在 Python 中创建按字母顺序排序的列表的最佳方法是什么?
11 回答
基本答案:
mylist = ["b", "C", "A"]
mylist.sort()
这会修改您的原始列表(即就地排序)。要获取列表的排序副本,而不更改原始列表,请使用以下sorted()
函数:
for x in sorted(mylist):
print x
但是,上面的示例有点幼稚,因为它们没有考虑语言环境,并且执行区分大小写的排序。您可以利用可选参数key
来指定自定义排序顺序(替代方案 usingcmp
是一个已弃用的解决方案,因为它必须多次评估 -key
每个元素仅计算一次)。
因此,要根据当前语言环境进行排序,考虑到特定于语言的规则(cmp_to_key
是 functools 的辅助函数):
sorted(mylist, key=cmp_to_key(locale.strcoll))
最后,如果需要,您可以指定自定义区域设置进行排序:
import locale
locale.setlocale(locale.LC_ALL, 'en_US.UTF-8') # vary depending on your lang/locale
assert sorted((u'Ab', u'ad', u'aa'),
key=cmp_to_key(locale.strcoll)) == [u'aa', u'Ab', u'ad']
最后一点:您将看到使用该方法的不区分大小写排序的示例lower()
- 这些是不正确的,因为它们仅适用于 ASCII 字符子集。这两个对于任何非英语数据都是错误的:
# this is incorrect!
mylist.sort(key=lambda x: x.lower())
# alternative notation, a bit faster, but still wrong
mylist.sort(key=str.lower)
list.sort()
真的就是这么简单:)
对字符串进行排序的正确方法是:
import locale
locale.setlocale(locale.LC_ALL, 'en_US.UTF-8') # vary depending on your lang/locale
assert sorted((u'Ab', u'ad', u'aa'), cmp=locale.strcoll) == [u'aa', u'Ab', u'ad']
# Without using locale.strcoll you get:
assert sorted((u'Ab', u'ad', u'aa')) == [u'Ab', u'aa', u'ad']
前面的示例mylist.sort(key=lambda x: x.lower())
适用于纯 ASCII 上下文。
请在 Python3 中使用 sorted() 函数
items = ["love", "like", "play", "cool", "my"]
sorted(items2)
但这如何处理特定于语言的排序规则?是否考虑了语言环境?
不,list.sort()
是通用的排序功能。如果要根据 Unicode 规则进行排序,则必须定义自定义排序键函数。你可以尝试使用pyuca模块,但不知道它有多完整。
老问题,但如果你想在不设置的情况下进行区域感知排序,你可以按照 这个答案的建议locale.LC_ALL
使用PyICU 库来做到这一点:
import icu # PyICU
def sorted_strings(strings, locale=None):
if locale is None:
return sorted(strings)
collator = icu.Collator.createInstance(icu.Locale(locale))
return sorted(strings, key=collator.getSortKey)
然后调用例如:
new_list = sorted_strings(list_of_strings, "de_DE.utf8")
这对我有用,无需安装任何语言环境或更改其他系统设置。
(这已经在上面的评论中提出过,但我想更加突出它,因为我自己一开始就错过了。)
认为s = "ZWzaAd"
要对以上字符串进行排序,简单的解决方案将低于一个。
print ''.join(sorted(s))
或许:
names = ['Jasmine', 'Alberto', 'Ross', 'dig-dog']
print ("The solution for this is about this names being sorted:",sorted(names, key=lambda name:name.lower()))
l =['abc' , 'cd' , 'xy' , 'ba' , 'dc']
l.sort()
print(l1)
结果
['abc', 'ba', 'cd', 'dc', 'xy']
很简单: https ://trinket.io/library/trinkets/5db81676e4
scores = '54 - Alice,35 - Bob,27 - Carol,27 - Chuck,05 - Craig,30 - Dan,27 - Erin,77 - Eve,14 - Fay,20 - Frank,48 - Grace,61 - Heidi,03 - Judy,28 - Mallory,05 - Olivia,44 - Oscar,34 - Peggy,30 - Sybil,82 - Trent,75 - Trudy,92 - Victor,37 - Walter'
score = score.split(',') for x in sorted(scores): print(x)