Python analogica della funzione natsort di PHP (ordinare un elenco utilizzando un “ordine naturale” algoritmo) [duplicato]
Domanda
Questa domanda ha già una risposta qui:
Vorrei sapere se c'è qualcosa di simile a PHP natsort funzione in Python?
l = ['image1.jpg', 'image15.jpg', 'image12.jpg', 'image3.jpg']
l.sort()
dà:
['image1.jpg', 'image12.jpg', 'image15.jpg', 'image3.jpg']
ma mi piacerebbe avere:
['image1.jpg', 'image3.jpg', 'image12.jpg', 'image15.jpg']
Aggiorna
base di soluzione dal questo link
def try_int(s):
"Convert to integer if possible."
try: return int(s)
except: return s
def natsort_key(s):
"Used internally to get a tuple by which s is sorted."
import re
return map(try_int, re.findall(r'(\d+|\D+)', s))
def natcmp(a, b):
"Natural string comparison, case sensitive."
return cmp(natsort_key(a), natsort_key(b))
def natcasecmp(a, b):
"Natural string comparison, ignores case."
return natcmp(a.lower(), b.lower())
l.sort(natcasecmp);
Soluzione
mia risposta per Natural algoritmo di ordinamento :
import re
def natural_key(string_):
"""See http://www.codinghorror.com/blog/archives/001018.html"""
return [int(s) if s.isdigit() else s for s in re.split(r'(\d+)', string_)]
Esempio:
>>> L = ['image1.jpg', 'image15.jpg', 'image12.jpg', 'image3.jpg']
>>> sorted(L)
['image1.jpg', 'image12.jpg', 'image15.jpg', 'image3.jpg']
>>> sorted(L, key=natural_key)
['image1.jpg', 'image3.jpg', 'image12.jpg', 'image15.jpg']
Per supportare le stringhe Unicode, .isdecimal()
dovrebbe essere usato al posto di .isdigit()
. Vedere l'esempio in @ commento di phihag. Correlati: Come rivelare Unicodes numerico proprietà di valore
.isdigit()
può anche fallire (valore di ritorno che non è accettato da int()
) per un bytestring su Python 2 in alcuni locali ad esempio, '\ xb2' ( '²') in locale CP1252 su Windows .
Altri suggerimenti
È possibile controllare le terze parti natsort biblioteca sul PyPI:
>>> import natsort
>>> l = ['image1.jpg', 'image15.jpg', 'image12.jpg', 'image3.jpg']
>>> natsort.natsorted(l)
['image1.jpg', 'image3.jpg', 'image12.jpg', 'image15.jpg']
L'informativa completa, io sono l'autore.
Questa funzione può essere usata come argomento key=
per sorted
in Python 2 .x 3.x:
def sortkey_natural(s):
return tuple(int(part) if re.match(r'[0-9]+$', part) else part
for part in re.split(r'([0-9]+)', s))