Tengo una lista de cadenas que quiero ordenar por dos funciones clave personalizadas en Python 3.6. Al comparar el enfoque de ordenación múltiple (ordenar por la clave menor y luego por la clave principal) con el enfoque de clave múltiple (tomando la clave como la tupla (major_key, lesser_key) ), pude ver que este último es más de 2 veces más lento que el primero, lo cual fue una sorpresa ya que pensé que eran equivalentes. Me gustaría entender por qué esto es así.
import random from time import time largest = 1000000 length = 10000000 start = time() lst = [str(x) for x in random.choices(range(largest), k=length)] t0 = time() - start start = time() tmp = sorted(lst, key=lambda x: x[::2]) l1 = sorted(tmp, key=lambda x: ''.join(sorted(x))) t1 = time() - start start = time() l2 = sorted(lst, key=lambda x: (''.join(sorted(x)), x[::2])) t2 = time() - start print(f'prepare={t0} multisort={t1} multikey={t2} slowdown={t2/t1}') assert l1 == l2