Alcune risposte eccessivamente complesse qui. La tecnica Debruin dovrebbe essere usata solo quando l'input è già una potenza di due, altrimenti c'è un modo migliore. Per una potenza di 2 input, Debruin è il più veloce in assoluto, persino più veloce di _BitScanReverse
qualsiasi processore che ho testato. Tuttavia, nel caso generale, _BitScanReverse
(o qualunque sia l'intrinseco viene chiamato nel compilatore) è il più veloce (su alcune CPU può essere microcodificato).
Se la funzione intrinseca non è un'opzione, ecco una soluzione software ottimale per l'elaborazione degli input generali.
u8 inline log2 (u32 val) {
u8 k = 0;
if (val > 0x0000FFFFu) { val >>= 16; k = 16; }
if (val > 0x000000FFu) { val >>= 8; k |= 8; }
if (val > 0x0000000Fu) { val >>= 4; k |= 4; }
if (val > 0x00000003u) { val >>= 2; k |= 2; }
k |= (val & 2) >> 1;
return k;
}
Nota che questa versione non richiede una ricerca di Debruin alla fine, a differenza della maggior parte delle altre risposte. Calcola la posizione in atto.
Le tabelle possono essere preferibili, tuttavia, se le chiami ripetutamente abbastanza volte, il rischio di un errore nella cache viene eclissato dalla velocità di una tabella.
u8 kTableLog2[256] = {
0,0,1,1,2,2,2,2,3,3,3,3,3,3,3,3,4,4,4,4,4,4,4,4,4,4,4,4,4,4,4,4,
5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,5,
6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,
6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,6,
7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,
7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,
7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,
7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7
};
u8 log2_table(u32 val) {
u8 k = 0;
if (val > 0x0000FFFFuL) { val >>= 16; k = 16; }
if (val > 0x000000FFuL) { val >>= 8; k |= 8; }
k |= kTableLog2[val]; // precompute the Log2 of the low byte
return k;
}
Questo dovrebbe produrre il rendimento più alto di qualsiasi risposta software qui fornita, ma se lo chiami solo occasionalmente, preferisci una soluzione senza tabelle come il mio primo frammento.