
6502:

   proc sebemodifikujici kod
   vyhodnost inverzniho carry pro SUB a CMP (v naslednem ROL se to hodilo nejmin na 2 mistech)

      kompilovany qbasic na 386DX 20 MHz je stejne rychly jako assembler na ATARI 800   
       takty:  plot  6502C_ATARI_800XL-GR0-1.7734475MHz 6502C_ATARI_800XL-1.7734475MHz 386DX-386asm-20MHz 8088-Bondwell8-86asm-4.77MHz 
       abs cas: plot 6502C_ATARI_800XL-GR0-1.7734475MHz 6502C_ATARI_800XL-1.7734475MHz 386DX-386asm-20MHz 8088-Bondwell8-86asm-4.77MHz  386DX-cQBASIC-20MHz 


AMD:

 plot2  Phenom-IIX4-980-x86asm-3700MHz Phenom-IIX4-980-AMD64asm-3700MHz

   Zde je videt ze tentyz procesor ve fast implementaci bezi stejne rychle
   jak v 32bit tak v 64bit modu, ale ve slow implementaci se ukazuje vyhoda
   AMD64 instrukci --- mozna to je nasobenim (na x86 je omezene ktere
   registry drzi vstup a kam pujde vysledek) --- OVERIT




----------------



 Na CPU s cachi je videt postupny rust memory wall

 porovnat delky kodu jednotlivych implementaci





 na modernich CPU je pomalejsi implementace rychlesi
    --- muze to byt tim ze sice pouziva nasobeni ale zase min registru a tim
        i zavislosti a CPU ma moznost spekulovat do vetsi hloubky


