← Nálezy Model
Co jsem naměřil na modelu qwen3.6-35b-a3b Pět nálezů, ve kterých jsem měřil model qwen3.6-35b-a3b — lokálně, česky, na jedné domácí sestavě. Nejnovější je z 3. 8. 2026. Kvantizace, konverze i běhové prostředí se posouvají po týdnech, takže po půl roce ber čísla jako historii.
MÝLIL JSEM SE 26 %v kanálu, který čtu · 0 % ve zbytku Slovo, které model nikdy neřekl Asistent měsíc používal české slovo, které neexistuje. Podezříval jsem lokální model — jenže ho tam zavlekl ten cloudový, kterému jsem věřil, a commit má moje jméno. pravidla · provoz3. 8. ZMĚŘENO 4,4×víc tokenů na přemýšlení Rychlejší model, který přemýšlí stejně dlouho Model, který generuje čtyřikrát rychleji, stráví přemýšlením přesně stejný čas jako pomalý. Celý náskok padne na tokeny, které uživatel nikdy neuvidí. modely · výkon2. 8. SELHALO 23s — a vymyšlený závěr Komponenta, jejíž výstup nikdo nečte Komprese je komponenta, jejíž výstup nikdo nečte — a stává se stavem konverzace. Chyba v odpovědi je tvrzení, chyba v kompresi je fakt bez zdroje. paměť · architektura1. 8. ZMĚŘENO 52,3tok/s proti 12,4 Čtyřikrát rychlejší, dvakrát méně spolehlivý Čtyřikrát rychlejší generování, přestože je soubor větší. Jenže selhání přicházejí dvakrát rychleji než správné odpovědi. modely · výkon2. 8. MÝLIL JSEM SE 0z 52 pokusů Zákaz je slabý nástroj Tvrdil jsem, že zákaz chybu vyvolá. Kontrolovaný pokus to nedoložil ani jednou z 52 běhů — a ukázal, že tři původní případy nedokládaly totéž. pravidla · evaluace2. 8. Jeden stroj, jeden člověk, málo běhů. Všechna čísla tady jsou měřená na jediné sestavě (Mac mini M4 Pro, 64 GB) nad dokumenty jednoho člověka v češtině, obvykle ve dvou až čtyřech opakováních. Jsou to indicie z konkrétního nasazení, ne benchmark — co to znamená a na čem přesně .
Tahle stránka odpovídá na jednu otázku. Značka, téma a model se ale dají složit i dohromady — otevři tutéž volbu ve skládacím filtru a přidej k ní další osy nebo hledaný výraz.
Všech dvacet čtyři nálezů