Google tiše vypustil nový model Gemini 3.6 Flash, ale reakce komunity jsou překvapivě negativní. Podle prvních testů jde o jeden z nejslabších modelů, které firma letos uvedla. Uživatelé hlásí horší přesnost, časté halucinace a problémy s logikou — a to i ve scénářích, které starší verze zvládaly bez potíží.
Google bez většího mediálního humbuku vydal nový model Gemini 3.6 Flash, který měl být rychlou a lehkou alternativou k výkonnějším variantám. Jenže podle prvních testů jde o jeden z nejslabších modelů, které Google letos uvedl. Uživatelé na sociálních sítích i v komunitních fórech upozorňují, že model často selhává v základních úlohách, má problémy s logickým uvažováním a generuje odpovědi, které působí jako halucinace. Uvádí se, že „může jít o nejhorší model, který Google dosud vydal“.
Gemini 3.6 Flash, který nabízí kontextové okno s 1 milionem tokenů, což odpovídá 1 500 stranám textu A4, 30 000 řádkům kódu nebo hodině videa, a jeho cena je 7,5 dolarů za 1 milion výstupních tokenů . Program také podporuje textové, obrazové, řečové a video vstupy.
Gemini 3.6 Flash literally got the same score on Artificial Analysis as 3.5 Flash.
Worse than Meta Spark 1.1, GLM-5.2, 5.6 Luna, Sonnet 5, Grok 4.5, 5.6 Terra… yikes. pic.twitter.com/0UjGhtCCTT
— leo 🐾 (@synthwavedd) July 21, 2026
Model měl být určený pro rychlé dotazy, jednoduché úkoly a aplikace, kde je důležitá nízká latence. Jenže podle uživatelů Gemini 3.6 Flash nezvládá ani běžné scénáře, které předchozí verze řešily bez potíží. Objevují se chyby v matematice, nesprávné interpretace textu a problémy s konzistencí odpovědí. Někteří uživatelé uvádějí, že model působí jako downgrade oproti starším verzím Flash.
Google Gemini 3.6 Flash dosáhl skóre 50 v indexu umělé analýzy inteligence (Artificial Analysis Intelligence Index) , který měří výkon modelů umělé inteligence v oblasti agentního, obecného, kódovacího a vědeckého uvažování.
Ve skutečnosti je toto skóre horší než to, co dosáhly Meta Spark 1.1, GLM-5.2, GPT-5.6 Luna, Sonnet 5, Grok 4.5 a GPT-5.6 Terra!
Gemini 3.6 Flash benchmarks are out, and it's… beaten by other models on code tasks, and is only really consistently SoTA on vision and context benchmarks. But hey, 3.1 Pro is now so old 3.6 Flash outperforms it across the board 😭 pic.twitter.com/3JDkJbezUn
— leo 🐾 (@synthwavedd) July 21, 2026
Hloubější ponoření odhalí, že Google Gemini 3.6 Flash je ve většině benchmarků často překonáván levnějšími a staršími modely. Například v SWE-Bench Pro (Public) ho poráží Grok 4.5, který debutoval 8. července, a Claude Sonnet 5 v MLE Bench.
Google zatím situaci nekomentoval, ale je pravděpodobné, že model bude v následujících týdnech aktualizován. Firma se v posledních měsících snaží zrychlit vývoj a vydávání nových verzí Gemini, což může být jedním z důvodů, proč se některé modely dostávají ven dříve, než jsou plně odladěné. Komunita však očekává rychlou nápravu — zejména proto, že Flash modely jsou klíčové pro integraci v mobilních aplikacích a službách, kde je rychlost zásadní.









