Google má problém: nový Gemini 3.6 Flash přináší nečekané zklamání

Google tiše vypustil nový model Gemini 3.6 Flash, ale reakce komunity jsou překvapivě negativní. Podle prvních testů jde o jeden z nejslabších modelů, které firma letos uvedla. Uživatelé hlásí horší přesnost, časté halucinace a problémy s logikou — a to i ve scénářích, které starší verze zvládaly bez potíží.

Google bez většího mediálního humbuku vydal nový model Gemini 3.6 Flash, který měl být rychlou a lehkou alternativou k výkonnějším variantám. Jenže podle prvních testů jde o jeden z nejslabších modelů, které Google letos uvedl. Uživatelé na sociálních sítích i v komunitních fórech upozorňují, že model často selhává v základních úlohách, má problémy s logickým uvažováním a generuje odpovědi, které působí jako halucinace. Uvádí se, že „může jít o nejhorší model, který Google dosud vydal“.

Gemini 3.6 Flash, který nabízí kontextové okno s 1 milionem tokenů, což odpovídá 1 500 stranám textu A4, 30 000 řádkům kódu nebo hodině videa, a jeho cena je 7,5 dolarů za 1 milion výstupních tokenů . Program také podporuje textové, obrazové, řečové a video vstupy.

Model měl být určený pro rychlé dotazy, jednoduché úkoly a aplikace, kde je důležitá nízká latence. Jenže podle uživatelů Gemini 3.6 Flash nezvládá ani běžné scénáře, které předchozí verze řešily bez potíží. Objevují se chyby v matematice, nesprávné interpretace textu a problémy s konzistencí odpovědí. Někteří uživatelé uvádějí, že model působí jako downgrade oproti starším verzím Flash.

Google Gemini 3.6 Flash dosáhl skóre 50 v indexu umělé analýzy inteligence (Artificial Analysis Intelligence Index) , který měří výkon modelů umělé inteligence v oblasti agentního, obecného, ​​kódovacího a vědeckého uvažování.

Ve skutečnosti je toto skóre horší než to, co dosáhly Meta Spark 1.1, GLM-5.2, GPT-5.6 Luna, Sonnet 5, Grok 4.5 a GPT-5.6 Terra!

Hloubější ponoření odhalí, že Google Gemini 3.6 Flash je ve většině benchmarků často překonáván levnějšími a staršími modely. Například v SWE-Bench Pro (Public) ho poráží Grok 4.5, který debutoval 8. července, a Claude Sonnet 5 v MLE Bench.

Google zatím situaci nekomentoval, ale je pravděpodobné, že model bude v následujících týdnech aktualizován. Firma se v posledních měsících snaží zrychlit vývoj a vydávání nových verzí Gemini, což může být jedním z důvodů, proč se některé modely dostávají ven dříve, než jsou plně odladěné. Komunita však očekává rychlou nápravu — zejména proto, že Flash modely jsou klíčové pro integraci v mobilních aplikacích a službách, kde je rychlost zásadní.

Doporučené TECHPress

RECENZE: Corasair HS35 v3 Wireless – dostupný headset, který překvapuje moderní...

Řada HS od Corsairu byla vždy synonymem dostupnosti a jednoduchosti. Zatímco HS80 disponuijí pokročilými funkcemi, tak modely HS35...

Více z této kategorie

Doporučené