Gemini 3.8 Flash е третият бюджетен модел на Google за шест седмици, докато водещите модели остават в неизвестност
Три седмици след Gemini 3.7 Flash Google отново представя Gemini 3.8 Flash. Очаква се бюджетният модел да превъзхожда значително предшественика си при програмиране.
Google пуска Gemini 3.8 Flash в две версии: универсален модел за разсъждение и програмиране и специализирана версия за киберсигурност, наречена 3.8 Flash Cyber. Това е третото издание на Flash само за шест седмици и дали този бърз ритъм е знак за сила или разсейване от все още липсващите водещи модели Gemini 3.5 Pro и Gemini 4 зависи от това кого ще попитате. Новият ръководител на DeepMind Корай Кавукчуоглу даде ясно да се разбере, че Google не преследва единствено оптимизация на съотношението цена-производителност и все още иска да бъде лидер и по отношение на чистите възможности.
Според собствените данни на Google Gemini 3.8 Flash постига 73,7 процента в бенчмарка DeepSWE v1.1 за дългосрочни задачи по софтуерно инженерство. Това е малко под Claude Opus 5 с 74,0 процента, но значително над Claude Sonnet 5 (53,8%), GPT-5.6 Sol (72,7%) и предишния 3.7 Flash (65,3%).

Google също така твърди, че новият модел се е подобрил при генерирането на 3D съдържание. Видеото по-долу показва 3D игра, която според съобщенията Gemini 3.8 Flash е създал от една-единствена подкана в инструмента за програмиране с изкуствен интелект Antigravity на Google. Текстурите са генерирани с модела за изображения Nano Banana на Google.
Gemini 3.8 Flash се представя на намалена цена от 0,75 долара за милион входни токени и 3,75 долара за милион изходни токени, същата като при 3.7 Flash. От януари 2027 г. редовната цена ще се повиши до 1,50 и 7,50 долара. Claude Opus 5 струва 5,00 долара за милион входни токени и 25,00 долара за изходни токени, докато GPT-5.6 Sol е на цена от 4,00 и 20,00 долара. Дори след изтичането на въвеждащите цени Gemini 3.8 Flash ще остане значително по-евтин на токен от водещите модели на OpenAI и Anthropic.
Google обаче обяснява част от подобренията в производителността спрямо 3.7 с това, че 3.8 Flash изпълнява допълнителни стъпки на разсъждение при сложни задачи и извиква инструментите итеративно. Моделът „работи по-усилено“, казва Google, което означава по-високо потребление на токени, частично компенсиращо по-ниската цена на токен. За случаи на употреба, при които ефективността на изчисленията е от най-голямо значение, Google препоръчва по-ниски нива на разсъждение или да се използва все още поддържаният 3.7 Flash.
Gemini 3.8 Flash е достъпен за разработчици чрез Google AI Studio, Google Antigravity и Android Studio. Бизнесите могат да получат достъп до него чрез Gemini Enterprise. Потребителите го получават в приложението Gemini, в режима за търсене с изкуствен интелект на Google, а платените абонати — и в Google Sheets.
Отлично съотношение цена-качество, но разходите за токени се натрупват
Независимата платформа за сравнителни тестове Artificial Analysis дава на Gemini 3.8 Flash оценка 59 в Intelligence Index — с три точки над предшественика му 3.7 Flash, който има 56. Това го поставя наравно с GPT-5.6 Sol при разсъждение xhigh и Grok 4.6 при средно ниво на разсъждение, като и двата също получават 59 точки. Според Artificial Analysis подобренията в Intelligence Index се дължат главно на по-силното представяне в агентни бенчмаркове, като използване на инструменти и задачи по програмиране.

По отношение на разходите за задача 3.8 Flash достига границата на Парето според Artificial Analysis, като струва 0,58 долара за задача и е най-евтиният модел на своето ниво на интелигентност. Тази стойност обаче се е повишила с около 40 процента спрямо 3.7 Flash, който струва 0,40 долара, въпреки че цената на токен е останала същата. Вероятно затова Google препоръчва да се използва 3.7 Flash при работни натоварвания, фокусирани върху ефективността.
При високи нива на разсъждение 3.8 Flash генерира около 300 изходни токена в секунда, със средно време за задача от 2,5 минути. Това е малко по-бързо от GPT-5.6 Luna (2,6 минути) и GPT-5.6 Terra (3,3 минути), но по-бавно от Claude Fable 5.1 (2,1 минути) и по-стария 3.7 Flash (2,2 минути). При ниски нива на разсъждение времето спада до около 48 секунди.
Моделът за киберсигурност остава ограничен до проверени защитници
Gemini 3.8 Flash Cyber, подобно на предшественика си 3.5 Flash Cyber, не е публично достъпен. Google го разпространява чрез програмата Fairwind до държавни агенции, оператори на критична инфраструктура и поддържащи софтуер разработчици. Моделът има по-малко ограничителни настройки за безопасност от стандартната версия, тъй като е създаден за отбранителна работа в областта на киберсигурността.
В CyberGym, стандартния за индустрията бенчмарк за откриване на уязвимости в C/C++, 3.8 Flash Cyber получава 86,2 процента според Google, изпреварвайки предишния 3.5 Flash Cyber (77,5%), GPT-5.6 Sol (83,6%) и GPT-5.5-Cyber (85,6%). При автоматизирано отстраняване на уязвимости във външния CWE-Bench 3.8 Flash Cyber постига 47,2 процента Pass@1, почти изравнявайки се с водещия водещ модел с 47,8 процента, като същевременно струва много по-малко.
Моделът изглежда и по-устойчив на атаки чрез инжектиране на подкани. В бенчмарка IPI на Gray Swan Gemini 3.8 Flash постига степен на успешни атаки от едва 5,5 процента. DeepSeek V4 Pro достига 60,1 процента, Kimi K3 — 52,7 процента, а Grok 4.6 — 51,8 процента. Единствено Claude Opus 5 на Anthropic се представя малко по-добре с 4,8 процента, а Opus 5 с допълнителните си опции за сигурност постига още по-нисък резултат в екосистемата на Claude.
Новини за изкуствения интелект без хайпа – подбрани от хора
Абонирайте се за THE DECODER за четене без реклами, седмичен бюлетин за изкуствения интелект, нашия ексклузивен шест пъти годишно доклад за водещите модели „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.