Gemini 3.8 Flash — третя бюджетна модель Google за шість тижнів, тоді як передові моделі досі не з’явилися
Через три тижні після Gemini 3.7 Flash Google повертається з Gemini 3.8 Flash. Очікується, що бюджетна модель значно перевершить свою попередницю в програмуванні.
Google випускає Gemini 3.8 Flash у двох версіях: універсальну модель для міркувань і програмування та спеціалізовану версію для кібербезпеки під назвою 3.8 Flash Cyber. Це третій реліз Flash лише за шість тижнів, і те, чи свідчить така швидка періодичність про силу компанії, чи відволікає увагу від досі відсутніх передових моделей Gemini 3.5 Pro і Gemini 4, залежить від того, кого ви запитаєте. Новий керівник DeepMind Корай Кавукчуоглу чітко дав зрозуміти, що Google не просто прагне оптимізувати співвідношення ціни та продуктивності, а й досі хоче лідирувати за чистими можливостями.
Згідно з власними даними Google, Gemini 3.8 Flash набирає 73,7 відсотка в бенчмарку DeepSWE v1.1 для завдань програмної інженерії з тривалим горизонтом. Це трохи нижче за Claude Opus 5 із результатом 74,0 відсотка, але значно вище за Claude Sonnet 5 (53,8%), GPT-5.6 Sol (72,7%) і попередню модель 3.7 Flash (65,3%).

Google також заявляє, що нова модель стала кращою у 3D-генерації. На відео нижче показано 3D-гру, яку, як повідомляється, Gemini 3.8 Flash створила за одним запитом у інструменті Google для програмування за допомогою ШІ Antigravity. Текстури було створено за допомогою моделі Google для генерації зображень Nano Banana.
Gemini 3.8 Flash запускається за зниженою ціною $0,75 за мільйон вхідних токенів і $3,75 за мільйон вихідних токенів, що відповідає вартості 3.7 Flash. Починаючи із січня 2027 року, звичайна ціна зросте до $1,50 і $7,50. Claude Opus 5 коштує $5,00 за мільйон вхідних токенів і $25,00 за вихідні токени, тоді як GPT-5.6 Sol — $4,00 і $20,00 відповідно. Навіть після завершення періоду початкових цін Gemini 3.8 Flash залишатиметься значно дешевшою в розрахунку на токен, ніж топові моделі OpenAI та Anthropic.
Однак Google пояснює перевагу в продуктивності над 3.7, зокрема, тим, що 3.8 Flash виконує додаткові кроки міркування для складних завдань і багаторазово викликає інструменти. За словами Google, модель «працює старанніше», а це означає більше споживання токенів, що частково нівелює нижчу ціну за токен. Для випадків використання, де найбільше важлива обчислювальна ефективність, Google рекомендує нижчі рівні міркування або радить залишатися на моделі 3.7 Flash, яку все ще підтримують.
Gemini 3.8 Flash доступна розробникам через Google AI Studio, Google Antigravity і Android Studio. Компанії можуть отримати доступ до неї через Gemini Enterprise. Споживачі отримують її в застосунку Gemini, у режимі ШІ Google Search, а платні підписники — у Google Sheets.
Вигідне співвідношення ціни та якості, але витрати на токени накопичуються
Незалежна платформа для бенчмаркінгу Artificial Analysis оцінює Gemini 3.8 Flash у 59 балів за індексом інтелекту, що на три бали вище за попередню модель 3.7 Flash із результатом 56. Це ставить її на один рівень із GPT-5.6 Sol у режимі міркування xhigh і Grok 4.6 у режимі міркування medium — обидві також набрали 59 балів. За даними Artificial Analysis, зростання за індексом інтелекту здебільшого зумовлене кращою продуктивністю в агентних бенчмарках, зокрема у використанні інструментів і завданнях із програмування.

За показником вартості одного завдання 3.8 Flash, згідно з Artificial Analysis, досягає межі Парето, коштуючи $0,58 за завдання як найдешевша модель зі своїм рівнем інтелекту. Але цей показник приблизно на 40 відсотків вищий, ніж у 3.7 Flash, де він становить $0,40, хоча ціна за токен залишилася незмінною. Імовірно, саме тому Google рекомендує залишатися на 3.7 Flash для робочих навантажень, орієнтованих на ефективність.
За високих рівнів міркування 3.8 Flash генерує близько 300 вихідних токенів за секунду, а середній час виконання завдання становить 2,5 хвилини. Це трохи швидше, ніж GPT-5.6 Luna (2,6 хвилини) і GPT-5.6 Terra (3,3 хвилини), але повільніше, ніж Claude Fable 5.1 (2,1 хвилини) і старша модель 3.7 Flash (2,2 хвилини). За низьких рівнів міркування час скорочується приблизно до 48 секунд.
Модель для кібербезпеки залишається доступною лише перевіреним фахівцям із захисту
Gemini 3.8 Flash Cyber, як і її попередниця 3.5 Flash Cyber, недоступна для широкого загалу. Google поширює її через програму Fairwind серед державних установ, операторів критичної інфраструктури та супроводжувачів програмного забезпечення. Модель має менш обмежувальні налаштування безпеки, ніж стандартна версія, оскільки створена для захисної роботи у сфері кібербезпеки.
У CyberGym, галузевому стандартному бенчмарку для виявлення вразливостей у C/C++, 3.8 Flash Cyber, за даними Google, набирає 86,2 відсотка, випереджаючи попередню 3.5 Flash Cyber (77,5%), GPT-5.6 Sol (83,6%) і GPT-5.5-Cyber (85,6%). В автоматизованому виправленні на зовнішньому CWE-Bench 3.8 Flash Cyber досягає 47,2 відсотка Pass@1, майже зрівнюючись із провідною передовою моделлю, яка набирає 47,8 відсотка, і коштуючи значно дешевше.
Модель також, схоже, краще протистоїть атакам із впровадженням запитів. У бенчмарку Gray Swan IPI Gemini 3.8 Flash досягає показника успішності атак лише 5,5 відсотка. DeepSeek V4 Pro набирає 60,1 відсотка, Kimi K3 — 52,7 відсотка, а Grok 4.6 — 51,8 відсотка. Лише Claude Opus 5 від Anthropic показує трохи кращий результат — 4,8 відсотка, а Opus 5 із додатковими параметрами безпеки отримує ще нижчий показник в екосистемі Claude.
Новини ШІ без хайпу — кураторство людей
Підпишіться на THE DECODER, щоб читати без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний передовий звіт «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.