Google у середу представила Gemini 3.8 Flash — модель, яка набрала 59 балів у незалежному індексі інтелекту, при цьому коштує значно дешевше за чільні конкурентні системи. Паралельно запущено й закриту кібербезпекову збірку.
Ключові тези
- Gemini 3.8 Flash набирає 59 балів в Artificial Analysis Intelligence Index — це на три бали більше за версію, що вийшла три тижні тому.
- Ціни на токени до 31 грудня фіксовані: $0,75 за мільйон вхідних та $3,75 за мільйон вихідних. Вартість одного завдання при цьому приблизно на 40% вища, ніж у попередньої моделі.
- Окремий варіант для кібербезпеки надається лише перевіреним урядовим структурам, критичній інфраструктурі та мейнтейнерам ПЗ через нову програму Fairwind.
Результати бенчмарків Gemini 3.8 Flash
Компанія представила обидві версії 2 вересня — це вже третій реліз лінійки Flash за шість тижнів. Обидві моделі базуються на єдиному ядрі, інтенсивно натренованому на задачах кібербезпеки.
Одна модифікація орієнтована на програмування та агентні сценарії, інша — на пошук вразливостей у великих кодових базах із набагато жорсткішим режимом доступу.
У режимі «посиленого міркування» модель набиває 59 балів в Artificial Analysis Intelligence Index — на три бали вище за 3.7 Flash і на рівні з GPT-5.6 Sol та Grok 4.6. У тесті HLE-Verified, який вимірює багатокрокове міркування в науці, гуманітаристиці та професійних дисциплінах, Gemini показує 54,9%. У Google зазначають, що найбільший прогрес помітний у задачах довгострокової розробки ПЗ.
Стартові тарифи компанія залишила без змін до 31 грудня: $0,75 за мільйон вхідних токенів і $3,75 за мільйон вихідних. З 1 січня обидві ставки подвоюються.
Також читайте: Claude Fable 5.1 виходить із читанням кешу по $0,25 і захистом від копіювання
Чому Gemini дорожчає на рівні завдання
Дешевший токен не означає дешевшу задачу. Середня вартість бенчмарк-завдання зросла до $0,58 — приблизно на 40% вище, ніж у попередника. Причина — середній обсяг відповіді зріс майже на 30%, до близько 48 000 токенів, а агентні запуски вимагають більше кроків.
Для порівняння, флагманський конкурент Anthropic бере майже вшестеро більше за аналогічне завдання, тому пропозиція Google все ще залишається на ціновому «фронтирі».
За словами старшої директорки з продукту Tulsee Doshi та керівниці з безпеки Gemini в Google DeepMind Raluca Ada Popa, модель «просто працює інтенсивніше»: додає кроки міркування і частіше викликає інструменти. Команди, які хочуть зберегти попередню структуру витрат, можуть залишатися на 3.7 Flash, тоді як передплатники Pro та Ultra отримують доступ до нової версії в застосунку Gemini, у режимі AI Mode та в Google Sheets.
Програма Fairwind обмежує доступ до кіберзбірки
Варіант моделі для кібербезпеки зачинений за рамками нової програми Fairwind, учасниками якої можуть стати лише перевірені державні органи, оператори критичної інфраструктури та відповідальні мейнтейнери ПЗ.
На внутрішньому тесті, що охоплював 20 мов програмування, модель виявляла вразливості з успішністю понад 70%. За оцінкою Google, команда безпеки Chrome з її допомогою створювала в 2,6 раза більше коректних виправлень, ніж набагато потужніші комерційні аналоги. Окрема хмарна дослідницька команда змогла відстежити критичну вразливість менш ніж за дві години — завдання, яке зазвичай займає місяці.
Швидкий темп релізів контрастує з непростим періодом для AI-підрозділу: червневий дедлайн для Gemini 3.5 Pro компанія так і не виконала.
У серпні генеральний директор DeepMind Demis Hassabis залишив посаду і перейшов у крісло голови ради директорів, а керівництво операційною діяльністю перебрав на себе Koray Kavukcuoglu, отримавши нижчий ранг старшого віцепрезидента.
Читайте далі: Bitcoin-ETF залучили $216,7 млн, відігравши одноденний відтік коштів





