Gemini 3.6 Flash, 3.5 Flash-Lite і 3.5 Flash Cyber: три нові моделі Google для агентів

Людина дивиться на трьох роботів різного розміру, ніби обираючи між ними

Google випустила одразу три моделі — і жодна з них не Gemini 3.5 Pro

21 липня 2026 року Google представила нове поповнення лінійки Gemini: 3.6 Flash, 3.5 Flash-Lite і 3.5 Flash Cyber. Якщо ви чекали на 3.5 Pro — доведеться почекати ще: компанія прямо каже, що ця модель усе ще тестується з партнерами, а тим часом уже стартувало навчання Gemini 4, яке Google називає “найамбітнішим претрейнінгом за всю історію” лінійки.

Натомість Google зробила ставку на те, що реально потрібно розробникам агентних систем просто зараз: не одну гучну флагманську модель, а три вузько заточені інструменти для різних задач — швидкість, дешевизну і кібербезпеку. Розберемось по черзі, що змінилось у кожній.

Gemini 3.6 Flash: робоча конячка лінійки стала і швидшою, і дешевшою

Офіційна промо-ілюстрація Google до анонсу Gemini 3.6 Flash, 3.5 Flash-Lite і Flash Cyber
Офіційна ілюстрація з блогу Google до анонсу трьох нових моделей Gemini

 

3.6 Flash — це наступник 3.5 Flash, і головна фішка тут не в тому, що модель стала розумнішою (хоча й це теж), а в тому, що вона стала економнішою. За даними Google, 3.6 Flash споживає на 17% менше вихідних токенів, ніж 3.5 Flash, на тому самому бенчмарку Artificial Analysis Index, а на окремих задачах на кшталт DeepSWE економія сягає аж 65%.

Якщо перекласти це на людську мову: модель витрачає менше “слів” на роздуми й проміжні кроки, щоб дійти до тієї самої відповіді. А що менше токенів — то менша ціна за кожен запит, навіть якщо номінальна вартість токена не змінилась. До речі, вона таки змінилась — 3.6 Flash коштує $1.50 за мільйон вхідних і $7.50 за мільйон вихідних токенів, що дешевше за 3.5 Flash.

При цьому якість не просіла, а подекуди й виросла: на DeepSWE (тест на якість написання коду) 3.6 Flash показує 49% проти 37% у 3.5 Flash, на MLE Bench (дослідницькі задачі з машинним навчанням) — 63.9% проти 49.7%, а на OSWorld-Verified (керування комп’ютером — тобто здатність моделі самостійно клацати по інтерфейсу, а не тільки писати код) — 83.0% проти 78.4%. Computer use (можливість моделі самостійно керувати курсором і вікнами) тепер вбудована прямо як інструмент в API та Gemini Enterprise, а не окрема експериментальна фіча.

Gemini 3.5 Flash-Lite: наймасовіша модель лінійки

Якщo 3.6 Flash — це робоча конячка, то 3.5 Flash-Lite — це спринтер. Це наймасовіша і найдешевша модель 3.5-го покоління, розрахована на задачі, де важлива не глибина міркувань, а швидкість і об’єм: масова обробка документів, агентний пошук, класифікація тексту у великих кількостях.

Цифри тут промовисті: за даними Artificial Analysis, модель видає 350 вихідних токенів за секунду — це найшвидший показник у всій 3.5-й лінійці. Ціна — $0.3 за мільйон вхідних токенів і $2.5 за мільйон вихідних, тобто зовсім не флагманський прайс. І, що цікавіше, за словами Google, на низці агентних бенчмарків (Terminal-Bench 2.1, SWE-Bench Pro, OSWorld-Verified) 3.5 Flash-Lite обходить не тільки попередню Flash-Lite, а й повноцінну модель 3 Flash — тобто найдешевша модель нового покоління вже конкурує з не найдешевшою моделлю попереднього.

Практично це означає, що розробники, які будують агентів з десятками чи сотнями викликів моделі на одну задачу (наприклад, рій під-агентів, які паралельно обробляють шматки великого документа), можуть переключити частину навантаження на Flash-Lite і суттєво зекономити, не сильно втрачаючи в якості там, де глибокі роздуми не потрібні.

Gemini 3.5 Flash Cyber: модель, яку звичайні користувачі не отримають

Третя новинка стоїть окремо від перших двох — і не тільки за назвою. 3.5 Flash Cyber — це спеціалізована версія Flash, донавчена конкретно на пошук і виправлення вразливостей у коді. Вона працює всередині CodeMender — агента Google для автоматичного аналізу безпеки коду, і в цій зв’язці кілька копій 3.5 Flash Cyber одночасно аналізують кодову базу й видають один зведений звіт про знайдені й уже виправлені вразливості.

Ось де це стає цікаво: Google свідомо НЕ випускає цю модель у відкритий доступ. 3.5 Flash Cyber буде доступна виключно урядам і довіреним партнерам через CodeMender, у форматі обмеженого пілотного доступу. Логіка проста і чесна: модель, натренована ефективно й дешево знаходити вразливості в коді, — це та сама технологія подвійного призначення, яку так само ефективно можна використати не для захисту, а для атаки. Тому Google обирає обережний, контрольований розкат замість публічного релізу — щоб дати захисникам фору, а не роздати інструмент усім охочим одразу.

Чому Google робить ставку саме на Flash, а не форсує Pro

Це не випадковий порядок релізів, а свідома стратегія. Google прямо пише: розробники й компанії, що будують продакшн-агентів, потребують не стільки максимальної “розумності” моделі, скільки токен-ефективності, низької затримки відповіді і стабільності на масштабі — тобто саме тих речей, де Flash-лінійка традиційно сильніша за важчі Pro-моделі.

Простіше кажучи: коли агент робить сотні викликів моделі поспіль, щоб виконати одну задачу, різниця в ціні й швидкості між моделями множиться на ці сотні викликів — і раптом стає набагато важливішою за кілька відсотків додаткової “розумності” в бенчмарку. Тому поки Gemini 3.5 Pro усе ще доводиться до розуму в тестах з партнерами, Google одразу закриває практичну потребу ринку трьома вузькоспеціалізованими Flash-моделями.

Де вже можна спробувати Gemini 3.6 Flash і 3.5 Flash-Lite

Обидві публічні моделі — 3.6 Flash і 3.5 Flash-Lite — доступні вже сьогодні:

  • розробникам — через Gemini API в Google AI Studio та Android Studio; 3.6 Flash додатково доступна в Google Antigravity;
  • компаніям — через Gemini Enterprise Agent Platform і застосунок Gemini Enterprise;
  • звичайним користувачам — прямо в застосунку Gemini; 3.5 Flash-Lite також поступово розкочується всередині Google Пошуку, де відповідає за агентний пошук (коли система сама уточнює запит і збирає відповідь із кількох джерел, а не просто видає список посилань).

3.5 Flash Cyber, нагадаємо, лишається закритою — доступ до неї тільки через партнерську програму CodeMender.

Що це означає для звичайного користувача

Якщо ви просто заходите в застосунок Gemini поспілкуватись — різниця відчується непрямо: відповіді можуть стати трохи швидшими й точнішими там, де модель під капотом уже перемкнулась на 3.6 Flash. Куди помітніше це буде для тих, хто користується продуктами на базі Gemini API — розробники за лаштунками отримують суттєво дешевший і швидший інструмент для побудови агентів, а це рано чи пізно позначається і на ціні та якості кінцевих продуктів, якими користуються звичайні люди.

А головна інтрига в цій історії, схоже, ще попереду: поки Google обережно доводить до пуття Gemini 3.5 Pro в закритому тестуванні, а паралельно вже розганяє претрейнінг Gemini 4 — саме ці два релізи, а не сьогоднішні Flash-моделі, стануть справжнім тестом того, наскільки Google готова конкурувати на рівні найважчих флагманів GPT і Claude.

Підпишіться на новини про штучний інтелект!

Ви будете отримувати від нас листи раз на тиждень.
Політика конфіденційності

Залишити коментар

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *

Прокрутка до верху