Claude Fable 5.1: кеш дешевший на 75% — кому це вигідно

Розробниця зіставляє два рахунки за API поруч із роботом-помічником

Anthropic випустила Claude Fable 5.1 і не знизила жодної базової ставки. Вхідні токени як коштували $10 за мільйон, так і коштують, вихідні — $50. Але рахунок за ту саму роботу має стати меншим.

Фокус у третій цифрі, яку мало хто взагалі дивиться, — ціні читання кешу. Вона впала на 75%, до $0,25 за мільйон токенів. Реліз — 1 вересня 2026 року.

Що таке кеш і чому він тут головний

Коли ви ганяєте агента по одній задачі, він не починає щоразу з чистого аркуша. На кожному кроці модель знову отримує те саме: системний промпт, опис інструментів, куски коду чи документів, історію попередніх кроків. Це й є кеш: незмінна частина контексту, яку провайдер зберігає й підставляє знову, замість того щоб обробляти з нуля.

Читання кешу завжди було дешевше за звичайний вхід, але в довгих задачах його набігає багато. Сотня кроків агента — це сотня повторних читань того самого контексту. Саме тому зниження саме цієї ставки б’є сильніше, ніж виглядає на папері.

Скільки це економить насправді

Anthropic називає дві цифри: приблизно 25% економії на типових задачах проти Fable 5 і до приблизно 45% на виражено агентній роботі.

Що оплачується Ціна за мільйон токенів
Вхідні токени $10 — без змін
Вихідні токени $50 — без змін
Читання кешу $0,25 — на 75% менше

Звідси випливає практичний наслідок. Якщо ви ганяєте короткі одноразові запити — перекласти абзац, переписати опис товару — кеш у вас майже не задіяний, і обіцяні відсотки ви побачите хіба на папері. Якщо ж у вас агент, який півгодини лазить по коду чи документах — ефект буде відчутний.

І все ж це оцінка виробника на його власних сценаріях, а не гарантія для вашого проєкту. І точно не знижка на підписку Claude — йдеться виключно про API.

Mythos 5.1 — це не альтернатива в меню

Разом із Fable 5.1 анонсували Mythos 5.1. Моделі однакові за можливостями й відрізняються рівнем захисних обмежень: Mythos налаштована під роботу в кібербезпеці та науках про життя.

Доступ до неї закритий: дві програми верифікації — для фахівців із захисної безпеки та для дослідників, причому друга поки відкрита лише для організацій зі США. Логіка та сама, що й торік: ми вже розбирали, як Mythos 5 шукає вразливості в коді і чому такі моделі не роздають усім.

Тож якщо в оглядах ви бачите вражаючі результати Mythos — це не та модель, яку ви підключите в свій проєкт у вівторок.

Чи працює це з України

Fable 5.1 загальнодоступна від дня релізу — через власний API Anthropic і через партнерські хмари: Amazon Web Services, Google Cloud та Microsoft Azure.

Україна є в переліку підтриманих країн, але компанія окремо виключає Крим та Донецьку, Луганську, Херсонську й Запорізьку області. Якщо ви тільки прицілюєтесь до екосистеми, почніть із базового огляду, як користуватись Клодом в Україні.

Як перевірити економію на своїй задачі

Відсотки з анонсу не переносяться на чужий проєкт автоматично. Зате їх легко перевірити за один вечір:

  1. Візьміть одну типову для себе задачу — таку, яку запускаєте щодня.
  2. Прогоніть її до кінця й випишіть три числа окремо: вхідні токени, вихідні й токени читання кешу.
  3. Подивіться на частку кешу. Якщо вона мала — економії не буде, і це нормальна відповідь.
  4. Перерахуйте ті самі числа за новими ставками — різниця й є вашою економією, а не тою, що в прес-релізі.

Якщо виявиться, що кешу в роботі мало, це частіше означає не «модель не та», а що задача розбита на дрібні незалежні виклики замість однієї довгої сесії. Перебудувати потік під сталий контекст часто дає більше, ніж зміна моделі. Про те, як складати такі повторювані сценарії, ми писали в гайді про власні скіли Claude, а про інструменти для агентів — у розборі browser use, Skills API і Files API.

Підпишіться на новини про штучний інтелект!

Ви будете отримувати від нас листи раз на тиждень.

Політика конфіденційності

Залишити коментар

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *

Прокрутка до верху