Anthropic випустила Claude Haiku 5.5 — першу малу модель компанії з контролем зусиль. Модель призначена для масових дешевих запитів: стислих переказів, класифікації та суміжних задач.

За даними Techmeme, Anthropic називає Claude Haiku 5.5 «найдешевшим, найшвидшим і найздатнішим з малих моделей, який ми випускали». Білдер може винести рутинний шар пайплайна — переказ фрагментів, тегування, модерацію, розподіл запитів — з дорогої моделі без зміни архітектури.

Що таке effort-контролі в Claude Haiku 5.5?

Effort-контролі, ймовірно, задають, скільки обчислень модель витрачає на відповідь. Anthropic не розкриває в анонсі, як працює механізм, тому семантику параметра перевірте в документації, а не в пресрелізі.

Дешеві запити не мають оплачувати розуміння рівня топових моделей. Контроль бюджету додає спосіб платити менше за той самий запит.

Розробник задає бюджет сам. Там, де потрібна передбачувана відповідь за фіксований час — класифікація в реалтаймі, модерація перед показом, — бюджет можна зменшити, а там, де важлива якість, — збільшити.

Де реально зекономити?

Claude Haiku 5.5 пасує там, де відповідь не вимагає найсильнішої моделі: короткі перекази, класифікація, модерація, чорнові чернетки. Ви множите кількість запитів на ціну токена, тож дешевша одиниця зменшує саме цей добуток.

У зведенні, на яке веде посилання, цін за токен немає. Перед запуском відкрийте таблицю цін Anthropic і перерахуйте вартість свого типового запиту.

Ймовірно, у продукті з погодинною тарифікацією або оплатою за запит дешевий класифікатор помітно зменшить собівартість, але точну цифру покаже лише ваш обсяг запитів.

Швидкість вимірюється грошима лише частково. Протестуйте Claude Haiku 5.5 на своїх записах і власному eval-наборі, перш ніж міняти модель у продакшні.

З чого почати зараз?

Команда може перевірити Claude Haiku 5.5 за день без зміни промптів.