Anthropic представила Fable 5.1 і Mythos 5.1: ШІ менше бреше
Новий реліз Anthropic поєднує технологічні досягнення з жорсткішими вимогами до приватності. Компанія представила моделі, орієнтовані на роботу з корпоративними даними, програмування та складні дослідницькі завдання, а також оприлюднила оцінку потенційних ризиків їхньої автономної поведінки.
Приватність і контроль для корпоративних клієнтів
Ключовою зміною стала політика нульового зберігання даних — zero data retention. Вона дає змогу запускати моделі у власній інфраструктурі замовника, не передаючи конфіденційну інформацію на зовнішні сервери.
Такий підхід особливо важливий для компаній, які працюють із персональними даними, комерційною таємницею або чутливою інформацією у сферах фінансів, медицини й кібербезпеки.
Восени Anthropic планує відкрити доступ до сервісу Enterprise Frontier Safeguards. У ньому клієнти зможуть самостійно контролювати моніторинг дій штучного інтелекту та визначати правила його використання у своїй організації.
Розробники також наголосили: приватні корпоративні дані не використовувалися і не використовуватимуться для навчання моделей без прямої згоди відповідної компанії.
Результати тестування та практичні можливості
Обидві нові системи продемонстрували найкращі результати в Terminal-Bench 4.0 — тесті, що оцінює здатність ШІ виконувати завдання з програмування через командний рядок. Високі показники також зафіксували у Humanity’s Last Exam, комплексному наборі складних завдань із різних галузей знань.
Моделі продемонстрували не лише вміння відповідати на запити, а й виконувати послідовні дослідницькі дії. Ще до офіційного запуску вони:
- оптимізували архітектуру графічного процесора;
- створили детальну карту Венери на основі доступних фотографій;
- виконували завдання, що потребують аналізу, планування та роботи з технічними даними.
Ці приклади свідчать про перехід від звичайного генерування тексту до складніших сценаріїв, у яких модель самостійно розподіляє етапи роботи та перевіряє проміжні результати.
Як розподілятимуть доступ до моделей
Anthropic не відкрила обидві версії для широкого використання. Модель Fable 5.1 буде доступна всім розробникам, тоді як Mythos 5.1 передаватимуть лише зареєстрованим партнерам компанії.
Партнери мають працювати над дослідженнями у сфері кібербезпеки або наук про життя. Обмежений доступ до Mythos пов’язаний із її вищими можливостями та необхідністю додаткового контролю під час використання.
Що показала оцінка ризиків
Разом із релізом Anthropic опублікувала системну картку — документ, у якому описано поведінку моделей, їхні обмеження та потенційно небезпечні сценарії застосування.
Ризик самовдосконалення
Фахівці оцінили Mythos 5.1 як модель із низьким ризиком самовдосконалення, яке могло б призвести до втрати людського контролю. Водночас така оцінка не означає повної відсутності ризиків: автономні системи потребують нагляду, обмежень доступу та перевірки результатів.
Точність і схильність до помилок
За надійністю Mythos 5.1 поступається Opus 5 і дещо частіше може демонструвати некоректну поведінку. Водночас нова версія перевершує Mythos 5 та Claude Sonnet 5 за стабільністю виконання завдань.
Виконання інструкцій
Модель краще дотримується прямих вказівок користувача. Вона рідше ігнорує окремі вимоги, вигадує неіснуючі вхідні дані або подає невиконане завдання як завершене.
Отже, реліз Anthropic поєднує високі результати в програмуванні та дослідницьких тестах із посиленим контролем приватності. Водночас доступ до найпотужнішої моделі обмежили, а її поведінку додатково оцінюють за критеріями безпеки, точності та здатності дотримуватися інструкцій.