Claude Fable 5.1 і Mythos 5.1. Нові моделі від Anthropic здешевили та посилили для програмування і наукових завдань

Claude Fable 5.1 і Mythos 5.1. Нові моделі від Anthropic здешевили та посилили для програмування і наукових завдань

Anthropic представила Claude Fable 5.1 і Claude Mythos 5.1. Компанія заявляє про приріст продуктивності в програмуванні, роботі з інформацією та наукових дослідженнях, а також зниження вартості використання Fable 5.1.

Про це йдеться на сайті Anthropic.

Claude Fable 5.1 доступний для широкого використання, тоді як Mythos 5.1 призначений для перевірених фахівців у кібербезпеці та біології. За словами Anthropic, обидві моделі мають однакові можливості, але відрізняються рівнем захисних обмежень.

Однією з головних змін стала ціна. Вартість читання раніше обробленого контексту знизили на 75% — до $0,25 за 1 млн токенів. За оцінкою компанії, це скоротить витрати на типові завдання приблизно на 25% порівняно з Fable 5, а для складних агентних процесів економія може сягати 45%.

Інші тарифи залишилися на рівні попередньої моделі: $10 за 1 млн вхідних токенів і $50 за 1 млн вихідних.

Anthropic також заявила про покращення результатів Fable 5.1 у низці тестів. У Terminal-Bench-Science 0.1 модель отримала 52,6% проти 24,7% у Fable 5. У CursorBench 3.2.0 результат становив 73,4%, а в тесті на роботу з комп’ютером OSWorld 2.0 — 77,9% у режимі partial.

Окремо компанія наголосила на здатності моделі працювати над довгими завданнями без постійного контролю людини. Під час тестів Fable 5.1, зокрема, допомагала знаходити причини складних програмних помилок, аналізувати документи та створювати прототипи.

Anthropic навела приклад Millennium, де модель знайшла причину надзвичайно рідкісного збою у внутрішній системі. За словами компанії, інженери намагалися пояснити цю проблему протягом чотирьох-п'яти років, але Fable 5.1 пов’язала збій із помилкою у зовнішній бібліотеці.

Нові моделі також протестували в наукових завданнях. Mythos 5.1 створила білкові молекули, здатні зв’язуватися з 12 різними мішенями. Для трьох із них показники зв’язування виявилися приблизно у 10 разів кращими за найкращі результати, представлені на відповідних змаганнях з дизайну білків.

Ще один експеримент стосувався Венери. Fable 5.1 навчила нейромережу створювати карту висот приблизно третини планети на основі радарних знімків місії NASA Magellan. Нова карта дозволяє розрізняти деталі розміром 2−3 км замість попередніх 10−20 км, а висоти, за даними Anthropic, визначаються до 25% точніше.

Mythos 5.1 також оптимізувала сім відкритих моделей машинного навчання для роботи на графічних процесорах NVIDIA H100. У деяких випадках швидкість їхньої роботи зросла у 2,5 раза без зміни результатів. Anthropic оцінює, що для масштабних геномних досліджень це може скоротити витрати на GPU на 30−60%.

Водночас компанія посилила контроль за використанням моделей. Mythos 5.1 залишили з обмеженнями для біологічних і кібербезпекових завдань та надали лише учасникам спеціальних програм доступу. Для Fable 5.1 Anthropic зменшила кількість хибних спрацьовувань захисних систем: у кібербезпеці їх стало приблизно на 60% менше.

Fable 5.1 вже доступна через Claude, API та хмарні платформи Amazon Web Services, Google Cloud і Microsoft Azure. Mythos 5.1 наразі доступна лише визначеним організаціям і фахівцям, переважно у США.

Источник: techno.nv.ua