DeepSeek представила швидшу та дешевшу модель V4.1 Flash
Китайська компанія DeepSeek представила нову модель штучного інтелекту DeepSeek-V4.1-Flash. Розробники називають її найменшою моделлю в новому сімействі V4.1, але водночас наголошують на помітному покращенні можливостей. Модель створена з акцентом на вищу швидкість роботи, більшу продуктивність і можливість масштабування для складніших завдань.
DeepSeek також заявляє про покращення роботи з текстом та ШІ-агентами. V4.1-Flash може використовуватися не лише для звичайного спілкування, а й для виконання складніших послідовностей дій, програмування та інших завдань, де важлива швидкість отримання результату. Крім того, нова модель підтримує нативне розуміння зображень, тобто може працювати не тільки з текстовими запитами.
За даними технічних матеріалів, DeepSeek-V4.1-Flash побудована за архітектурою Mixture of Experts. Загальна кількість параметрів моделі становить близько 522 млрд, але під час обробки кожного токена активується лише частина з них. Це дозволяє поєднати високу потужність із відносно невеликими витратами на обчислення.
Окрему увагу DeepSeek приділяє вартості та швидкості роботи. Компанія позиціонує V4.1-Flash як доступніший варіант для масового використання, що особливо важливо для розробників, які працюють із великими обсягами запитів через API. Нова модель має стати одним із ключових інструментів DeepSeek для конкурування з іншими великими ШІ-системами.
Презентація відбулася на тлі активного розвитку DeepSeek. Компанія одночасно готується до можливого виходу на Шанхайську фондову біржу STAR Market, що спеціалізується на технологічних компаніях. Тому запуск V4.1-Flash має для DeepSeek не лише технологічне, а й стратегічне значення – компанія намагається закріпитися серед головних гравців світового ринку штучного інтелекту.
Источник: itechua.com