DeepSeek представил новую флагманскую ИИ-модель V4
Китайский стартап DeepSeek выпустил превью-версии новой модели искусственного интеллекта V4. Компания сообщила об этом в соцсети X. В компании называют ее «самой мощной» ИИ-моделью с открытым исходным кодом.
Что известно о модели V4
DeepSeek представил модель V4 в двух версиях — V4-Flash и V4-Pro. Как утверждают в компании, последняя в режиме Pro-Max может конкурировать с ведущими мировыми проприетарными моделями: ChatGPT от OpenAI, Claude от Anthropic, а также Gemini от Google. Она превосходит все существующие open-source модели в тестах по программированию, а также сокращает отставание от лучших проприетарных моделей в задачах на рассуждение и агентных задачах, заявила компания на платформе Hugging Face. К агентным задачам относят те, в которых ИИ-модель не просто отвечает на вопрос, а самостоятельно выполняет последовательность действий для достижения цели, часто взаимодействуя с внешними инструментами.
V4-Flash — более простая версия модели V4. В режиме Flash-Max, она может показывать сопоставимую с Pro-версией производительность в задачах на рассуждение. Однако хуже справляется со сложными агентными задачами и задачами, которые требуют только знаний о мире.
Кроме того, обе версии обладают контекстным окном в 1 млн токенов — от этого параметра зависит, насколько большие входные данные (текст, видео, аудио, изображения и другие) способна обрабатывать и учитывать модель в ходе одного запроса. Как отмечает Bloomberg, в новые модели DeepSeek теперь можно будет отправлять целые кодовые базы или длинные документы.
С кем конкурирует DeepSeek
В рэнкинге Artificial Analysis модель V4-Pro занимает 22-е место в мире по сводному индексу «интеллекта» нейросетей. При этом она уступает не только проприетарным моделям, но и другим моделям с открытым кодом, например, Kimi K2.6 от китайского стартапа Moonshot. Однако среди моделей с контекстным окном в 1 млн токенов и больше, лишь две превосходят V4-Pro по «интеллекту»: Grok 4.2 и GPT-5.4.
В самом стартапе признают, что хотя V4 в ходе стандартных тестов показывает хорошую производительность по сравнению с моделями наподобие GPT-5.2 от OpenAI, однако она отстает от еще более передовых разработок примерно на 3-6 месяцев.
Нехватка вычислительных мощностей
Возможности V4 Pro «крайне ограничены» из-за нехватки вычислительных мощностей, пишет Bloomberg со ссылкой на заявление компании в мессенджере WeChat. Однако стартап ожидает, что цена за использование этой версии для пользователей значительно снизится после запуска вычислительных кластеров на базе чипов Ascend 950 от Huawei Technologies во второй половине этого года.
При этом компания ставит своей целью не только наращивать вычислительные мощности, но и существенно снижать затраты. Так, версия V4 разработана для развертывания на более дешевой инфраструктуре, подчеркивают в DeepSeek.
- Более года назад стартап выпустил свою первую модель R1, которая смогла составить конкуренцию передовым разработкам, в том числе, от стартапа OpenAI. При этом, заявляли в DeepSeek, на создание R1 понадобилось значительно меньше денег. Дешевизна и открытый исходный код часто называются ключевыми конкурентными преимуществами китайских моделей перед американскими.
- По данным Andreessen Horowitz, треть трафика DeepSeek обеспечивают пользователи из Китая, на втором месте — Россия с долей 7,1%. В России DeepSeek действительно конкурируют за лидерство по популярности с ChatGPT. Однако, допускают аналитики, это может быть следствием санкций: официально американские ИИ-модели в стране недоступны.