Обновление DeepSeek: Революция в AI технологии

DeepSeek произвёл тихое обновление своего приложения до версии 1.7.4, и пользователи сразу же заметили кардинальные изменения. Конкретно, контекстное окно увеличилось с 128 тысяч токенов до более чем миллиона, а база знаний обновлена до мая 2025 года. Но наиболее интересный факт заключается в том, что чатбот в ответах на вопросы о своей версии указал, что он является «финальной эволюционной формой серии V3» и «последней версией перед выходом V4».

Согласно оценке аналитиков Nomura Securities, обновленная модель уже показывает сопоставимые с Gemini 3 Pro и K2.5 результаты в сложных задачах. Внутренние тесты показывают, что DeepSeek V4 превосходит как Claude, так и текущее поколение GPT в программировании, благодаря новым технологиям: mHC (Manifold-Constrained Hyper-Connections) и модулю условной памяти Engram.

Nomura акцентирует внимание на том, что выход V4 не вызовет такого же рыночного шока, как релиз DeepSeek-R1, когда акции Nvidia упали на $600 млрд за один день. Главное преимущество новой модели заключается в снижении затрат на обучение и инференс, что может ускорить коммерциализацию AI приложений и запустить новый инвестиционный цикл, особенно в Китае. Тем не менее, позиции DeepSeek на рынке open-source ослабли: если в конце 2024 года их модели занимали более половины токенов на OpenRouter, то к концу 2025 года их доля значительно сократится из-за конкуренции.

Обновление произошло на фоне активной подготовки китайских AI-лабораторий к приближающемуся празднику Лунного Нового года. Задолго до данного события Zhipu (Z.ai) выпустила модель GLM-5 с 744 млрд параметров, используя технологию разреженного внимания от DeepSeek. Alibaba готовит Qwen 3.5, а ByteDance — Doubao 2.0, все стремятся выпустить свои разработки до 17 февраля, когда DeepSeek, по слухам, планирует полное развертывание V4.

Понравилась статья? Поделиться с друзьями: