Сравнительный анализ LLM моделей: конец доминирования?

Ноябрь 2025 ознаменовался значительными событиями в мире LLM моделей. 13 ноября Baidu представила ERNIE 5.0, которая быстро попала в топ-15 на LMArena. 18 ноября Google анонсировала Gemini 3 Pro с выдающимися показателями, а 19 ноября Сбер выпустил GigaChat3-702B, открыв модель под MIT-лицензией. 24 ноября Anthropic представил Claude Opus 4.5, пробивший 80% на SWE-bench. В это время Kimi-K2-Thinking от Moonshot AI продемонстрировала 84.5% на GPQA Diamond, став первой open-source моделью с триллионом параметров. Эти достижения ставят под сомнение прежнюю монополию OpenAI и Anthropic. В таблице сравнения открытые модели уже близки к проприетарным, а GigaChat становится лидером на российском рынке. Выбор моделей для научного анализа, кодинга и других задач становится все более разнообразным. Важно следить за новыми разработками, особенно из Китая и России.

Понравилась статья? Поделиться с друзьями: