LFM2.5-2.6B – языковая модель от Liquid AI из семейства LFM2.5, построенная на архитектуре LFM2 и предназначенная для локального запуска на ноутбуке, десктопе или смартфоне. Модель насчитывает 2,69 млрд параметров, но при этом обладает агентными способностями, характерными обычно для куда более крупных моделей. Это reasoning-модель – она всегда формирует внутренние рассуждения перед финальным ответом.
Сохранение ИИ-сервисов доступно только для авторизованных пользователей
ВойтиСписок больших языковых моделей
Laguna S 2.1 – это модель для агентного программирования от компании Poolside, распространяемая в открытом доступе на Hugging Face. Она построена на архитектуре Mixture-of-Experts с 118 млрд параметров, из которых на каждый токен активируется примерно 8 млрд. Модель рассчитана на задачи с длинным горизонтом рассуждений, а не на общение в формате чат-бота.
Huihui-Qwen3.8-27B-abliterated, представляет собой модель Qwen3.8-27B, из которой методом abliteration удалили встроенные механизмы отказа от ответов. Модель нужна для изучения «сырого» поведения языковой модели без слоя safety-фильтрации, наложенного создателями оригинальной Qwen. Она позволяет исследовать механизмы отказа от ответов и способы их обхода в контролируемой среде. Также её можно использовать для тестирования устойчивости других защитных механизмов при разработке собственных приложений на базе Qwen.
Qwen3.8-27B – открытая языковая модель с поддержкой изображений и видео, выложенная командой Qwen на Hugging Face в рамках линейки Qwen3.8. Она построена на архитектурной базе Qwen3.5 и, по заявлению разработчиков, является самой мощной моделью в открытом семействе Qwen на текущий момент. Важно понимать: это модель весов, а не готовый чат-бот с интерфейсом.
Gemini 3.7 Flash – нейросеть для работы с текстом, изображениями, аудио и видео. В основе – архитектура Gemini 3.6 Flash, доработанная в части логического вывода. Модель входит в семейство Gemini 3 от Google DeepMind и позиционируется как быстрый и относительно недорогой вариант по сравнению со старшими моделями линейки – отсюда, собственно, и приставка Flash.
Grok 4.6 – нейросеть от SpaceXAI, развитие модели Grok 4.5, заточенная под многошаговые агентные задачи. Она умеет исследовать темы, анализировать данные, работать с кодовой базой и доводить продуктовую идею до рабочего приложения. Главная особенность модели – способность долго удерживать фокус на сложной задаче через десятки шагов, а не терять логику после пары итераций.
DeepSeek-V4-Pro – большая языковая модель на архитектуре Mixture-of-Experts от компании DeepSeek, рассчитанная на работу с длинными текстами и сложными рассуждениями. Всего у модели 1,6 трлн параметров, но на обработку каждого токена реально задействуется около 49 млрд. Модель нужна для задач, где требуется обрабатывать большие объёмы текста или выполнять сложные многошаговые действия: анализ документов, работа с кодовыми репозиториями, агентные сценарии с вызовом инструментов. Её главная особенность – нативная поддержка контекста в миллион токенов без пропорционального роста вычислительных затрат.
GPT‑5.6 – это модель от OpenAI, пришедшая на смену GPT‑5.5. Она доступна в ChatGPT, Codex и через OpenAI API. Линейка состоит из трёх моделей – Sol, Terra и Luna, которые различаются балансом скорости, цены и возможностей. Сервис создан для решения сложных профессиональных задач с меньшими затратами вычислений и токенов. Модель обучена «получать больше пользы с каждого токена», за счёт чего запрос обходится дешевле при сопоставимом или более высоком качестве результата. Используется для программирования, кибербезопасности, научных исследований и работы с документами.
Claude Opus 5 – модель компании Anthropic, созданная для сложных агентных задач: многошагового рассуждения, автономного написания и рефакторинга кода, работы с документами и координации команд ИИ-агентов. Отдельного приложения с интерфейсом у нее нет – доступ идет через Claude API, а также через Amazon Bedrock, Google Cloud и Microsoft Foundry. Модель сменяет Claude Opus 4.8 и заметно улучшена в задачах с долгим удержанием контекста и самостоятельным планированием.
Gemini 3.6 Flash – модель от Google DeepMind из серии Gemini 3, построенная на базе Gemini 3.5 Flash. Она позиционируется как «рабочая лошадка» для кодинга, работы со знаниями и мультимодальных задач, а её главное отличие от предшественника – заявленная экономия токенов на выходе.
Claude Fable 5 – модель Anthropic пятого поколения, предназначенная для сложных задач в программировании и интеллектуальной работе. Anthropic описывает её как самую способную из широко выпущенных моделей компании на момент релиза. Ключевое отличие от предыдущих версий – умение работать над многодневными асинхронными проектами без потери фокуса.
Kimi K3 – это флагманская модель от Moonshot AI, ориентированная на разработчиков и активных пользователей AI-инструментов. Модель доступна через сервис Kimi Code (KFC), который включает CLI-утилиту, расширение для VS Code и API. Главная техническая особенность модели – контекстное окно до 1 миллиона токенов.
DeepSeek-V4
ПровереноDeepSeek-V4 – семейство больших языковых моделей с архитектурой Mixture-of-Experts (MoE), способных работать с контекстом до миллиона токенов. В линейке две модели: DeepSeek-V4-Pro с 1,6 триллионами параметров (49 миллиардов активных) и DeepSeek-V4-Flash с 284 миллиардами параметров (13 миллиардов активных).
GPT-5.5
ПровереноGPT-5.5 – новая версия языковой модели от OpenA. Её главное назначение – сделать общение с искусственным интеллектом естественным и гибким, повысив качество понимания текста и глубину ответов. GPT-5.5 не просто выдаёт факты, она поддерживает живой диалог на разные темы и помогает решать задачи быстро и эффективно.
Qwen 3.6-Plus – нейросеть от Alibaba Cloud, которая сочетает скорость и глубину анализа. Она уверенно работает с длинными текстами, превосходя многих конкурентов. Пользователи отмечают, что модель безошибочно разбирает код и строит логические цепочки. Главное её достоинство – способность обрабатывать большие объёмы данных.
Gemma 4 – семейство открытых языковых моделей от Google DeepMind, построенных на базе их флагманских Gemini. В отличие от последних, Gemma 4 доступна для свободного использования: разработчики могут скачать, доработать и запускать её локально. Размер моделей варьируется от 2 до 31 миллиардов параметров.
MiniMax M2.7 – новая модель компании MiniMax, которая самостоятельно улучшает себя. Она анализирует свои ошибки, исправляет код и проверяет изменения, чтобы стать эффективнее. В одном из тестов за 100 итераций производительность выросла на 30%. Представьте ученика, который сам проверяет домашнее задание и переписывает ошибки.
ChatGPT 5.2 — обновлённая модель от OpenAI, выпущенная в конце 2025 года. Она быстро привлекла внимание специалистов, работающих с текстами, кодом и данными. Главная её особенность — способность удерживать в памяти большой объём контекста беседы, не упуская важные детали даже после сотен сообщений.
Gemini 3 Pro
ПровереноGemini 3 Pro — это мультимодальная языковая модель от Google, представленная 18 ноября 2025 года. Главное преимущество нейросети — её способность рассуждать на уровне, который раньше был недоступен предыдущим поколениям моделей. Доступна функция рассуждений, заставляющая модель думать перед ответом.
Первые открытые модели от компании OpenAI. Нейросети доступны для загрузки в 2 вариантах: 20 млрд и 120 млрд параметров. Модели показывают результаты на бенчмарках по математики и программированию, сопоставимые с o3 и o4-mini. Доступны 3 уровня глубины рассуждений: низкий, средний и высокий.
Kimi K2 - языковая модель от китайской компании Moonshot AI. Если верить бенчмаркам, нейросеть конкурирует с лучшими проприетарными решениями. Архитектура Mixture of Experts в сочетании с оптимизатором MoonClip обеспечивают высокую точность ответов. Разработчики могут воспользоваться API по низким ценам.
Ernie 4.5 - бесплатная нейросеть от компании Baidu. Представляет собой мультимодальную модель. Также пользователям доступна нейросеть Ernie X1 с функцией рассуждения. По словам разработчиков Ernie 4.5 может тягаться с GPT-4,5, а Ernie X1 бросает вызов Deepseek R1. Доступен API с демократичной ценой.
QwQ-32B - нейросеть от компании Alibaba. Языковая модель была обучена на крупной базе текста из 18 триллионов токенов. Нейросеть поддерживает более 29 языков, обладает контекстным окном 131 тыс. токенов и предлагает функцию рассуждений (reasoning). Модель доступна в нескольких вариантов с различным количеством параметров.
Grok - большая языковая модель от компании xAI. Преимуществом нейросети является отсутствие фильтрации ответов, что проявляется в возможной грубости, резкости и прямолинейности. Присутствует режим неформального общения. Также Grok умеет генерировать изображения. Доступен API для разработчиков.
DeepSeek R1 - большая языковая модель, использующая цепочки рассуждений. Нейросеть показывает высокие результаты в задачах по математике и программированию. Доступна генерация ответа с учетом информации из интернета. Доступен API, совместимый с моделями OpenAI, но намного дешевле.
Minimax-01 - языковая модель с контекстным окном 4 млн токенов. Модель выполняет обработку текстовых документов, изображений и способна выполнить поиск информации в интернете. Несмотря на огромное контекстное окно, модель отлично запоминает данные всей последовательности.
Gemini - семейство нейросетей от компании Google. Самой последней разработкой на данный момент является Gemini 1.5 Pro, способная извлечь информацию из огромного количества текста, длинных аудиозаписей и документов благодаря контекстному окну в более 1 млн токенов. Также доступны Gemini 1.0 и Gemini 1.0 Ultra.
Llama* - семейство языковых моделей от компании Meta**. В вашем распоряжении флагманская Llama 3*, зарекомендовавшая себя с хорошей стороны, более старенькая Llama 2* и Code Llama*, предназначенная для генерации и отладки программного кода. Исходный код доступен для всех указанных нейросетей, поэтому вы можете загрузить их для использования на своём устройстве.
Claude - семейство больших языковых моделей, состоящее из трёх моделей: Haiku, Sonnet и Opus. Каждая нейросеть способна не только работать с текстом, но и анализировать загруженные изображения. Haiku является самой простой и быстрой моделью, Opus отличается способностью работать со сложными вопросами, а Sonnet представляет собой компромисс между скоростью и мощностью.