Infatoshi/GLM-5.3-UNCENSORED-EXL3-3.0bpw – это сильно сжатая (quantized) версия GLM-5.3, предназначенная прежде всего для запуска через ExLlamaV3 / EXL3. Модель предназначена для разработчиков, которым нужно развернуть крупную языковую модель на собственной GPU-инфраструктуре в формате EXL3. Она может использоваться в сценариях генерации текста, агентных задачах и вызовах инструментов при корректной обработке аргументов. Квантование позволяет работать с версией модели, занимающей меньше места, чем исходный FP8-чекпойнт, хотя размер файлов все равно составляет 273 GiB.
Сохранение ИИ-сервисов доступно только для авторизованных пользователей
ВойтиСписок больших языковых моделей
Claude Sonnet 5.5 – модель Anthropic для быстрых рабочих итераций с кодом, документами, таблицами, презентациями, изображениями и интерфейсами. Она ориентирована на задачи, где важны скорость, стоимость и возможность многократно уточнять результат. Модель можно использовать для написания и проверки кода, поиска ошибок, подготовки черновиков документов и создания структуры презентаций. Также она подходит для анализа рабочих материалов, извлечения ключевых показателей, работы с диаграммами и подготовки HTML-макетов. Качество результата зависит от исходных данных, формулировки запроса и выбранного уровня усилий.
GPT‑6 Luna – доступная модель OpenAI для профессиональных задач, разработки, работы с фактами и агентной автоматизации. Её главное преимущество – сочетание сравнительно низкой стоимости API с возможностью выполнять многошаговые сценарии и часто повторять итерации. Модель может быть особенно полезна разработчикам и командам, которые используют API для работы с кодом, обработки повторяющихся запросов и построения агентов.
GPT‑6 Sol – модель OpenAI для профессиональных задач, программирования, работы с фактами и выполнения действий в компьютерных интерфейсах. Она доступна через API под названием gpt-6-sol, а также в ChatGPT Work и Codex для пользователей указанных подписок. Модель позиционируется как более доступный вариант для сложных задач, где возможностей GPT‑6 Astra может быть больше, чем требуется.
Claude Opus 5.5 – флагманская модель Anthropic для задач, где важны работа с большим контекстом, программирование, анализ информации и подготовка сложных материалов. Основные преимущества – более высокая скорость, снижение стоимости относительно Opus 5 и более структурированный стиль ответов. Claude Opus 5.5 подходит для аудита и миграции кода, поиска ошибок, рефакторинга и оптимизации приложений. Также модель можно применять для исследовательских отчётов, финансового анализа, подготовки презентаций и структурирования информации.
Grok 4.7 – нейросеть для программирования, анализа данных и решения сложных задач, требующих продолжительного рассуждения. Модель умеет дольше работать над запросом, проверять промежуточные результаты и удерживать большой контекст. Сервис предназначен для объёмных задач по коду, работе с данными, подготовке документов и презентаций. Его можно использовать, когда нужно последовательно проработать несколько этапов задания, учесть ограничения и не потерять ранее заданные условия.
GPT-6 Astra – языковая модель OpenAI для сложных рабочих задач: от действий в браузере и программах до подготовки документов, анализа данных и разработки ПО. Она способна работать в многошаговых сценариях, а не ограничиваться текстовым ответом. Astra может пригодиться специалистам, работающим с документами, таблицами, презентациями, кодом, исследованиями и веб-инструментами.
Ornith-1.5-9B-uncensored-GGUF – открытая мультимодальная модель на базе Ornith-1.5-9B с 9 млрд параметров. Она подготовлена для red teaming и защитных исследований: в её весах ослаблено направление, связанное с отказами от ответа. Это не готовый веб-чат, а модель для запуска через библиотеки, локальные приложения или серверные фреймворки. Модель предназначена для проверки защитных механизмов, фильтров ввода и вывода, модерации, а также устойчивости к prompt injection. Её можно сравнивать с базовой Ornith-1.5-9B, чтобы оценивать, как встроенные отказы влияют на результаты тестов. Также модель рассматривается как инструмент для подготовки ответов в задачах бенчмаркинга модерации и детекторов злоупотреблений.
DeepSeek-V4.1-Flash – открытая мультимодальная модель для разработчиков, которым важны обработка текста и изображений в одном контексте, поддержка длинных входных данных и возможность самостоятельного развёртывания. Её ключевые особенности – окно контекста до 1 миллиона токенов, архитектура Mixture-of-Experts, параметр reasoning_effort и инструменты для работы с диалогами и вызовами функций. Модель особенно интересна для задач анализа документов, кода, переписок, скриншотов, графиков и агентных сценариев. При этом практическая ценность DeepSeek-V4.1-Flash зависит не только от заявленных характеристик, но и от выбранного движка инференса, доступной инфраструктуры, качества подготовки промптов и тестов на данных конкретного проекта.
Step 3.7 Flash – ИИ-модель компании StepFun, созданная для агентных и многошаговых задач. Она работает с текстом и изображениями, может искать информацию, использовать инструменты, писать код и проверять промежуточные результаты. Модель предназначена для задач, в которых недостаточно одного ответа в чате. Она может составлять план действий, искать и обрабатывать сведения, анализировать документы или интерфейсы, работать с кодом и выполнять последовательность операций через подключённые инструменты.
Muse Spark 1.3 – нейросеть для агентных задач и программирования, доступная в Muse Code и через Meta Model API. Она рассчитана на продолжительную работу с контекстом, инструментами и многоэтапными заданиями, где результат формируется постепенно. Сервис нужен для задач, которые нельзя полностью решить одним коротким запросом. Модель может собирать сведения из разных источников, выявлять пробелы в плане, учитывать новые условия и доводить работу до итогового результата.
Gemini 3.8 Flash – модель Google для программирования, многошагового анализа и агентных сценариев. Она рассчитана на задачи, в которых нужно последовательно выполнять несколько действий, уточнять промежуточные результаты и использовать инструменты. Модель входит в линейку Gemini и доступна через API, продукты Google для разработчиков и отдельные пользовательские сервисы. Gemini 3.8 Flash используют для сложных задач разработки, аналитики и подготовки черновиков отчётов. Модель может разбирать комплексную инженерную проблему, выстраивать последовательность рассуждений и участвовать в агентных рабочих процессах.
Claude Fable 5.1 – модель Anthropic для сложных задач с рассуждением, программирования, исследований, работы с документами и длительных агентных процессов. Это не отдельный чат-сервис: модель доступна через Claude API, а также облачные платформы AWS, Google Cloud и Microsoft Foundry. Идентификатор модели в Claude API – claude-fable-5-1. Модель нужна для задач, в которых требуется последовательно работать с большим количеством материалов, вызывать внешние инструменты и сохранять логику между шагами. Например, её можно применять для анализа крупной кодовой базы, отладки, рефакторинга, многошагового исследования, обработки отчётов и сопоставления данных из нескольких документов. Для обычных коротких запросов её возможности могут быть избыточны.
GLM-5.3-Flash – мультимодальная языковая модель от Z.ai для работы с текстом, кодом, изображениями, видео и файлами. Она доступна через API и инструменты для разработчиков, а также поддерживает сценарии с внешними функциями и структурированными ответами. Модель предназначена для задач, где требуется не только сгенерировать текст, но и разобрать материалы, обработать визуальный контекст, вызвать внешний инструмент или вернуть данные в заданном формате. Например, её можно применять для анализа документов и кода, подготовки интерфейсов по референсам, извлечения данных и создания агентских сценариев.
LFM2.5-2.6B – языковая модель от Liquid AI из семейства LFM2.5, построенная на архитектуре LFM2 и предназначенная для локального запуска на ноутбуке, десктопе или смартфоне. Модель насчитывает 2,69 млрд параметров, но при этом обладает агентными способностями, характерными обычно для куда более крупных моделей. Это reasoning-модель – она всегда формирует внутренние рассуждения перед финальным ответом.
Laguna S 2.1 – это модель для агентного программирования от компании Poolside, распространяемая в открытом доступе на Hugging Face. Она построена на архитектуре Mixture-of-Experts с 118 млрд параметров, из которых на каждый токен активируется примерно 8 млрд. Модель рассчитана на задачи с длинным горизонтом рассуждений, а не на общение в формате чат-бота.
Huihui-Qwen3.8-27B-abliterated, представляет собой модель Qwen3.8-27B, из которой методом abliteration удалили встроенные механизмы отказа от ответов. Модель нужна для изучения «сырого» поведения языковой модели без слоя safety-фильтрации, наложенного создателями оригинальной Qwen. Она позволяет исследовать механизмы отказа от ответов и способы их обхода в контролируемой среде. Также её можно использовать для тестирования устойчивости других защитных механизмов при разработке собственных приложений на базе Qwen.
Qwen3.8-27B – открытая языковая модель с поддержкой изображений и видео, выложенная командой Qwen на Hugging Face в рамках линейки Qwen3.8. Она построена на архитектурной базе Qwen3.5 и, по заявлению разработчиков, является самой мощной моделью в открытом семействе Qwen на текущий момент. Важно понимать: это модель весов, а не готовый чат-бот с интерфейсом.
Gemini 3.7 Flash – нейросеть для работы с текстом, изображениями, аудио и видео. В основе – архитектура Gemini 3.6 Flash, доработанная в части логического вывода. Модель входит в семейство Gemini 3 от Google DeepMind и позиционируется как быстрый и относительно недорогой вариант по сравнению со старшими моделями линейки – отсюда, собственно, и приставка Flash.
Grok 4.6 – нейросеть от SpaceXAI, развитие модели Grok 4.5, заточенная под многошаговые агентные задачи. Она умеет исследовать темы, анализировать данные, работать с кодовой базой и доводить продуктовую идею до рабочего приложения. Главная особенность модели – способность долго удерживать фокус на сложной задаче через десятки шагов, а не терять логику после пары итераций.
DeepSeek-V4-Pro – большая языковая модель на архитектуре Mixture-of-Experts от компании DeepSeek, рассчитанная на работу с длинными текстами и сложными рассуждениями. Всего у модели 1,6 трлн параметров, но на обработку каждого токена реально задействуется около 49 млрд. Модель нужна для задач, где требуется обрабатывать большие объёмы текста или выполнять сложные многошаговые действия: анализ документов, работа с кодовыми репозиториями, агентные сценарии с вызовом инструментов. Её главная особенность – нативная поддержка контекста в миллион токенов без пропорционального роста вычислительных затрат.
GPT‑5.6 – это модель от OpenAI, пришедшая на смену GPT‑5.5. Она доступна в ChatGPT, Codex и через OpenAI API. Линейка состоит из трёх моделей – Sol, Terra и Luna, которые различаются балансом скорости, цены и возможностей. Сервис создан для решения сложных профессиональных задач с меньшими затратами вычислений и токенов. Модель обучена «получать больше пользы с каждого токена», за счёт чего запрос обходится дешевле при сопоставимом или более высоком качестве результата. Используется для программирования, кибербезопасности, научных исследований и работы с документами.
Claude Opus 5 – модель компании Anthropic, созданная для сложных агентных задач: многошагового рассуждения, автономного написания и рефакторинга кода, работы с документами и координации команд ИИ-агентов. Отдельного приложения с интерфейсом у нее нет – доступ идет через Claude API, а также через Amazon Bedrock, Google Cloud и Microsoft Foundry. Модель сменяет Claude Opus 4.8 и заметно улучшена в задачах с долгим удержанием контекста и самостоятельным планированием.
Gemini 3.6 Flash – модель от Google DeepMind из серии Gemini 3, построенная на базе Gemini 3.5 Flash. Она позиционируется как «рабочая лошадка» для кодинга, работы со знаниями и мультимодальных задач, а её главное отличие от предшественника – заявленная экономия токенов на выходе.
Claude Fable 5 – модель Anthropic пятого поколения, предназначенная для сложных задач в программировании и интеллектуальной работе. Anthropic описывает её как самую способную из широко выпущенных моделей компании на момент релиза. Ключевое отличие от предыдущих версий – умение работать над многодневными асинхронными проектами без потери фокуса.
Kimi K3 – это флагманская модель от Moonshot AI, ориентированная на разработчиков и активных пользователей AI-инструментов. Модель доступна через сервис Kimi Code (KFC), который включает CLI-утилиту, расширение для VS Code и API. Главная техническая особенность модели – контекстное окно до 1 миллиона токенов.
DeepSeek-V4
ПровереноDeepSeek-V4 – семейство больших языковых моделей с архитектурой Mixture-of-Experts (MoE), способных работать с контекстом до миллиона токенов. В линейке две модели: DeepSeek-V4-Pro с 1,6 триллионами параметров (49 миллиардов активных) и DeepSeek-V4-Flash с 284 миллиардами параметров (13 миллиардов активных).
GPT-5.5
ПровереноGPT-5.5 – новая версия языковой модели от OpenA. Её главное назначение – сделать общение с искусственным интеллектом естественным и гибким, повысив качество понимания текста и глубину ответов. GPT-5.5 не просто выдаёт факты, она поддерживает живой диалог на разные темы и помогает решать задачи быстро и эффективно.
Qwen 3.6-Plus – нейросеть от Alibaba Cloud, которая сочетает скорость и глубину анализа. Она уверенно работает с длинными текстами, превосходя многих конкурентов. Пользователи отмечают, что модель безошибочно разбирает код и строит логические цепочки. Главное её достоинство – способность обрабатывать большие объёмы данных.
Gemma 4 – семейство открытых языковых моделей от Google DeepMind, построенных на базе их флагманских Gemini. В отличие от последних, Gemma 4 доступна для свободного использования: разработчики могут скачать, доработать и запускать её локально. Размер моделей варьируется от 2 до 31 миллиардов параметров.