WanGP, также известный как Wan2GP – локальное бесплатное приложение для работы с открытыми ИИ-моделями. Через веб-интерфейс в браузере оно позволяет генерировать и обрабатывать видео, изображения, аудио и речь на собственном компьютере. Проект поддерживает несколько моделей, а не ограничивается одним генератором. С его помощью можно делать ролики по текстовому описанию, создавать изображения, работать с аудиодорожками и синтезом речи, а также подготавливать материалы для дальнейшей генерации. Возможности конкретной задачи зависят от выбранной модели и её настроек.
Сохранение ИИ-сервисов доступно только для авторизованных пользователей
ВойтиБесплатные ИИ-сервисы для любых задач
OmniScientist – сервис для автоматизации научного анализа данных, который сам разработчики называют «omni-modal, omni-discipline AI scientist». Он проходит полный исследовательский цикл: от гипотезы и написания кода для анализа до готовой статьи в PDF с графиками и ссылками на источники. Это не облачная подписка, а программа с открытым кодом на MIT-лицензии, которую устанавливают и запускают на своей машине.
LFM2.5-2.6B – языковая модель от Liquid AI из семейства LFM2.5, построенная на архитектуре LFM2 и предназначенная для локального запуска на ноутбуке, десктопе или смартфоне. Модель насчитывает 2,69 млрд параметров, но при этом обладает агентными способностями, характерными обычно для куда более крупных моделей. Это reasoning-модель – она всегда формирует внутренние рассуждения перед финальным ответом.
Laguna S 2.1 – это модель для агентного программирования от компании Poolside, распространяемая в открытом доступе на Hugging Face. Она построена на архитектуре Mixture-of-Experts с 118 млрд параметров, из которых на каждый токен активируется примерно 8 млрд. Модель рассчитана на задачи с длинным горизонтом рассуждений, а не на общение в формате чат-бота.
Huihui-Qwen3.8-27B-abliterated, представляет собой модель Qwen3.8-27B, из которой методом abliteration удалили встроенные механизмы отказа от ответов. Модель нужна для изучения «сырого» поведения языковой модели без слоя safety-фильтрации, наложенного создателями оригинальной Qwen. Она позволяет исследовать механизмы отказа от ответов и способы их обхода в контролируемой среде. Также её можно использовать для тестирования устойчивости других защитных механизмов при разработке собственных приложений на базе Qwen.
Qwen3.8-27B – открытая языковая модель с поддержкой изображений и видео, выложенная командой Qwen на Hugging Face в рамках линейки Qwen3.8. Она построена на архитектурной базе Qwen3.5 и, по заявлению разработчиков, является самой мощной моделью в открытом семействе Qwen на текущий момент. Важно понимать: это модель весов, а не готовый чат-бот с интерфейсом.
Hermes Agent – open-source сервис от Nous Research для запуска автономного агента с постоянной памятью на собственном сервере. В отличие от обычных чат-ботов, агент не привязан к одной сессии – он устанавливается на сервер пользователя и работает там постоянно, подключаясь к мессенджерам. Сервис нужен тем, кто хочет получить личного агента, работающего автономно и без привязки к облачным сервисам сторонних компаний. Он накапливает знания о проектах и окружении пользователя, автоматизирует рутинные задачи и запоминает контекст между обращениями, так что не нужно каждый раз объяснять ситуацию с нуля.
Alayalab.ai – сервис, который развивает технологии на стыке нейросетей и геймдева. Здесь и автоматизированное создание игр, и генеративная графика, и цифровые персонажи. Компания позиционирует себя как разработчика «инфраструктуры для AI-нативного игрового инжиниринга» и параллельно ведёт сразу несколько направлений. В перспективе они должны сойтись в единый цикл – от идеи до готового к запуску проекта.
MiniMax Music 3 – это открытая модель для генерации целых песен длительностью до пяти минут на основе текста лирики и описания музыкального стиля. Она создаёт готовый трек с вокалом, инструментами и развивающейся аранжировкой, а не короткий музыкальный фрагмент. Разработчик – компания MiniMax, модель опубликована на Hugging Face.
DeepSeek-V4-Pro – большая языковая модель на архитектуре Mixture-of-Experts от компании DeepSeek, рассчитанная на работу с длинными текстами и сложными рассуждениями. Всего у модели 1,6 трлн параметров, но на обработку каждого токена реально задействуется около 49 млрд. Модель нужна для задач, где требуется обрабатывать большие объёмы текста или выполнять сложные многошаговые действия: анализ документов, работа с кодовыми репозиториями, агентные сценарии с вызовом инструментов. Её главная особенность – нативная поддержка контекста в миллион токенов без пропорционального роста вычислительных затрат.
Qwen-Image-3.0 — это одна из наиболее ориентированных на практическое применение моделей генерации изображений. Её ключевое отличие заключается не столько в стремлении создавать максимально художественные изображения, сколько в способности работать с информационно насыщенными визуальными материалами.
MOSS-SoundEffect v2.0 – нейросеть для генерации звуковых эффектов по текстовому описанию. Она входит в открытое семейство MOSS-TTS Family от MOSI.AI и OpenMOSS и отвечает за звуковой дизайн, а не за синтез речи. В основе – архитектура DiT (Diffusion Transformer), обученная по принципу Flow Matching.
Sokuji – это нейросеть для перевода речи в реальном времени, которая работает как в облаке, так и полностью автономно на вашем устройстве. Вы говорите на одном языке, а собеседники слышат перевод на их родном языке. Сервис доступен в виде настольного приложения для Windows, macOS, Linux и расширения для браузеров Chrome и Edge.
AionUi – это нейросеть для управления несколькими ИИ-агентами на одном рабочем столе. Сервис позволяет запускать Claude Code, Codex, Gemini CLI и другие инструменты параллельно через единый интерфейс. Главное отличие от обычных чат-клиентов – встроенный движок агентов, который работает сразу после установки без дополнительной настройки окружения
Archon – это инструмент для управления рабочими процессами ИИ-агентов, которые генерируют код. Вы описываете процесс разработки один раз в формате YAML, а затем запускаете его из терминала, Slack, Telegram, комментария на GitHub или через веб-интерфейс. Каждый запуск работает изолированно в собственном git-worktree, что позволяет управлять несколькими параллельными задачами без конфликтов.Сервис работает локально, не отправляет ваш код на сторонние серверы и распространяется бесплатно под лицензией MIT. Это делает его подходящим выбором как для индивидуальных разработчиков, так и для команд, которым важна безопасность и контроль над процессами.
DeepSeek-V4
ПровереноDeepSeek-V4 – семейство больших языковых моделей с архитектурой Mixture-of-Experts (MoE), способных работать с контекстом до миллиона токенов. В линейке две модели: DeepSeek-V4-Pro с 1,6 триллионами параметров (49 миллиардов активных) и DeepSeek-V4-Flash с 284 миллиардами параметров (13 миллиардов активных).
Qwen 3.6-Plus – нейросеть от Alibaba Cloud, которая сочетает скорость и глубину анализа. Она уверенно работает с длинными текстами, превосходя многих конкурентов. Пользователи отмечают, что модель безошибочно разбирает код и строит логические цепочки. Главное её достоинство – способность обрабатывать большие объёмы данных.
Gemma 4 – семейство открытых языковых моделей от Google DeepMind, построенных на базе их флагманских Gemini. В отличие от последних, Gemma 4 доступна для свободного использования: разработчики могут скачать, доработать и запускать её локально. Размер моделей варьируется от 2 до 31 миллиардов параметров.
PicoClaw – компактный персональный ИИ-ассистент, который работает всего на 10 МБ оперативной памяти. Такие скромные требования делают его идеальным для дешёвых одноплатников, например, Sipeed LicheeRV Nano стоимостью около 15 долларов. Забудьте о мощных компьютерах: PicoClaw запускается за секунду даже на ядре с частотой 600 МГц.
OpenClaw – автономный ИИ-агент, запускающийся прямо на твоём компьютере или сервере. Он берёт на себя рутинные задачи, управляет файлами и общается через мессенджеры без привлечения облачных сервисов. Главное преимущество – абсолютная приватность: все данные хранятся локально, агент запоминает контекст и действует самостоятельно.
ACE-Step 1.5 – беспалтная нейросеть для создания песен прямо на твоём компьютере. Она принимает текстовое описание и генерирует полноценный трек с вокалом или без него. Главный плюс – невероятная скорость: на мощной видеокарте RTX 5090 четырёхминутная композиция создаётся за секунду, а на RTX 3090 – менее чем за десять секунд.
Lucy 2.0 от Decart AI – нейросеть, которая заменяет лица и объекты на видео в режиме реального времени. Ты вводишь текстовый запрос, и модель мгновенно меняет кадр: персонажей, одежду, фон или объекты. Работает напрямую с трансляцией – 30 кадров в секунду при разрешении 1080p, практически без задержек.
Kandinsky 5.0 – семейство моделей от Сбера для генерации изображений и видео. Главная особенность – глубокое понимание российского культурного контекста. Нейросеть уверенно создаёт надписи на кириллице и латинице, а также точно передаёт местные реалии. Пользователи отмечают её внимание к деталям.
Qwen3-TTS – открытая нейросеть от команды Qwen, которая преобразует текст в речь с минимальной задержкой. Главное её преимущество – сверхбыстрая потоковая генерация: первый фрагмент аудио появляется уже после ввода первого символа. Задержка составляет всего около 97 миллисекунд.
GLM-Image — нейросеть для генерации изображений от Zhipu AI. Эта модель с 16 миллиардами параметров безупречно работает с изображениями, в которых много текста: постерами, слайдами, инфографикой. Главное её преимущество — семантические токены, которые распознают не только цвет и форму, но и смысл: здесь лицо, а здесь шрифт.
Clean Video AI — это ИИ-сервис для удаления водяных знаков из видео. Суть инструмента проста: загружаете видео с логотипом или текстом, нейросеть анализирует и удаляет ненужные элементы, вы скачиваете чистый результат. Видео экспортируется в FullHD или 4K без потери четкости и без размытия.
AI Face Shape Detector — это нейросеть для определения формы лица. Вы загружаете фотографию, а алгоритм пробегается по ключевым точкам: измеряет ширину лба, расстояние между скулами, линию челюсти и высоту подбородка. На основе этих данных он выдает вердикт: кто вы — обладатель «овала», «квадрата», «сердца» или более редкого «алмаза».
Chatterbox-Turbo — это нейросеть для клонирования голоса и озвучки текста. По сути, это первый серьёзный удар открытого сообщества по конкурентам вроде ElevenLabs, которые долгое время доминировали на рынке синтеза речи. Модель поддерживает 23 языка прямо из коробки, включая русский, английский, французский и китайский.
AI Vector — это нейросеть для конвертации PNG в SVG. Идея простая: ты загружаешь картинку в формате PNG, а ИИ за несколько секунд превращает её в векторный формат. В основе работает нейронная сеть, которая анализирует пиксельную структуру изображения — находит формы, цвета, контуры и преобразует всё это в векторные кривые.