Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Cohere

    Rerank 4 Pro

    Cohere
    Скопировано!

    Модель AI поиска Cohere для повышения релевантности информации, отображаемой в системах поиска и RAG. Обладает контекстным окном на 32K, поддержкой более чем 100 языков, не требует предварительной обработки данных и обеспечивает передовую производительность с низкой задержкой.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Cohere

    Rerank 4 Fast

    Cohere
    Скопировано!

    Модель AI поиска от Cohere для повышения релевантности информации, отображаемой в системах поиска и RAG. Обладает контекстным окном на 32K, поддержкой более чем 100 языков, не требует предварительной обработки данных и обеспечивает высокую производительность с минимальной задержкой.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Cohere

    Rerank v3.5

    Cohere
    Скопировано!

    Rerank v3.5 предназначен для переупорядочивания результатов поиска с целью повышения их релевантности. Он поддерживает многогранное и полуструктурированное ранжирование данных на более чем 100 языках. Идеально подходит для уточнения результатов семантического или ключевого поиска.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Google

    Gemma 4 26B A4B

    Google
    Скопировано!

    Gemma 4 26B A4B IT — это модель Mixture-of-Experts (MoE) от Google DeepMind, настроенная на выполнение инструкций. Несмотря на общий объем в 25,2 миллиарда параметров, во время вывода активируется только 3,8 миллиарда параметров на каждый токен, что обеспечивает качество, близкое к 31 миллиарду, при значительно меньших вычислительных затратах. Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд при 1 кадре в секунду). Имеет контекстное окно на 256 тысяч токенов, возможность вызова встроенных функций, настраиваемый режим мышления/рассуждения и поддержку структурированного вывода. Выпущена под лицензией Apache 2.0.

    Входные данные:
    • Изображения
    • Текст
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemma 4 31B

    Google
    Скопировано!

    Gemma 4 31B Instruct — это плотная мультимодальная модель от Google DeepMind с 30,7 миллиардами параметров, поддерживающая текстовый и визуальный ввод с текстовым выводом. Обладает контекстным окном на 256 тысяч токенов, настраиваемым режимом мышления/рассуждения, возможностью нативного вызова функций и многоязычной поддержкой более чем на 140 языках. Сильна в задачах программирования, рассуждения и понимания документов. Лицензия Apache 2.0.

    Входные данные:
    • Изображения
    • Текст
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3.6 Plus

    Qwen
    Скопировано!

    Qwen 3.6 Plus основывается на гибридной архитектуре, которая сочетает эффективное линейное внимание с маршрутизацией редкой смеси экспертов, обеспечивая высокую масштабируемость и высокопроизводительный вывод. По сравнению с серией 3.5, она обеспечивает качественный скачок в задачах агентного программирования и полноценном мультимодальном восприятии.

    Главным акцентом релиза стала работа с кодом, где Qwen 3.6 Plus позиционируется как сильнейшая китайская модель на сегодняшний день. В профильных бенчмарках (SWE-bench и Claw-Eval) она уверенно обходит таких конкурентов, как GLM-5 и Kimi-K2.5, несмотря на то, что они превосходят ее по количеству параметров в 2–3 раза. По уровню автономной разработки Qwen вплотную приблизилась к серии Claude — признанному лидеру в этой области. На практике модель работает как полноценный разработчик: она способна самостоятельно декомпозировать задачи, планировать пути их решения, писать код (от простых фронтенд-задач до изменений на уровне всего репозитория), а также тестировать и исправлять его до полного завершения. Кроме того, Qwen 3.6 Plus “из коробки” совместима с популярными ИИ-агентами, включая OpenClaw, Claude Code и Cline.

    Важным отличием финального релиза стала глубокая мультимодальность. Alibaba реализовала новую архитектурную концепцию «цикла возможностей» (capability loop), которая позволяет модели воспринимать данные, рассуждать и действовать в рамках единого непрерывного процесса. Теперь Qwen 3.6 Plus способна не только обрабатывать текст, но и парсить документы с высокой плотностью информации, анализировать визуальные сцены из физического мира и выстраивать логические цепочки на основе длинных видеороликов. Все эти возможности поддерживаются расширенным контекстным окном, которое вмещает до 1 миллиона токенов.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM 5V Turbo

    Z AI
    Скопировано!

    GLM-5V-Turbo — это первая нативная мультимодальная модель-основа агента от Z.ai, созданная для задач, основанных на зрении и управляемых агентами. Она нативно обрабатывает изображения, видео и текстовые данные, превосходно справляется с планированием на длительный срок, сложным кодированием и выполнением задач, и безупречно взаимодействует с агентами для завершения полного цикла «восприятие → планирование → выполнение».

    Входные данные:
    • Изображения
    • Текст
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Arcee AI

    Trinity Large Thinking

    Arcee AI
    Скопировано!

    Trinity Large Thinking — это мощная модель рассуждений с открытым исходным кодом от команды Arcee AI. Она демонстрирует высокую производительность в PinchBench, агентных нагрузках и задачах на рассуждение. Она бесплатна в open claw в течение первых пяти дней. Видео запуска: https://youtu.be/Gc82AXLa0Rg?si=4RLn6WBz33qT–B7

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип SpaceXAI

    Grok 4.20 Multi-Agent

    SpaceXAI
    Скопировано!

    Grok 4.20 Multi-Agent — это вариант Grok 4.20 от xAI, разработанный для совместных рабочих процессов на основе агентов. Несколько агентов работают параллельно, чтобы проводить глубокие исследования, координировать использование инструментов и синтезировать информацию в рамках сложных задач.

    Поведение усилий по рассуждению: - низкое / среднее: 4 агента - высокое / очень высокое: 16 агентов

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип SpaceXAI

    Grok 4.20

    SpaceXAI
    Скопировано!

    Grok 4.20 — это новая флагманская модель xAI с ведущей в отрасли скоростью и возможностями агентского вызова инструментов. Она сочетает в себе самый низкий уровень галлюцинаций на рынке с строгим соблюдением заданных инструкций, обеспечивая постоянно точные и правдивые ответы.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Google

    Lyria 3 Pro Preview

    Google
    Скопировано!

    Полноформатные песни оцениваются в 8₽ за песню. Lyria 3 — это семейство моделей генерации музыки от Google, доступное через API Gemini. С помощью Lyria 3 вы можете создавать высококачественное стерео-аудио с частотой 48 кГц из текстовых подсказок или изображений. Эти модели обеспечивают структурную целостность, включая вокал, синхронизированные тексты и полные инструментальные аранжировки. Lyria 3 Pro может генерировать полноформатные песни с куплетами, припевами и бриджами.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
    • Аудио
  • Логотип Google

    Lyria 3 Clip Preview

    Google
    Скопировано!

    Клипы продолжительностью 30 секунд оцениваются в 4₽ за клип. Lyria 3 — это семейство моделей генерации музыки от Google, доступное через API Gemini. С помощью Lyria 3 можно генерировать высококачественное стерео-аудио с частотой 48 кГц из текстовых подсказок или изображений. Эти модели обеспечивают структурную согласованность, включая вокал, синхронизированные тексты песен и полные инструментальные аранжировки. Lyria 3 Clip может генерировать короткие клипы, петли, превью.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
    • Аудио
  • Логотип Alibaba

    Wan 2.6

    Alibaba
    Скопировано!

    Самая передовая модель генерации видео от Alibaba, поддерживающая более 10 возможностей визуального создания в единой системе. Wan 2.6 генерирует видео в формате 1080p с частотой 24 кадра в секунду из текста, изображений, референсных видео или аудио, с естественной аудио-визуальной синхронизацией и точным синхронизированием губ. Основные функции включают преобразование референса в видео (вставка внешности и голоса персонажа в новые сцены), многокадровое повествование из простых подсказок, синхронизированные звуковые эффекты и музыку, а также поддержку соотношений сторон 16:9, 9:16 и 1:1 с клипами до 15 секунд.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип Kwaipilot

    KAT-Coder-Pro V2

    Kwaipilot
    Скопировано!

    KAT-Coder-Pro V2 — это последняя высокопроизводительная модель в серии KAT-Coder от KwaiKAT, разработанная для сложной разработки программного обеспечения корпоративного уровня и интеграции SaaS. Она опирается на агентные возможности кодирования предыдущих версий, с акцентом на крупномасштабные производственные среды, координацию между системами и бесшовную интеграцию в современных программных стэках, а также поддерживает генерацию веб-эстетики для создания посадочных страниц и презентационных материалов производственного уровня.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип ByteDance

    Seedance 1.5 Pro

    ByteDance
    Скопировано!

    Модель следующего поколения для аудио-визуальной генерации от ByteDance с архитектурой Dual-Branch Diffusion Transformer на 4,5 миллиарда параметров. Seedance 1.5 Pro генерирует видео и аудио одновременно в одном унифицированном проходе — устраняя проблемы синхронизации при последовательном дубляже аудио. Поддерживает синхронизацию губ на нескольких языках (английский, мандарин, японский, корейский, испанский и другие), кинематографическое управление камерой (панорамирование, наклон, зум, орбита), диалоги с несколькими персонажами и согласованность персонажей в разных кадрах. Производит клипы длительностью от 4 до 12 секунд с разрешением до 1080p. Количество токенов определяется по формуле (высота выходного видео * ширина выходного видео * продолжительность * 24) / 1024.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео