Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Alibaba

    Wan 3.0 Prime

    Alibaba
    Скопировано!

    Wan 3.0 Prime — это вариант Wan 3.0 от Alibaba с ускоренным режимом. Он поддерживает генерацию видео из текста и создание видео из изображения первого кадра.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип Inclusionai

    Ling 3.0 Flash Fin

    Inclusionai
    Скопировано!

    Ling 3.0 Flash Fin — это модель типа mixture-of-experts, ориентированная на финансы, разработанная InclusionAI на основе Ling 3.0 Flash с 5,1 миллиардами активных параметров из общего числа в 124 миллиарда. Она предназначена для реальных инвестиционных процессов, требующих выполнения сложных многоэтапных задач и долгосрочного планирования и исполнения, при этом сохраняя общие возможности в области рассуждений, программирования и математики.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3.8 Flash

    Qwen
    Скопировано!

    Qwen3.8 Flash — это многомодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентных рабочих процессов, визуального понимания, анализа документов и кодовой базы, взаимодействия с рабочим столом, анализа графиков и анализа длинных видео.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM Flash Latest

    Z AI алиас
    Скопировано!

    GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач агентов с долгосрочным горизонтом. Ее гибридная архитектура с разреженным и линейным вниманием сохраняет точное поведение в длинном контексте, одновременно снижая вычислительную нагрузку.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM 5.3 Flash

    Z AI
    Скопировано!

    GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач агентов с долгосрочным горизонтом. Ее гибридная архитектура с разреженным и линейным вниманием сохраняет точное поведение в длинном контексте, одновременно снижая вычислительную нагрузку.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Recraft

    Recraft V4 Styles Pro

    Recraft
    Скопировано!

    Recraft V4 Styles Pro — это модель генерации изображений с сохранением стиля от Recraft. Каждый запрос требует как минимум одно изображение-образец стиля и генерирует новое изображение, которое воспроизводит…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Recraft

    Recraft V4 Styles Vector

    Recraft
    Скопировано!

    Recraft V4 Styles Vector — это модель генерации изображений с единым стилем от Recraft. Каждый запрос требует как минимум одно эталонное изображение стиля и генерирует новое изображение, которое воспроизводит…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Recraft

    Recraft V4 Styles Pro Vector

    Recraft
    Скопировано!

    Recraft V4 Styles Pro Vector — это модель генерации изображений с согласованным стилем от Recraft. Каждый запрос требует как минимум одного эталонного изображения стиля и генерирует новое изображение, которое воспроизводит…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Recraft

    Recraft V4 Styles

    Recraft
    Скопировано!

    Recraft V4 Styles — это модель генерации изображений с сохранением стиля от Recraft. Каждый запрос требует как минимум одно эталонное изображение стиля и создает новое изображение, которое воспроизводит рендеринг эталона…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Alibaba

    Wan 3.0

    Alibaba
    Скопировано!

    Wan 3.0 — это модель генерации видео от Alibaba для создания видео из текста, изображения или с использованием эталонного руководства. Она производит видео с разрешением 480p, 720p или 1080p продолжительностью от 2 до 30 секунд.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип Heygen

    Avatar IV

    Heygen
    Скопировано!

    HeyGen: Avatar IV — это модель преобразования изображения в видео, которая анимирует одну фотографию в выразительное видео говорящей головы с синхронизацией губ. Вместо того чтобы просто сопоставлять формы рта со словами, она интерпретирует вокал…

    Входные данные:
    • Текст
    • Изображения
    • Аудио
    Исходящие данные:
    • Видео
  • Muse Spark 1.2 Contributor

    Meta
    Скопировано!

    Muse Spark 1.2 contributor tier — это модель рассуждений от Meta, предназначенная для разработчиков, которые хотят начать разработку с еще более низкими затратами. Она значительно дешевле, чем Muse Spark 1.2. Ваши запросы и результаты могут использоваться для улучшения продуктов Meta, что делает ее подходящей для экспериментов, обучения и начальных проектов без беспокойства о расходах.

    Это модель рассуждений от Meta, адаптированная для сложных агентных задач. Она принимает текст, изображения, видео, аудио и PDF-документы, возвращает текст и предлагает контекстное окно на 1 миллион токенов. Модель разработана для поддержки многопоточных рабочих процессов, будь то в качестве основного агента, который планирует и делегирует, или в качестве подагента, выполняющего задачи параллельно. Она работает с различными кодовыми оболочками и поддерживает структурированный вывод, параллельный вызов функций и настраиваемую степень рассуждений. В тестах Meta она показывает хорошие результаты при рефакторинге нескольких файлов, расширенных сеансах отладки, генерации целых репозиториев и задачах, которые выходят за рамки одного запроса.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Файл
    • Аудио
    Исходящие данные:
    • Текст
  • Логотип DeepSeek

    DeepSeek V4 Flash Vision Exp

    DeepSeek
    Скопировано!

    DeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek с поддержкой визуального восприятия, добавляющая понимание изображений при сохранении возможностей базовой модели в области работы с текстом, включая агентов, рассуждения и знания о мире. Это разреженная модель с использованием смеси экспертов, имеющая 13 миллиардов активных параметров из общего числа в 284 миллиарда.

    Она подходит для понимания документов и диаграмм, визуального ответа на вопросы и мультимодальных рабочих процессов агентов, которые чередуют текст и изображения.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип Tencent

    Hy-MT2-1.8B

    Tencent
    Скопировано!

    Hy-MT2-1.8B — это компактная модель перевода с 1.8 миллиардами параметров от Tencent. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и стилистически направленного перевода.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Tencent

    Hy-MT2-30B-A3B

    Tencent
    Скопировано!

    Hy-MT2-30B-A3B — это флагманская модель перевода Tencent в семействе Hy-MT2. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и стилизованного перевода. Она использует 3 миллиарда активных параметров из 30 миллиардов общих.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст