Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Black-forest-labs

    FLUX Video Upscale

    Black-forest-labs
    Скопировано!

    FLUX Video Upscale — это модель увеличения разрешения видео от Black Forest Labs. Она увеличивает исходное видео в 1,5–3 раза, сохраняя его продолжительность, с возможностью использования дополнительного запроса…

    Входные данные:
    • Текст
    • Видео
    Исходящие данные:
    • Видео
  • Логотип Tencent

    Hy-MT2-7B

    Tencent
    Скопировано!

    Hy-MT2-7B — это модель перевода с 7 миллиардами параметров от Tencent. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и стилизованного перевода.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM Latest

    Z AI алиас
    Скопировано!

    GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для сложных задач в области программной инженерии и задач агентов с длительным горизонтом. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и улучшает GLM-5.2 в кодировании и в балансе между производительностью и эффективностью использования токенов.

    Режим рассуждений всегда включен и не может быть отключен. Поддерживаются усилия рассуждений low, high и max; по умолчанию используется max.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM 5.3

    Z AI
    Скопировано!

    GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для сложных задач в области программной инженерии и задач агентов с длительным горизонтом. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и улучшает GLM-5.2 в кодировании и в балансе между производительностью и эффективностью использования токенов.

    Режим рассуждений всегда включен и не может быть отключен. Поддерживаются усилия рассуждений low, high и max; по умолчанию используется max.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3.8 27B

    Qwen
    Скопировано!

    Qwen3.8 27B — это модель с плотной архитектурой для обработки изображений и текста от Qwen. Она подходит для программирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных задач агентов, с возможностью включения или отключения гибкого мышления.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип NVIDIA

    Nemotron 3.5 ASR Streaming Multilingual 0.6B

    NVIDIA
    Скопировано!

    Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Ее конструкция FastConformer-RNNT, учитывающая условия запроса и кэш, ориентирована на низкую задержку транскрипции более чем на 40 языках для создания субтитров в реальном времени, голосовых агентов и многоязычных транскрипционных конвейеров.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Mistral AI

    Voxtral Small 24B 2507 STT

    Mistral AI
    Скопировано!

    Voxtral Small 24B 2507 STT — это модель для транскрипции речи от Mistral AI. Она подходит для задач транскрипции, перевода и аудиоанализа, которые выигрывают от ее большей емкости модели.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Mistral AI

    Voxtral Mini 3B 2507

    Mistral AI
    Скопировано!

    Voxtral Mini 3B 2507 — это модель для понимания речи и аудио от Mistral AI. Она подходит для транскрипции, перевода и компактной обработки аудио.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Bytedance-seed

    Seedream 5.0 Lite

    Bytedance-seed
    Скопировано!

    Seedream 5.0 Lite — это модель генерации изображений от ByteDance Seed. Она подходит для профессионального визуального творчества, которое выигрывает от подключения к интернету для поиска, понимания сложных запросов, визуальных ссылок и обширных знаний…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Google

    Gemini 3.7 Flash

    Google
    Скопировано!

    Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, программирования и сложных многошаговых рассуждений. Она разработана для задач, требующих оперативной производительности и надежного многошагового решения проблем.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Файл
    • Аудио
    Исходящие данные:
    • Текст
  • Логотип Voyageai

    voyage-code-4

    Voyageai
    Скопировано!

    voyage-code-4 — это модель кодирования от Voyage AI, компании MongoDB. Она предназначена для агентов кодирования и поиска кода, с вложениями Matryoshka на 2048, 1024, 512 и 256 измерений и множеством вариантов квантования.

    Входные данные:
    • Текст
    Исходящие данные:
    • Embeddings
  • Логотип Qwen

    Qwen3 Reranker 8B

    Qwen
    Скопировано!

    Qwen3 Reranker 8B — это модель повторной ранжировки текста от Alibaba Cloud, построенная на архитектуре Qwen3. Она оценивает пары запрос-документ для получения оценок релевантности, которые используются в системах поиска и RAG. Поддерживает более 100 языков и языков программирования, с учетом инструкций для повторной ранжировки, что позволяет настраивать критерии оценки для каждой задачи. Обеспечивает высокую производительность на многоязычных тестах, включая MTEB, CMTEB и MMTEB.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Qwen

    Qwen3 ASR 1.7B

    Qwen
    Скопировано!

    Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает идентификацию и транскрипцию на нескольких языках, охватывая 30 языков и 22 китайских диалекта, с возможностью потокового и офлайн-распознавания, а также отметками времени на уровне сегментов и слов.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Qwen

    Qwen3 ASR 0.6B

    Qwen
    Скопировано!

    Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с возможностью потокового и офлайн-распознавания, а также с отметками времени на уровне сегментов и слов.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Bytedance-seed

    Seedream 5.0 Pro

    Bytedance-seed
    Скопировано!

    Seedream 5.0 Pro — это модель для генерации и редактирования изображений от ByteDance Seed. Она подходит для коммерческих рабочих процессов по созданию визуального контента, которые требуют точного контроля редактирования, реалистичных сцен и естественной визуализации.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения