Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Upstage

    Solar Pro 4

    Upstage
    Скопировано!

    Solar Pro 4 — это крупная языковая модель от Upstage. Она подходит для агентских рабочих процессов, повышения производительности в офисе, работы с документами и программирования.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Meta

    Muse Glimmer 30B

    Meta
    Скопировано!

    Muse Glimmer 30B — это плотная, открытая мультимодальная модель от Meta Superintelligence Labs, дистиллированная из Muse Spark и оптимизированная для автономных агентов на потребительском оборудовании. Она подходит для долгосрочных агентных и кодировочных рабочих процессов, с многошаговым рассуждением, надежным использованием инструментов, восстановлением после сбоев, пониманием изображений и поддержкой более чем 100 языков.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип ByteDance

    Seedance 2.5

    ByteDance
    Скопировано!

    Seedance 2.5 — это модель генерации видео от ByteDance. Она подходит для создания длинных повествований, мультимодальной генерации на основе ссылок, редактирования видео и расширения видео. Поддерживает управление первым кадром и первым и последним кадрами, вплоть до…

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Аудио
    Исходящие данные:
    • Видео
  • Логотип OpenAI

    GPT Transcribe

    OpenAI
    Скопировано!

    GPT Transcribe — это высокоточная модель преобразования речи в текст от OpenAI. Она подходит для записи аудио, транскрипции потоковых файлов и обработки в режиме реального времени, с поддержкой свободного контекста, подсказок по ключевым словам и многозначных языковых подсказок для специализированных терминов и многоязычной речи.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Meta

    Muse Spark 1.2

    Meta
    Скопировано!

    Muse Spark 1.2 — это модель рассуждений от Meta, разработанная для выполнения сложных агентных задач. Она принимает текст, изображения, видео, аудио и PDF-документы, возвращает текст и предлагает контекстное окно на 1 миллион токенов.

    Модель создана для поддержки рабочих процессов с несколькими агентами, будь то в качестве основного агента, который планирует и делегирует, или в качестве субагента, выполняющего задачи параллельно. Она работает с несколькими кодовыми оболочками и поддерживает структурированный вывод, параллельные вызовы функций и настраиваемые усилия по рассуждению. В тестах Meta она хорошо справляется с рефакторингом нескольких файлов, длительными сеансами отладки, генерацией целых репозиториев и задачами, которые выходят далеко за рамки одного запроса.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Файл
    • Аудио
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen Image 3 Pro

    Qwen
    Скопировано!

    Qwen Image 3 Pro — это модель генерации и редактирования изображений от Qwen. Она поддерживает точное отображение текста и деталей размером до 10 пикселей, а также обладает более глубокими знаниями о мире…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Qwen

    Qwen Image 3

    Qwen
    Скопировано!

    Qwen Image 3 — это унифицированная модель генерации и редактирования изображений от Qwen. Она поддерживает точное отображение текста и деталей размером всего 10 пикселей, а также более насыщенный мир…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Black-forest-labs

    FLUX.3 Video

    Black-forest-labs
    Скопировано!

    FLUX.3 Video — это модель генерации видео от Black Forest Labs. Она поддерживает генерацию видео на основе текста, создание видео с помощью изображений с начальными и конечными ключевыми кадрами, а также рабочие процессы продолжения видео, что делает её подходящей для контролируемого…

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Видео
  • Логотип Qwen

    Qwen3.8 Max

    Qwen
    Скопировано!

    Qwen3.8 Max является флагманской моделью в серии Qwen3.8 от Alibaba, которая является общедоступным преемником Qwen3.8 Max Preview. Это мультимодальная модель рассуждений, предназначенная для сложных рассуждений, визуального понимания, программирования и агентных рабочих процессов.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип DeepSeek

    DeepSeek V4 Flash 0731

    DeepSeek
    Скопировано!

    DeepSeek V4 Flash 0731 — это модель с разреженной смесью экспертов от DeepSeek, с 13 миллиардами активных параметров из 284 миллиардов общих. Эта пересмотренная версия, прошедшая повторное обучение, подходит для кодирования, рассуждений и рабочих процессов агентов.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Inkling Small

    Thinkingmachines
    Скопировано!

    Inkling Small — это многомодальная модель с открытым весом и смешением экспертов от Thinking Machines Lab, с 12 миллиардами активных параметров из общего числа в 276 миллиардов. Она позиционируется как меньший и более эффективный член семейства Inkling и подходит для рассуждений, программирования, агентных рабочих процессов, генерации с дополнением извлечением, выполнения инструкций и многоязычного общения.

    Входные данные:
    • Текст
    • Изображения
    • Аудио
    Исходящие данные:
    • Текст
  • Логотип Minimax

    H3

    Minimax
    Скопировано!

    MiniMax H3 — это легковесная модель генерации видео с открытыми весами от MiniMax. Она предназначена для точного мультимодального редактирования и управляемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также…

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Аудио
    Исходящие данные:
    • Видео
  • Логотип Fish-audio

    Transcribe 1

    Fish-audio
    Скопировано!

    Transcribe 1 — это модель преобразования речи в текст от Fish Audio. Она подходит для транскрипции аудио с автоматическим определением языка и может возвращать временные метки на уровне слов, когда запрашиваются детали выравнивания.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Fish-audio

    S2 Pro

    Fish-audio
    Скопировано!

    S2 Pro — это многоязычная модель преобразования текста в речь от Fish Audio. Она подходит для выразительного повествования и диалогов с несколькими участниками, с возможностью управления стилем речи и эмоциями на естественном языке.

    Входные данные:
    • Текст
    Исходящие данные:
    • Речь
  • Логотип Fish-audio

    S1

    Fish-audio
    Скопировано!

    S1 — это многоязычная модель преобразования текста в речь от Fish Audio. Она подходит для голосовых приложений, которым требуется широкое эмоциональное выражение, используя скобочные элементы управления для направления стиля речи на поддерживаемых языках.

    Входные данные:
    • Текст
    Исходящие данные:
    • Речь