Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Inclusionai

    Ling-2.6-flash

    Inclusionai
    Скопировано!

    Ling-2.6-flash is an instant (instruct) model from inclusionAI with 104B total parameters and 7.4B active parameters, designed for real-world agents that require fast responses, strong execution, and high token efficiency. It delivers performance comparable to state-of-the-art models at a similar scale while significantly reducing token usage across coding, document processing, and lightweight agent workflows.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Kwaivgi

    Kling: Video O1

    Kwaivgi
    Скопировано!

    Kling Video O1 — это модель генерации видео от Kuaishou. Она поддерживает ввод текста и изображений с выводом видео, позволяя создавать видео на основе текста и изображений. Модель подходит для производства кинематографического контента, обеспечивая контроль над первым и последним кадрами для точной композиции сцены. Она генерирует клипы длительностью 5 или 10 секунд в соотношениях сторон 16:9, 9:16 или 1:1.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип Minimax

    Hailuo 2.3

    Minimax
    Скопировано!

    Hailuo 2.3 — это модель генерации видео от MiniMax. Она принимает текстовые подсказки и эталонные изображения в качестве входных данных и генерирует видео на выходе, поддерживая как преобразование текста в видео, так и изображений в видео. Модель подходит для создания креативного контента, генерации кинематографических сцен и анимации персонажей, с акцентом на реалистичное движение и выразительное отображение персонажей.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип Moonshot AI

    Kimi K2.6

    Moonshot AI
    Скопировано!

    Kimi K2.6 — это модель следующего поколения от Moonshot AI, предназначенная для многозадачного кодирования, генерации UI/UX, управляемой кодом, и оркестрации множества агентов. Она справляется с комплексными задачами кодирования от начала до конца на языках Python, Rust и Go, и может преобразовывать подсказки и визуальные вводы в интерфейсы, готовые к производству. Ее архитектура роя агентов масштабируется до сотен параллельных субагентов для автономной декомпозиции задач — предоставляя документы, веб-сайты и электронные таблицы за один запуск без человеческого контроля.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип Mistral AI

    Voxtral Mini TTS

    Mistral AI
    Скопировано!

    Voxtral Mini TTS — это модель преобразования текста в речь от Mistral, которая поддерживает клонирование голоса без предварительного обучения и многоязычную поддержку. Она преобразует текстовый ввод в аудиовыход с естественным звучанием.

    Входные данные:
    • Текст
    Исходящие данные:
    • Речь
  • Логотип Google

    Gemini Embedding 2 Preview

    Google
    Скопировано!

    Gemini Embedding 2 Preview — это первая мультимодальная модель встраивания от Google. В настоящее время мы поддерживаем отображение текста и изображений в единое векторное пространство для семантического поиска и генерации с дополнением извлечением (RAG). Она поддерживает контекст ввода до 8,192 токенов и гибкие размеры выходных данных от 128 до 3,072 (рекомендуемые: 768, 1536 или 3,072). Модель разработана для кросс-модальной схожести — вы можете встроить текстовый запрос и получить наиболее релевантные изображения или наоборот — что делает её хорошо подходящей для мультимодального поиска, рекомендаций и конвейеров понимания документов.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    • Аудио
    • Видео
    Исходящие данные:
    • Embeddings
  • Логотип Anthropic

    Claude Opus 4.7

    Anthropic
    Скопировано!

    Opus 4.7 — это следующее поколение семейства Opus от Anthropic, созданное для долгосрочных асинхронных агентов. Основываясь на кодировочных и агентных возможностях Opus 4.6, оно обеспечивает более высокую производительность при выполнении сложных многоэтапных задач и более надежное выполнение агентных операций в рамках расширенных рабочих процессов. Особенно эффективно для асинхронных агентных конвейеров, где задачи разворачиваются со временем — большие кодовые базы, многоэтапная отладка и комплексная организация проектов.

    Помимо кодирования, Opus 4.7 предлагает улучшенные возможности для интеллектуальной работы — от составления документов и создания презентаций до анализа данных. Оно сохраняет согласованность в очень длинных выводах и расширенных сессиях, что делает его отличным выбором для задач, требующих настойчивости, суждения и доведения до конца.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Alibaba

    Wan 2.7

    Alibaba
    Скопировано!

    Wan 2.7 — это модель генерации видео от Alibaba. Она поддерживает преобразование текста в видео, изображений в видео с контролем первого и последнего кадра, а также преобразование с использованием эталонных изображений, где несколько эталонных изображений определяют стиль и содержание создаваемой сцены.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип ByteDance

    Seedance 2.0 Fast

    ByteDance
    Скопировано!

    Seedance 2.0 Fast — это модель генерации видео от ByteDance. Она поддерживает текст-видео, изображение-видео с контролем первого и последнего кадра, а также мультимодальное преобразование ссылок в видео. Модель отдает приоритет скорости генерации и снижению затрат по сравнению с максимальным качеством вывода. Количество токенов определяется по формуле (высота выходного видео * ширина выходного видео * длительность * 24) / 1024.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Аудио
    Исходящие данные:
    • Видео
  • Логотип ByteDance

    Seedance 2.0

    ByteDance
    Скопировано!

    Seedance 2.0 — это модель генерации видео от ByteDance. Она поддерживает преобразование текста в видео, изображения в видео с контролем первого и последнего кадра, а также мультимодальное преобразование ссылки в видео. Модель особенно хорошо сохраняет согласованность персонажей, визуальный стиль и движение камеры из исходного материала. Количество токенов определяется по формуле (высота выходного видео * ширина выходного видео * продолжительность * 24) / 1024.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Аудио
    Исходящие данные:
    • Видео
  • Логотип Z AI

    GLM 5.1

    Z AI
    Скопировано!

    GLM-5.1 — это флагманская открытая модель от Z.ai, разработанная для проектирования сложных систем и долгосрочных рабочих процессов агентов. Созданная для опытных разработчиков, она обеспечивает производительность промышленного уровня при выполнении крупномасштабных программных задач, соперничая с ведущими закрытыми моделями. Благодаря продвинутому агентному планированию, глубокому бэкенд-рассуждению и итеративной самокоррекции, GLM-5.1 выходит за рамки генерации кода к полноценному созданию систем и автономному выполнению.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Cohere

    Rerank 4 Pro

    Cohere
    Скопировано!

    Модель AI поиска Cohere для повышения релевантности информации, отображаемой в системах поиска и RAG. Обладает контекстным окном на 32K, поддержкой более чем 100 языков, не требует предварительной обработки данных и обеспечивает передовую производительность с низкой задержкой.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Cohere

    Rerank 4 Fast

    Cohere
    Скопировано!

    Модель AI поиска от Cohere для повышения релевантности информации, отображаемой в системах поиска и RAG. Обладает контекстным окном на 32K, поддержкой более чем 100 языков, не требует предварительной обработки данных и обеспечивает высокую производительность с минимальной задержкой.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Cohere

    Rerank v3.5

    Cohere
    Скопировано!

    Rerank v3.5 предназначен для переупорядочивания результатов поиска с целью повышения их релевантности. Он поддерживает многогранное и полуструктурированное ранжирование данных на более чем 100 языках. Идеально подходит для уточнения результатов семантического или ключевого поиска.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Google

    Gemma 4 26B A4B

    Google
    Скопировано!

    Gemma 4 26B A4B IT — это модель Mixture-of-Experts (MoE) от Google DeepMind, настроенная на выполнение инструкций. Несмотря на общий объем в 25,2 миллиарда параметров, во время вывода активируется только 3,8 миллиарда параметров на каждый токен, что обеспечивает качество, близкое к 31 миллиарду, при значительно меньших вычислительных затратах. Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд при 1 кадре в секунду). Имеет контекстное окно на 256 тысяч токенов, возможность вызова встроенных функций, настраиваемый режим мышления/рассуждения и поддержку структурированного вывода. Выпущена под лицензией Apache 2.0.

    Входные данные:
    • Изображения
    • Текст
    • Видео
    Исходящие данные:
    • Текст