Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Anthropic

    Claude Sonnet 5

    Anthropic
    Скопировано!

    Sonnet 5 — это самая мощная модель класса Sonnet от Anthropic, демонстрирующая передовые результаты в области кодирования, агентных систем и профессиональной работы. Она поддерживает адаптивное мышление с возможностью выбора уровня усилий для рассуждений (низкий, средний, высокий, максимальный и сверхвысокий), имеет контекстное окно на 1 миллион токенов и принимает текстовые, графические и файловые вводы. Sonnet 5 использует обновленный токенизатор и включает в себя средства кибербезопасности в реальном времени, блокирующие некоторые высокорисковые действия двойного назначения.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип OpenAI

    GPT-5.6 Sol

    OpenAI
    Скопировано!

    GPT-5.6 Sol является флагманской моделью в серии GPT-5.6 от OpenAI. Она подходит для сложных рассуждений, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки и многоэтапного кодирования, а также в решении проблем с долгосрочной перспективой.

    Входные данные:
    • Файл
    • Изображения
    • Текст
    Исходящие данные:
    • Текст
  • Логотип DeepSeek

    DeepSeek V4 Pro

    DeepSeek
    Скопировано!

    DeepSeek V4 Pro — это крупномасштабная модель Mixture-of-Experts от DeepSeek с общим количеством параметров 1,6 триллиона и 49 миллиардами активированных параметров, поддерживающая контекстное окно в 1 миллион токенов. Она разработана для продвинутого рассуждения, кодирования и работы агентов с длинным горизонтом, демонстрируя высокую производительность по показателям знаний, математики и программной инженерии.

    Построенная на той же архитектуре, что и DeepSeek V4 Flash, она вводит гибридную систему внимания для эффективной обработки длинного контекста. Поддерживаются усилия по рассуждению high и xhigh; xhigh соответствует максимальному уровню рассуждения. Она хорошо подходит для сложных задач, таких как анализ полного кода, многошаговая автоматизация и крупномасштабный синтез информации, где критически важны как возможности, так и эффективность.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemini 3.1 Pro Preview

    Google
    Скопировано!

    Gemini 3.1 Pro Preview — это передовая модель рассуждений от Google, обеспечивающая улучшенную производительность в области программной инженерии, повышенную надежность агентов и более эффективное использование токенов в сложных рабочих процессах. Основываясь на мультимодальной платформе серии Gemini 3, она сочетает высокоточные рассуждения в текстах, изображениях, видео, аудио и коде с контекстным окном в 1 миллион токенов. Обновление 3.1 демонстрирует измеримые улучшения в SWE-бенчмарках и реальных условиях программирования, а также более сильное выполнение автономных задач в структурированных областях, таких как финансы и рабочие процессы на основе электронных таблиц.

    Разработанная для продвинутой разработки и агентных систем, Gemini 3.1 Pro Preview улучшает стабильность на длинных горизонтах и оркестрацию инструментов, одновременно увеличивая эффективность токенов. Она вводит новый уровень среднего мышления для лучшего баланса между стоимостью, скоростью и производительностью. Модель превосходит в агентном кодировании, структурированном планировании, мультимодальном анализе и автоматизации рабочих процессов, что делает её подходящей для автономных агентов, финансового моделирования, автоматизации электронных таблиц и задач с высоким контекстом в корпоративной среде.

    Входные данные:
    • Аудио
    • Файл
    • Изображения
    • Текст
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3.8 27B

    Qwen
    Скопировано!

    Qwen3.8 27B — это модель с плотной архитектурой для обработки изображений и текста от Qwen. Она подходит для программирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных задач агентов, с возможностью включения или отключения гибкого мышления.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    Исходящие данные:
    • Текст
  • Логотип NVIDIA

    Nemotron 3.5 ASR Streaming Multilingual 0.6B

    NVIDIA
    Скопировано!

    Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Ее конструкция FastConformer-RNNT, учитывающая условия запроса и кэш, ориентирована на низкую задержку транскрипции более чем на 40 языках для создания субтитров в реальном времени, голосовых агентов и многоязычных транскрипционных конвейеров.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Mistral AI

    Voxtral Small 24B 2507 STT

    Mistral AI
    Скопировано!

    Voxtral Small 24B 2507 STT — это модель для транскрипции речи от Mistral AI. Она подходит для задач транскрипции, перевода и аудиоанализа, которые выигрывают от ее большей емкости модели.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Mistral AI

    Voxtral Mini 3B 2507

    Mistral AI
    Скопировано!

    Voxtral Mini 3B 2507 — это модель для понимания речи и аудио от Mistral AI. Она подходит для транскрипции, перевода и компактной обработки аудио.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Bytedance-seed

    Seedream 5.0 Lite

    Bytedance-seed
    Скопировано!

    Seedream 5.0 Lite — это модель генерации изображений от ByteDance Seed. Она подходит для профессионального визуального творчества, которое выигрывает от подключения к интернету для поиска, понимания сложных запросов, визуальных ссылок и обширных знаний…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Google

    Gemini 3.7 Flash

    Google
    Скопировано!

    Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, программирования и сложных многошаговых рассуждений. Она разработана для задач, требующих оперативной производительности и надежного многошагового решения проблем.

    Входные данные:
    • Текст
    • Изображения
    • Видео
    • Файл
    • Аудио
    Исходящие данные:
    • Текст
  • Логотип Voyageai

    voyage-code-4

    Voyageai
    Скопировано!

    voyage-code-4 — это модель кодирования от Voyage AI, компании MongoDB. Она предназначена для агентов кодирования и поиска кода, с вложениями Matryoshka на 2048, 1024, 512 и 256 измерений и множеством вариантов квантования.

    Входные данные:
    • Текст
    Исходящие данные:
    • Embeddings
  • Логотип Qwen

    Qwen3 Reranker 8B

    Qwen
    Скопировано!

    Qwen3 Reranker 8B — это модель повторной ранжировки текста от Alibaba Cloud, построенная на архитектуре Qwen3. Она оценивает пары запрос-документ для получения оценок релевантности, которые используются в системах поиска и RAG. Поддерживает более 100 языков и языков программирования, с учетом инструкций для повторной ранжировки, что позволяет настраивать критерии оценки для каждой задачи. Обеспечивает высокую производительность на многоязычных тестах, включая MTEB, CMTEB и MMTEB.

    Входные данные:
    • Текст
    Исходящие данные:
    • Rerank
  • Логотип Qwen

    Qwen3 ASR 1.7B

    Qwen
    Скопировано!

    Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает идентификацию и транскрипцию на нескольких языках, охватывая 30 языков и 22 китайских диалекта, с возможностью потокового и офлайн-распознавания, а также отметками времени на уровне сегментов и слов.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Qwen

    Qwen3 ASR 0.6B

    Qwen
    Скопировано!

    Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с возможностью потокового и офлайн-распознавания, а также с отметками времени на уровне сегментов и слов.

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Bytedance-seed

    Seedream 5.0 Pro

    Bytedance-seed
    Скопировано!

    Seedream 5.0 Pro — это модель для генерации и редактирования изображений от ByteDance Seed. Она подходит для коммерческих рабочих процессов по созданию визуального контента, которые требуют точного контроля редактирования, реалистичных сцен и естественной визуализации.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения