Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип OpenAI

    GPT Image 1 Mini

    OpenAI
    Скопировано!

    Экономически эффективный вариант GPT Image 1 для генерации изображений высокого качества с уменьшенной задержкой и стоимостью через специализированный API изображений от OpenAI.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Alibaba

    HappyHorse 1.0

    Alibaba
    Скопировано!

    HappyHorse 1.0 — это модель генерации видео от Alibaba. Она создает короткие видеоролики на основе текстового запроса, одного начального изображения или набора эталонных изображений, с разрешением до 1080p и продолжительностью от 3 до 15 секунд. Модель подходит для создания креативного контента, клипов для социальных сетей и анимации, основанной на изображениях, в различных соотношениях сторон.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Видео
  • Логотип Google

    Nano Banana 2 (Gemini 3.1 Flash Image)

    Google
    Скопировано!

    Gemini 3.1 Flash Image, также известная как “Nano Banana 2”, является новейшей моделью Google для генерации и редактирования изображений, обеспечивающей визуальное качество уровня Pro на скорости Flash. Она сочетает в себе передовое контекстуальное понимание с быстрой и экономически эффективной интерпретацией, делая сложную генерацию изображений и итеративные правки значительно более доступными.

    Входные данные:
    • Изображения
    • Текст
    Исходящие данные:
    • Изображения
    • Текст
  • Логотип Google

    Nano Banana Pro (Gemini 3 Pro Image)

    Google
    Скопировано!

    Nano Banana Pro — это самая продвинутая модель генерации и редактирования изображений от Google, построенная на базе Gemini 3 Pro. Она расширяет возможности оригинальной Nano Banana, значительно улучшая мультимодальное рассуждение, привязку к реальному миру и высокоточное визуальное синтезирование. Модель генерирует графику, насыщенную контекстом, от инфографики и диаграмм до кинематографических композиций, и может включать информацию в реальном времени через привязку к поиску.

    Она предлагает передовую в отрасли визуализацию текста в изображениях (включая длинные отрывки и многоязычные макеты), стабильное смешивание нескольких изображений и точное сохранение идентичности до пяти объектов. Nano Banana Pro добавляет детализированные креативные элементы управления, такие как локализованные правки, регулировка освещения и фокуса, трансформации камеры, а также поддержку вывода в 2K/4K и гибкие соотношения сторон. Она разработана для профессионального дизайна, визуализации продуктов, раскадровки и сложных многокомпонентных композиций, оставаясь при этом эффективной для общих рабочих процессов создания изображений.

    Входные данные:
    • Изображения
    • Текст
    Исходящие данные:
    • Изображения
    • Текст
  • Логотип Z AI

    GLM 5.2

    Z AI
    Скопировано!

    GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и подходит для долгосрочных рабочих процессов агентов, проектного уровня программной инженерии и сложной многоэтапной автоматизации.

    Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и следовать стандартам последовательно на протяжении всего рабочего процесса разработки, от требований до много платформенного развертывания, в одной задаче.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Moonshot AI

    Kimi K2.7 Code

    Moonshot AI
    Скопировано!

    MoonshotAI: Kimi K2.7 Code — это модель, ориентированная на программирование, из семейства Kimi K2 компании Moonshot AI, созданная для надежного выполнения комплексных программных задач в длительных контекстах. Она использует нативную мультимодальную архитектуру смеси экспертов, которая принимает текстовый и визуальный ввод, и всегда работает в режиме мышления, сохраняя полное содержание рассуждений в многоходовых диалогах. С контекстным окном в 256 тысяч токенов, она нацелена на программирование с длинным горизонтом, агентное разбиение задач и многоходовой диалог. Модель активирует 32 миллиарда параметров из примерно 1 триллиона общих.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип Anthropic

    Claude Fable 5

    Anthropic
    Скопировано!

    Claude Fable 5 — это модель класса Mythos от Anthropic, созданная для автономной работы с знаниями и кодирования. Она поддерживает ввод текста, изображений и файлов с выводом текста, с поддержкой рассуждений и контекстным окном на 1 миллион токенов. Модель подходит для длительных, сложных и асинхронных задач, которые ранее требовали частых проверок человеком.

    Она особенно сильна в выполнении задач от начала до конца, которые в противном случае занимали бы у человека часы, дни или недели, берясь за проблемы, которые являются длительными, неоднозначными или многосоставными. Модель эффективно выполняет четко определенные задачи с минимальным количеством ошибок, автоматически исправляя себя через циклы проверки, и поставляется с надежными средствами защиты.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Nex-agi

    Nex-N2-Pro

    Nex-agi
    Скопировано!

    Nex-N2-Pro — это агентная модель mixture-of-experts от Nex AGI, с 17 миллиардами активных параметров из 397 миллиардов общих. Построенная на архитектуре Qwen3.5, она принимает текстовые и графические входные данные и производит текстовый вывод, поддерживает рассуждение, вызов функций и структурированные выходные данные. Она предназначена для кодирования, использования инструментов, глубоких исследований и агентных рабочих процессов с длинным горизонтом, объединяя планирование, реализацию кода, отладку и итерацию в единый цикл выполнения.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип Sourceful

    Riverflow V2.5 Pro

    Sourceful
    Скопировано!

    Riverflow V2.5 Pro является самой мощной версией в линейке Riverflow 2.5 от Sourceful, идеально подходящей для задач высшего уровня, требующих контроля и чувствительных к качеству результатов. Серия Riverflow 2.5 представляет собой унифицированную систему преобразования текста в изображение и изображения в изображение…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип Sourceful

    Riverflow V2.5 Fast

    Sourceful
    Скопировано!

    Riverflow V2.5 Fast — это оптимизированный по скорости вариант серии Riverflow 2.5 от Sourceful, который лучше всего подходит для производственных развертываний и рабочих процессов, критичных к задержкам. Серия Riverflow 2.5 представляет собой унифицированное семейство преобразования текста в изображение и изображения в изображение…

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения
  • Логотип NVIDIA

    Nemotron 3 Ultra

    NVIDIA
    Скопировано!

    NVIDIA Nemotron 3 Ultra — это модель открытого разума и оркестрации от NVIDIA, с 55 миллиардами активных параметров из 550 миллиардов общих (MoE). Построенная на гибридной архитектуре Transformer-Mamba с смесью экспертов, она поддерживает ввод и вывод текста с контекстным окном до 1 миллиона токенов. Она подходит для длительных агентных рабочих процессов, включая оркестрацию агентов, кодирование агентов, глубокие исследования и сложные корпоративные задачи.

    Она особенно сильна в многошаговом рассуждении и планировании, с высокопроизводительным выводом, предназначенным для высокообъемных агентных конвейеров. Это часть семейства открытых моделей NVIDIA Nemotron для агентного ИИ.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3.7 Plus

    Qwen
    Скопировано!

    Qwen3.7-Plus — это экономичная модель в серии Qwen3.7 от Alibaba. Она поддерживает ввод текста и изображений с выводом текста, развивая текстовые возможности серии с комплексным обновлением её способностей в области зрения и языка, при этом сохраняя полнофункциональный интеллект агентского уровня для кодирования, использования инструментов и рабочих процессов продуктивности. Её отличительная черта — способность мультимодального интерактивного гибридного агента: она может воспринимать сцены реального мира, читать экраны и взаимодействовать с графическими интерфейсами, генерировать код из визуальных ссылок и выполнять навигацию от начала до конца в мобильных приложениях.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип Microsoft

    MAI-Voice-2

    Microsoft
    Скопировано!

    MAI-Voice-2 — это высококачественная, выразительная модель синтеза речи от Microsoft, работающая на базе Azure AI Speech. Она синтезирует естественно звучащую речь на более чем 10 языках с поддержкой выразительных стилей SSML (радостный, грустный, взволнованный и т.д.) и контролем скорости (0.5×–2×). Имена голосов следуют формату локали Azure (например, en-US-Harper:MAI-Voice-2). Выходные данные доступны в форматах MP3 и PCM с частотой 24 кГц.

    Входные данные:
    • Текст
    Исходящие данные:
    • Речь
  • Логотип Microsoft

    MAI-Transcribe 1.5

    Microsoft
    Скопировано!

    MAI-Transcribe 1.5 — это модель быстрой транскрипции от Microsoft на базе Azure AI Speech. Она поддерживает более 100 локалей BCP-47 с автоматическим определением языка, автоматической пунктуацией и поминутной тарификацией на основе продолжительности. Использует API быстрой транскрипции Azure Speech (v2025-10-15).

    Входные данные:
    • Аудио
    Исходящие данные:
    • Транскрибация
  • Логотип Microsoft

    MAI-Image-2.5

    Microsoft
    Скопировано!

    MAI-Image-2.5 от Microsoft — это высококачественная модель генерации изображений, доступная через Azure AI Foundry. Она создает фотореалистичные и художественные изображения на основе текстовых подсказок с поддержкой различных соотношений сторон.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Изображения