Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Anthropic

    Claude Haiku 4.5

    Anthropic
    Скопировано!

    Claude Haiku 4.5 — это самая быстрая и эффективная модель от Anthropic, обеспечивающая почти передовой уровень интеллекта за небольшую часть стоимости и задержки по сравнению с более крупными моделями Claude. Сопоставимая с производительностью Claude Sonnet 4 в задачах рассуждения, программирования и использования компьютера, Haiku 4.5 предоставляет возможности передового уровня для приложений в реальном времени и с высоким объемом данных.

    Она вводит расширенное мышление в линейку Haiku, позволяя контролировать глубину рассуждений, выводить обобщенные или чередующиеся мысли и использовать рабочие процессы с поддержкой инструментов, включая полную поддержку программирования, bash, веб-поиска и инструментов для работы с компьютером. Набирая более 73% на SWE-bench Verified, Haiku 4.5 входит в число лучших моделей для программирования в мире, при этом сохраняя исключительную отзывчивость для суб-агентов, параллельного выполнения и масштабируемого развертывания.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 VL 8B Thinking

    Qwen
    Скопировано!

    Qwen3-VL-8B-Thinking — это оптимизированный для рассуждений вариант мультимодальной модели Qwen3-VL-8B, разработанный для продвинутого визуального и текстового анализа в сложных сценах, документах и временных последовательностях. Он интегрирует улучшенное мультимодальное выравнивание и обработку длинного контекста (встроенные 256K, расширяемые до 1M токенов) для задач, таких как научный визуальный анализ, причинно-следственные выводы и математические рассуждения по изображениям или видео.

    По сравнению с версией Instruct, версия Thinking вводит более глубокое слияние визуального и языкового аспектов и продуманные пути рассуждений, которые улучшают производительность в задачах с длинными логическими цепочками, решении задач STEM и многократном понимании видео. Она достигает более сильной временной привязки с помощью Interleaved-MRoPE и встраиваний с учетом временных меток, при этом поддерживая надежное OCR, многоязычное понимание и генерацию текста на уровне крупных текстовых LLM.

    Входные данные:
    • Изображения
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 VL 8B Instruct

    Qwen
    Скопировано!

    Qwen3-VL-8B-Instruct — это мультимодальная модель из серии Qwen3-VL, созданная для высокоточного понимания и рассуждений по тексту, изображениям и видео. Она обладает улучшенной мультимодальной фьюзией с использованием Interleaved-MRoPE для временного рассуждения на длинных отрезках, DeepStack для точного выравнивания визуального и текстового контента, а также выравнивания текста и временных меток для точной локализации событий.

    Модель поддерживает контекстное окно на 256 тысяч токенов, которое можно расширить до 1 миллиона токенов, и обрабатывает как статические, так и динамические медиа-входы для задач, таких как парсинг документов, визуальные вопросы и ответы, пространственное рассуждение и управление графическим интерфейсом. Она достигает уровня понимания текста, сопоставимого с ведущими LLM, расширяя охват OCR до 32 языков и повышая устойчивость в различных визуальных условиях.

    Входные данные:
    • Изображения
    • Текст
    Исходящие данные:
    • Текст
  • Логотип OpenAI

    GPT-5 Image

    OpenAI
    Скопировано!

    Image сочетает в себе самую передовую языковую модель OpenAI с передовыми возможностями генерации изображений. Она предлагает значительные улучшения в области рассуждений, качества кода и пользовательского опыта, при этом включая превосходное следование инструкциям, рендеринг текста и детальное редактирование изображений, характерные для GPT Image 1.

    Входные данные:
    • Изображения
    • Текст
    • Файл
    Исходящие данные:
    • Изображения
    • Текст
  • Логотип Google

    Nano Banana (Gemini 2.5 Flash Image)

    Google
    Скопировано!

    Gemini 2.5 Flash Image, также известный как “Nano Banana”, теперь доступен для общего использования. Это современная модель генерации изображений с контекстуальным пониманием. Она способна на генерацию изображений, редактирование и ведение многоходовых диалогов.

    Входные данные:
    • Изображения
    • Текст
    Исходящие данные:
    • Изображения
    • Текст
  • Логотип Qwen

    Qwen3 VL 30B A3B Thinking

    Qwen
    Скопировано!

    Qwen3-VL-30B-A3B-Thinking — это мультимодальная модель, объединяющая мощную генерацию текста с визуальным пониманием изображений и видео. Ее вариант Thinking улучшает способность к рассуждению в STEM, математике и сложных задачах. Она превосходно воспринимает реальные и синтетические категории, 2D/3D пространственное закрепление и долгосрочное визуальное понимание, достигая конкурентоспособных результатов в мультимодальных тестах. Для агентного использования она справляется с многоизображенческими многоходовыми инструкциями, выравниванием временных шкал видео, автоматизацией GUI и визуальным кодированием от набросков до отлаженного пользовательского интерфейса. Производительность текста соответствует флагманским моделям Qwen3, что делает ее подходящей для документального ИИ, OCR, помощи в пользовательском интерфейсе, пространственных задач и исследований агентов.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 VL 30B A3B Instruct

    Qwen
    Скопировано!

    Qwen3-VL-30B-A3B-Instruct — это мультимодальная модель, объединяющая мощную генерацию текста с визуальным пониманием изображений и видео. Вариант Instruct оптимизирован для выполнения инструкций в общих мультимодальных задачах. Она превосходно справляется с восприятием реальных и синтетических категорий, 2D/3D пространственным обоснованием и длительным визуальным пониманием, достигая конкурентоспособных результатов в мультимодальных тестах. Для агентного использования она обрабатывает инструкции с несколькими изображениями и многократными обращениями, выравнивание временной шкалы видео, автоматизацию графического интерфейса и визуальное кодирование от эскизов до отлаженного пользовательского интерфейса. Производительность текста соответствует флагманским моделям Qwen3, что делает её подходящей для ИИ документов, OCR, помощи в пользовательском интерфейсе, пространственных задач и исследований агентов.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст
  • Логотип OpenAI

    GPT-5 Pro

    OpenAI
    Скопировано!

    GPT-5 Pro — это самая продвинутая модель OpenAI, предлагающая значительные улучшения в области рассуждений, качества кода и пользовательского опыта. Она оптимизирована для сложных задач, требующих пошагового рассуждения, следования инструкциям и точности в критически важных случаях использования. Модель поддерживает функции маршрутизации во время тестирования и продвинутое понимание подсказок, включая намерения, заданные пользователем, такие как “подумай над этим тщательно”. Улучшения включают снижение количества галлюцинаций, лести и лучшую производительность в задачах программирования, письма и связанных со здоровьем.

    Входные данные:
    • Изображения
    • Текст
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM 4.6 (exacto)

    Z AI
    Скопировано!

    По сравнению с GLM-4.5, это поколение вносит несколько ключевых улучшений:

    Увеличенное окно контекста: Окно контекста расширено с 128K до 200K токенов, что позволяет модели справляться с более сложными агентными задачами.
    Улучшенная производительность в кодировании: Модель достигает более высоких результатов в тестах на код и демонстрирует лучшую производительность в реальных приложениях, таких как Claude Code, Cline, Roo Code и Kilo Code, включая улучшения в создании визуально отточенных фронт-энд страниц.
    Продвинутое рассуждение: GLM-4.6 показывает явное улучшение в производительности рассуждений и поддерживает использование инструментов во время вывода, что приводит к более сильным общим возможностям.
    Более способные агенты: GLM-4.6 демонстрирует более высокую производительность в использовании инструментов и поисковых агентов, и более эффективно интегрируется в агентные фреймворки.
    Усовершенствованное написание: Лучше соответствует человеческим предпочтениям в стиле и читаемости, и действует более естественно в сценариях ролевых игр.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Z AI

    GLM 4.6

    Z AI
    Скопировано!

    По сравнению с GLM-4.5, это поколение вносит несколько ключевых улучшений:

    Увеличенное окно контекста: Окно контекста расширено с 128K до 200K токенов, что позволяет модели справляться с более сложными агентными задачами.
    Улучшенная производительность в кодировании: Модель достигает более высоких результатов в тестах на код и демонстрирует лучшую производительность в реальных приложениях, таких как Claude Code, Cline, Roo Code и Kilo Code, включая улучшения в создании визуально проработанных фронтэнд-страниц.
    Продвинутое рассуждение: GLM-4.6 показывает явное улучшение в производительности рассуждений и поддерживает использование инструментов во время вывода, что приводит к более высокой общей способности.
    Более способные агенты: GLM-4.6 демонстрирует более высокую производительность в использовании инструментов и поисковых агентов, а также более эффективно интегрируется в агентные фреймворки.
    Улучшенное написание: Лучше соответствует человеческим предпочтениям в стиле и читаемости, и более естественно выполняет ролевые сценарии.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Anthropic

    Claude Sonnet 4.5

    Anthropic
    Скопировано!

    Claude Sonnet 4.5 — это самая продвинутая модель Sonnet от Anthropic на сегодняшний день, оптимизированная для агентов реального мира и рабочих процессов программирования. Она демонстрирует передовые результаты на тестах программирования, таких как SWE-bench Verified, с улучшениями в проектировании систем, безопасности кода и соблюдении спецификаций. Модель разработана для длительной автономной работы, поддерживая непрерывность задач между сессиями и предоставляя отслеживание прогресса на основе фактов.

    Sonnet 4.5 также вводит более сильные агентные возможности, включая улучшенную оркестрацию инструментов, спекулятивное параллельное выполнение и более эффективное управление контекстом и памятью. Благодаря улучшенному отслеживанию контекста и осведомленности о использовании токенов в вызовах инструментов, она особенно хорошо подходит для многоконтекстных и длительных рабочих процессов. Области применения охватывают разработку программного обеспечения, кибербезопасность, финансовый анализ, исследовательские агенты и другие области, требующие устойчивого рассуждения и использования инструментов.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип DeepSeek

    DeepSeek V3.2 Exp

    DeepSeek
    Скопировано!

    DeepSeek-V3.2-Exp — это экспериментальная крупная языковая модель, выпущенная компанией DeepSeek как промежуточный шаг между V3.1 и будущими архитектурами. Она вводит механизм DeepSeek Sparse Attention (DSA), тонко настроенный разреженный механизм внимания, разработанный для повышения эффективности обучения и вывода в сценариях с длинным контекстом, сохраняя при этом качество вывода. Пользователи могут управлять поведением рассуждений с помощью логического параметра reasoning enabled.

    Модель была обучена в условиях, согласованных с V3.1-Terminus, чтобы обеспечить прямое сравнение. Тестирование показывает производительность примерно на уровне V3.1 в задачах рассуждения, кодирования и использования агентных инструментов, с незначительными компромиссами и улучшениями в зависимости от области. Этот выпуск сосредоточен на проверке архитектурных оптимизаций для увеличенных длин контекста, а не на повышении точности выполнения задач, что делает его в первую очередь исследовательской моделью для изучения эффективных дизайнов трансформеров.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип The Drummer

    Cydonia 24B V4.1

    The Drummer
    Скопировано!

    Модель для нецензурированного и креативного письма, основанная на Mistral Small 3.2 24B, с хорошей памятью, соблюдением инструкций и интеллектом.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Relace

    Relace Apply 3

    Relace
    Скопировано!

    Relace Apply 3 — это специализированная LLM для исправления кода, которая интегрирует предлагаемые ИИ изменения прямо в ваши исходные файлы. Она может применять обновления от GPT-4o, Claude и других в ваши файлы со средней скоростью 7500 токенов в секунду.

    Модель требует, чтобы запрос был в следующем формате:

    {инструкция}

    {исходный_код}

    {фрагмент_правки}

    Для Relace включено нулевое сохранение данных.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 VL 235B A22B Thinking

    Qwen
    Скопировано!

    Qwen3-VL-235B-A22B Thinking — это мультимодальная модель, объединяющая мощную генерацию текста с визуальным пониманием изображений и видео. Модель Thinking оптимизирована для мультимодального рассуждения в STEM и математике. Серия делает акцент на надежном восприятии (распознавание разнообразных реальных и синтетических категорий), пространственном понимании (привязка к 2D/3D) и долгосрочном визуальном понимании, демонстрируя конкурентоспособные результаты на публичных мультимодальных тестах как для восприятия, так и для рассуждения.

    Помимо анализа, Qwen3-VL поддерживает агентное взаимодействие и использование инструментов: она может следовать сложным инструкциям в диалогах с несколькими изображениями и несколькими этапами; синхронизировать текст с временными шкалами видео для точных временных запросов; и управлять элементами графического интерфейса для автоматизации задач. Модели также поддерживают рабочие процессы визуального кодирования, превращая эскизы или макеты в код и помогая с отладкой интерфейса, сохраняя при этом высокую производительность только на текстовом уровне, сравнимую с флагманскими языковыми моделями Qwen3. Это делает Qwen3-VL подходящей для производственных сценариев, охватывающих документальный ИИ, многоязычный OCR, помощь с программным обеспечением/интерфейсом, пространственные/воплощенные задачи и исследования агентов, работающих с видением и языком.

    Входные данные:
    • Текст
    • Изображения
    Исходящие данные:
    • Текст