Загрузка...

Каталог AI моделей и нейросетей: сравнение и цены

Каталог нейросетей с описанием возможностей и ценами в рублях. Сравните стоимость токенов и выберите лучшее решение.

  • Логотип Minimax

    MiniMax M1

    Minimax
    Скопировано!

    MiniMax-M1 — это крупномасштабная модель рассуждений с открытым весом, разработанная для расширенного контекста и высокоэффективного вывода. Она использует гибридную архитектуру Mixture-of-Experts (MoE) в сочетании с пользовательским механизмом “молниеносного внимания”, что позволяет обрабатывать длинные последовательности — до 1 миллиона токенов — при сохранении конкурентоспособной эффективности FLOP. С общим количеством параметров 456 миллиардов и 45,9 миллиарда активных на токен, этот вариант оптимизирован для сложных, многошаговых задач рассуждения.

    Обученная с помощью пользовательского конвейера обучения с подкреплением (CISPO), M1 превосходит в понимании длинного контекста, программной инженерии, использовании агентных инструментов и математическом рассуждении. Тесты показывают высокие результаты на FullStackBench, SWE-bench, MATH, GPQA и TAU-Bench, часто превосходя другие открытые модели, такие как DeepSeek R1 и Qwen3-235B.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemini 2.5 Flash

    Google
    Скопировано!

    Gemini 2.5 Flash — это передовая рабочая модель от Google, специально разработанная для выполнения сложных задач в области рассуждений, программирования, математики и науки. Она включает встроенные возможности “мышления”, что позволяет ей давать ответы с большей точностью и учитывать нюансы контекста.

    Входные данные:
    • Файл
    • Изображения
    • Текст
    • Аудио
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemini 2.5 Pro

    Google
    Скопировано!

    Gemini 2.5 Pro — это передовая модель ИИ от Google, разработанная для выполнения сложных задач в области рассуждений, программирования, математики и науки. Она использует возможности «мышления», что позволяет ей рассуждать при формировании ответов с повышенной точностью и тонким учетом контекста. Gemini 2.5 Pro демонстрирует высочайшую производительность по нескольким критериям, включая первое место в рейтинге LMArena, что отражает превосходное соответствие предпочтениям человека и способности решать сложные задачи.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    • Аудио
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemini 2.5 Pro Preview 06-05

    Google
    Скопировано!

    Gemini 2.5 Pro — это передовая модель искусственного интеллекта от Google, разработанная для выполнения сложных задач в области рассуждений, программирования, математики и науки. Она использует возможности «мышления», что позволяет ей рассуждать над ответами с повышенной точностью и учитывать нюансы контекста. Gemini 2.5 Pro демонстрирует высочайшую производительность на различных тестах, включая первое место в рейтинге LMArena, что отражает превосходное соответствие предпочтениям человека и способности решать сложные проблемы.

    Входные данные:
    • Файл
    • Изображения
    • Текст
    • Аудио
    Исходящие данные:
    • Текст
  • Логотип DeepSeek

    R1 0528

    DeepSeek
    Скопировано!

    Обновление от 28 мая для оригинального DeepSeek R1 Производительность на уровне OpenAI o1, но с открытым исходным кодом и полностью открытыми токенами рассуждений. Размер модели составляет 671 миллиард параметров, из которых 37 миллиардов активны в процессе вывода.

    Полностью открытая модель с открытым исходным кодом.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Anthropic

    Claude Opus 4

    Anthropic
    Скопировано!

    Claude Opus 4 оценивается как лучшая в мире модель для кодирования на момент выпуска, обеспечивая стабильную производительность на сложных, длительных задачах и рабочих процессах агентов. Она устанавливает новые стандарты в области программной инженерии, достигая ведущих результатов на SWE-bench (72.5%) и Terminal-bench (43.2%). Opus 4 поддерживает расширенные агентные рабочие процессы, обрабатывая тысячи шагов задач непрерывно в течение нескольких часов без ухудшения производительности.

    Входные данные:
    • Изображения
    • Текст
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Anthropic

    Claude Sonnet 4

    Anthropic
    Скопировано!

    Claude Sonnet 4 значительно улучшает возможности своего предшественника, Sonnet 3.7, превосходя его как в задачах кодирования, так и в задачах рассуждения с улучшенной точностью и управляемостью. Достигнув передовых результатов на SWE-bench (72,7%), Sonnet 4 сочетает в себе возможности и вычислительную эффективность, что делает его подходящим для широкого спектра приложений — от рутинных задач кодирования до сложных проектов разработки программного обеспечения. Ключевые улучшения включают улучшенную автономную навигацию по кодовой базе, снижение уровня ошибок в агентно-управляемых рабочих процессах и повышенную надежность в следовании сложным инструкциям. Sonnet 4 оптимизирован для практического повседневного использования, предоставляя расширенные возможности рассуждения при сохранении эффективности и отзывчивости в различных внутренних и внешних сценариях.

    Входные данные:
    • Изображения
    • Текст
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemma 3n 4B

    Google
    Скопировано!

    Gemma 3n E4B-it оптимизирован для эффективного выполнения на мобильных и малоресурсных устройствах, таких как телефоны, ноутбуки и планшеты. Он поддерживает мультимодальные вводы — включая текст, визуальные данные и аудио — что позволяет выполнять разнообразные задачи, такие как генерация текста, распознавание речи, перевод и анализ изображений. Используя инновации, такие как кэширование Per-Layer Embedding (PLE) и архитектура MatFormer, Gemma 3n динамически управляет использованием памяти и вычислительной нагрузкой, выборочно активируя параметры модели, что значительно снижает требования к ресурсам во время выполнения.

    Эта модель поддерживает широкий языковой диапазон (обучена на более чем 140 языках) и имеет гибкое контекстное окно на 32K токенов. Gemma 3n может выборочно загружать параметры, оптимизируя память и вычислительную эффективность в зависимости от задачи или возможностей устройства, что делает её подходящей для приложений, ориентированных на конфиденциальность, с возможностью работы в оффлайн-режиме и решений AI на устройстве. Подробнее в блоге

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Mistral AI

    Mistral Medium 3

    Mistral AI
    Скопировано!

    Mistral Medium 3 — это высокопроизводительная языковая модель корпоративного уровня, разработанная для предоставления передовых возможностей при значительно сниженной операционной стоимости. Она сочетает передовые возможности в области рассуждений и мультимодальной производительности с 8-кратным снижением затрат по сравнению с традиционными крупными моделями, что делает её подходящей для масштабируемого развертывания в профессиональных и промышленных сценариях использования.

    Модель превосходно работает в таких областях, как программирование, STEM-рассуждения и адаптация для предприятий. Она поддерживает гибридные, локальные и в-VPC развертывания и оптимизирована для интеграции в пользовательские рабочие процессы. Mistral Medium 3 предлагает конкурентоспособную точность по сравнению с более крупными моделями, такими как Claude Sonnet 3.5/3.7, Llama 4 Maverick и Command R+, при этом сохраняя широкую совместимость с облачными средами.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    Исходящие данные:
    • Текст
  • Логотип Google

    Gemini 2.5 Pro Preview 05-06

    Google
    Скопировано!

    Gemini 2.5 Pro — это передовая модель искусственного интеллекта от Google, разработанная для выполнения сложных задач в области рассуждений, программирования, математики и науки. Она использует возможности «мышления», что позволяет ей рассуждать при формировании ответов с повышенной точностью и тонким учетом контекста. Gemini 2.5 Pro демонстрирует высочайшую производительность на множестве тестов, включая первое место в рейтинге LMArena, что отражает превосходное соответствие предпочтениям человека и способности решать сложные задачи.

    Входные данные:
    • Текст
    • Изображения
    • Файл
    • Аудио
    • Видео
    Исходящие данные:
    • Текст
  • Логотип Arcee AI

    Virtuoso Large

    Arcee AI
    Скопировано!

    Virtuoso‑Large — это универсальная LLM высшего уровня от Arcee с 72 миллиардами параметров, настроенная для решения задач междисциплинарного рассуждения, креативного письма и корпоративного QA. В отличие от многих аналогов с 70 миллиардами параметров, она сохраняет контекст в 128 тысяч, унаследованный от Qwen 2.5, что позволяет ей полностью обрабатывать книги, кодовые базы или финансовые отчеты. Обучение сочетает дистилляцию DeepSeek R1, многократную эпоху контролируемой тонкой настройки и заключительный этап согласования DPO/RLHF, обеспечивая высокую производительность на тестах BIG‑Bench‑Hard, GSM‑8K и Needle‑In‑Haystack для длинного контекста. Компании используют Virtuoso‑Large как “резервный” мозг в конвейерах Conductor, когда другие SLM показывают низкую уверенность. Несмотря на свои размеры, агрессивные оптимизации KV‑кэша удерживают задержку первого токена в пределах нескольких секунд на узлах 8× H100, что делает её мощным инструментом для производственного использования.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Meta Llama

    Llama Guard 4 12B

    Meta Llama
    Скопировано!

    Llama Guard 4 — это многомодальная предварительно обученная модель, основанная на Llama 4 Scout, доработанная для классификации безопасности контента. Подобно предыдущим версиям, она может использоваться для классификации контента как во входных данных LLM (классификация запросов), так и в ответах LLM (классификация ответов). Она функционирует как LLM, генерируя текст на выходе, который указывает, является ли данный запрос или ответ безопасным или небезопасным, и если небезопасным, то также перечисляет категории контента, которые были нарушены.

    Llama Guard 4 была настроена для защиты от стандартизированной таксономии угроз MLCommons и разработана для поддержки многомодальных возможностей Llama 4. В частности, она объединяет функции предыдущих моделей Llama Guard, обеспечивая модерацию контента для английского и нескольких поддерживаемых языков, а также улучшенные возможности обработки смешанных текстово-изображенческих запросов, включая несколько изображений. Кроме того, Llama Guard 4 интегрирована в Llama Moderations API, расширяя надежную классификацию безопасности на текст и изображения.

    Входные данные:
    • Изображения
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 30B A3B

    Qwen
    Скопировано!

    Qwen3, последнее поколение в серии крупных языковых моделей Qwen, включает как плотные, так и архитектуры с набором экспертов (MoE), чтобы преуспевать в рассуждениях, многоязыковой поддержке и выполнении сложных задач агентами. Его уникальная способность беспрепятственно переключаться между режимом мышления для сложных рассуждений и режимом без мышления для эффективного диалога обеспечивает универсальную и высококачественную производительность.

    Значительно превосходя предыдущие модели, такие как QwQ и Qwen2.5, Qwen3 демонстрирует превосходные способности в математике, программировании, здравом смысле, творческом письме и интерактивном диалоге. Вариант Qwen3-30B-A3B включает 30,5 миллиарда параметров (3,3 миллиарда активированных), 48 слоев, 128 экспертов (8 активируются на задачу) и поддерживает до 131 тысячи токенов в контексте с YaRN, устанавливая новый стандарт среди моделей с открытым исходным кодом.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 8B

    Qwen
    Скопировано!

    Qwen3-8B — это плотная причинно-следственная языковая модель с 8,2 миллиардами параметров из серии Qwen3, разработанная как для задач, требующих интенсивного рассуждения, так и для эффективного диалога. Она поддерживает плавное переключение между режимом “мышления” для математики, программирования и логического вывода и режимом “немышления” для общего общения. Модель тонко настроена для следования инструкциям, интеграции агентов, творческого письма и многоязычного использования на более чем 100 языках и диалектах. Она изначально поддерживает контекстное окно в 32K токенов и может расширяться до 131K токенов с помощью масштабирования YaRN.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст
  • Логотип Qwen

    Qwen3 14B

    Qwen
    Скопировано!

    Qwen3-14B — это плотная причинно-следственная языковая модель с 14,8 миллиардами параметров из серии Qwen3, разработанная для сложных рассуждений и эффективного диалога. Она поддерживает бесшовное переключение между режимом “мышления” для задач, таких как математика, программирование и логический вывод, и режимом “немышления” для общих разговоров. Модель точно настроена для выполнения инструкций, использования инструментов агента, творческого письма и многоязычных задач на более чем 100 языках и диалектах. Она изначально обрабатывает контексты из 32 тысяч токенов и может расширяться до 131 тысячи токенов с использованием масштабирования на основе YaRN.

    Входные данные:
    • Текст
    Исходящие данные:
    • Текст