Характеристики Step 3.5 Flash
Контекстное окно 262K
Дата релиза 29 января 2026
Мультимодальность
Входящие данные:
- Текст
Исходящие данные:
- Текст
Цены Step 3.5 Flash в рублях
Оплата производится по факту за использованные токены.
Цены по провайдерам
RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.
-
1SiliconFlow10 ₽Входящие
Умная маршрутизация запросов
Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.
- Автоматический выбор
- Отказоустойчивость
- Лучшая цена
Цены по провайдерам
RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.
-
1SiliconFlow32 ₽Исходящие
Умная маршрутизация запросов
Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.
- Автоматический выбор
- Отказоустойчивость
- Лучшая цена
Цены указаны в рублях и могут меняться в зависимости от курса валют
Что умеет Step 3.5 Flash
Step 3.5 Flash — это самая продвинутая модель с открытым исходным кодом от StepFun. Построенная на архитектуре разреженной смеси экспертов (MoE), она избирательно активирует только 11 миллиардов из своих 196 миллиардов параметров на каждый токен. Это модель рассуждений, которая невероятно эффективна по скорости даже при работе с длинными контекстами.
API Step 3.5 Flash: подключение и примеры кода
Наш сервис предоставляет единый API, совместимый с OpenAI SDK. Просто укажите наш base_url и используйте ключ, полученный в личном кабинете.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://routerai.ru/api/v1"
)
response = client.chat.completions.create(
model="stepfun/step-3.5-flash",
messages=[
{"role": "user", "content": "Hello, how are you?"}
]
)
print(response.choices[0].message.content)
import requests
import json
url = "https://routerai.ru/api/v1/chat/completions"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "stepfun/step-3.5-flash",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}
response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stepfun/step-3.5-flash",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}'
Эндпоинты API
Chat Completions
Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.
https://routerai.ru/api/v1/chat/completions
Поддерживаемые параметры запроса
max_tokens
temperature
top_p
frequency_penalty
top_k
tool_choice
tools
reasoning
include_reasoning
Responses API
Создаёт ответ в формате OpenAI Responses API — для агентных сценариев и работы с инструментами. Поддерживает потоковый и обычный режимы.
https://routerai.ru/api/v1/responses
Поддерживаемые параметры запроса
max_tokens
temperature
top_p
frequency_penalty
top_k
tool_choice
tools
reasoning
include_reasoning
Messages API
Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).
https://routerai.ru/api/v1/messages
Поддерживаемые параметры запроса
max_tokens
temperature
top_p
frequency_penalty
top_k
tool_choice
tools
reasoning
include_reasoning