Каталог и идентификаторы
Список моделей не зашит в документацию: он меняется чаще, чем страница. Актуальный набор всегда отдаёт сам шлюз — на него и стоит смотреть из кода.
Получить список#
curl https://nirastudio.org/v1/models -H "Authorization: Bearer $NIRA_API_KEY"
{
"object": "list",
"data": [
{
"id": "anthropic/claude-sonnet-4.6",
"object": "model",
"created": 1770000000,
"owned_by": "anthropic",
"name": "Claude Sonnet 4.6",
"context_length": 1000000,
"pricing": { "prompt": "0.000003", "completion": "0.000015" }
}
]
}Поля#
| Поле | Что означает |
|---|---|
id | То, что подставляют в model. Формат разработчик/модель, например anthropic/claude-sonnet-4.6 |
name | Человеческое имя для интерфейса. В запросах не используется |
owned_by | Разработчик модели: anthropic, openai, google, deepseek… |
context_length | Сколько токенов вмещает вход вместе с ответом. null — провайдер не сообщает |
pricing.prompt | Цена за один входной токен, строкой. Строка, а не число — чтобы не терять знаки на разборе JSON |
pricing.completion | Цена за один выходной токен |
created | Когда модель появилась в каталоге, unix-время в секундах |
Одна модель#
Слэш в идентификаторе не мешает — путь принимает его как есть, кодировать не нужно:
curl https://nirastudio.org/v1/models/anthropic/claude-sonnet-4.6 \ -H "Authorization: Bearer $NIRA_API_KEY"
Если модели нет или она выключена — 404. Это же случится в /chat/completions, поэтому проверять существование заранее обычно незачем.
Псевдонимы#
Часть клиентов присылает имя в своём формате: без префикса разработчика, с версией через дефис, иногда с датой. Шлюз пробует сопоставить такое имя с каталогом, прежде чем отвечать 404. Это спасает настройки вида claude-sonnet-4.6 вместо anthropic/claude-sonnet-4.6.
id из /v1/models.Что выбрать#
Для агента в редакторе
Нужны инструменты и длинный контекст. Модели Anthropic семейства Sonnet — обычный выбор для повседневной работы: они держат вызовы функций и миллион токенов контекста.
Для массовых задач
Классификация, извлечение полей, короткие переписывания — здесь выигрывают быстрые модели: Haiku, Flash, Flash-Lite. Разница в цене между ними и старшими моделями — порядок, а на простых задачах качество почти не отличается.
Для сложных рассуждений
Старшие модели (Opus, Pro, R1) плюс поле reasoning.effort в Chat Completions. Рассуждение считается как выходные токены, поэтому включать его на всё подряд дорого.