Справочник

Модели

Полный список моделей Claude, OpenAI: ID, вендор, контекст, максимальный output, поддержка tools и стриминга, назначение.

Обновлено 21 июл. 2026 г.6 мин
#модели#models#claude#gpt-5#контекст#context window

Через один ключ cr_… доступны восемь моделей трёх вендоров. Указывайте точный id из таблицы ниже — регистр и дефисы важны. Тарификация одинаковая для всех: по upstream-токенам (input + output + cache).

#Полный список

ID моделиВендорКонтекстМакс. outputToolsСтримНазначение
claude-opus-5Anthropic1M128KМаксимальное качество, сложные агенты и код
claude-sonnet-5Anthropic1M128KБаланс цена / качество, ежедневная работа
claude-fable-5Anthropic1M128KБыстрая модель поколения 5
claude-haiku-4-5Anthropic200K64KСкорость и низкая цена, простые задачи
gpt-5.6OpenAI1.05M128KУниверсальная флагманская модель
gpt-5.5-proOpenAI1.05M128KУсиленные рассуждения
gpt-5.4-miniOpenAI400K128KБыстрая и недорогая
gpt-5.3-codexOpenAI272K128KКод и агентные задачи
Точный id
Ошибка в id модели — это 404. Скопируйте значение из таблицы целиком, без пробелов и с правильными дефисами.

#Claude

  • `claude-opus-5` — топовое качество рассуждений и кода; берите под сложные агентные сценарии и ревью.
  • `claude-sonnet-5` — рабочая лошадка: сильный код и текст при разумной цене. Дефолт для большинства задач.
  • `claude-haiku-4-5` — самый быстрый и дешёвый Claude; классификация, извлечение, короткие ответы.

#OpenAI / Codex

  • `gpt-5` — флагман OpenAI, универсальные задачи и рассуждения.
  • `gpt-5-mini` — облегчённая версия для объёмных и недорогих запросов.
  • `gpt-5.3-codex` — заточен под код и агентные пайплайны (Codex CLI, IDE-агенты).

#Как выбрать

Нужен максимум качества

`claude-opus-5` или `gpt-5` — сложные рассуждения и агенты.

Ежедневная работа

`claude-sonnet-5` — лучший баланс цены и результата.

#Тарификация по токенам

Списывается стоимость реальных upstream-токенов: вход, выход и кеш. Более дешёвая модель на простой задаче экономит больше, чем любые ручные оптимизации промпта.

Совет
Маршрутизируйте запросы по сложности: простое — на Haiku / mini / Flash, сложное — на Opus / gpt-5. Так дневной лимит расходуется эффективнее.
Не помогло?

Напишите в Telegram — поможем с настройкой и подберём тариф. Или вернитесь ко всем разделам документации.