Статус материала

Архивный материал перенесён без переписывания. Цифры и утверждения требуют актуальной сверки по ссылкам из исходной публикации.

Claude Sonnet 4.6: 1 миллион токенов контекста. Что с этим делать.

Не “новая модель вышла, какая классная”. А конкретно: что теперь возможно, что раньше было невозможно или стоило в 5 раз дороже. Контекст 1M токенов это примерно 700 000 слов. Или 1500 страниц текста. Или весь ваш проект на 50 файлов. Целиком. В одном запросе. Три юзкейса, которые раньше были проблемой:

Полная кодовая база в одном запросе. Раньше: разбиваешь проект на куски, отправляешь по частям, теряешь контекст между вызовами, агент “забывает” что было в прошлом куске. Теперь: загружаешь весь проект (до 1500 страниц кода), просишь найти баг или провести рефакторинг. Модель видит все зависимости разом. Длинные документы без потерь. Договор на 200 страниц. Финансовая отчётность за 3 года. Техническая документация на продукт целиком. Раньше приходилось резать на части, а на стыках терялись связи между разделами. Теперь один запрос, одна аналитика. Multi-document reasoning. Загрузи 10 отчётов конкурентов, проси найти несоответствия между ними. Или 5 контрактов, проси найти конфликтующие условия. Раньше это требовало цепочки вызовов с промежуточным хранилищем. Теперь один проход.

Что ещё важно: Цена не изменилась: $3 за миллион input-токенов, $15 за output. Тот же прайс что Sonnet 4.5. Extended thinking: модель “думает” перед ответом. Адаптивный режим: сама решает, нужно ли думать долго или задача простая. На сложных запросах качество растёт существенно. 300K output на Batches API. Это для тех, кто обрабатывает документы пакетами. Раньше лимит был 64K, для длинного анализа приходилось дробить. Теперь один вызов, один отчёт. Пользователи предпочитают его Sonnet 4.5 в 70% случаев на задачах кодирования. Что делать: Если работаете с документами больше 50 страниц: попробуйте загрузить целиком вместо нарезки. Разница в качестве анализа заметна. Если используете агентов: 1M контекста значит, что агент может работать дольше без потери памяти о том, что делал на предыдущих шагах. Если строите RAG: пересмотрите, нужен ли вам RAG вообще. Для документов до 1500 страниц прямая загрузка в контекст может быть и дешевле, и точнее.

Docs: anthropic.com/news/claude-sonnet-4-6 API: platform.claude.com/docs/en/about-claude/models/whats-new-claude-4-6

Источники и след

  1. 01 anthropic.com Ссылка из исходной публикации
  2. 02 platform.claude.com Ссылка из исходной публикации
  3. 03 Оригинал в канале Under the Hood Происхождение / Telegram / сообщение 148