← Модуль 5: Оркестрация ИИ-инструментов и экономия ресурсов (Claude vs Cursor)
Блок 8 из 16·~15 мин·0/16 пройдено
Экономика LLM и анатомия токенов
8.1. Как тарифицируются запросы к ИИ
Любое взаимодействие с LLM оплачивается на основе количества обработанных токенов:
• C_in (входные токены) — стоимость входных токенов (ваш промпт + прикрепленный контекст файлов). • C_out (выходные токены) — стоимость выходных токенов (ответ ИИ и созданный код).
8.2. Анатомия расхода токенов размышления (Thinking Tokens)
В моделях рассуждения (Claude Fable 5 / Claude Opus 4.8 Thinking / GPT-5.6 Sol) списание токенов происходит по усложненной схеме:
Стоимость запроса
Стоимость = C_in × (входные токены) + C_out × (выходные токены + токены размышления)
⚠️Внимание
Важно: Если вы просите модель рассуждения решить простую задачу, она может сгенерировать 10 000 токенов размышления перед тем, как выдать 100 токенов кода. Вы заплатите за все 10 000 токенов размышления по максимальному тарифу!