Продвинутые техники и обходные пути максимальной экономии токенов
1. Техника Prompt Caching (Кэширование контекста)
Современные API (Anthropic / OpenAI) автоматически кэшируют частые файлы (например, .cursorrules или PRD.md). Если файл не менялся, повторное считывание стоит на 90% дешевле.
Правило: Не редактируйте файл PRD.md во время мелких задач, чтобы он оставался в дешевом кэше.
2. Вынос рассуждений в бесплатные внешние сервисы (Free Reasoning Offload)
Вместо того чтобы тратить дорогие Reasoning-запросы в Cursor API, открывайте веб-версию Claude Fable 5 Web, DeepSeek-R1 или ChatGPT (Reasoning) в браузере.
Попросите веб-модель продумать алгоритм, скопируйте текстовый результат и передайте его в Cursor обычной быстрой моделью (GPT-5.6 Luna / Claude Haiku 4.5).
3. Передача сниппетов (AST / Function Signatures) вместо файлов
Если файл приложения содержит 1000 строк, не нужно прикреплять его целиком через @File. Скопируйте в промпт только заголовки функций (сигнатуры) и опишите логику. Это снизит расход входных токенов на 90%.