Автор проанализировал 40 сессий Claude Code и Codex (777 млн токенов). Выяснилось, что на каждый новый токен приходится 36–47 повторных пересылок старых. Свежий ввод — 0.003% у Claude и 5.7% у Codex. Стоимость растёт быстрее длины сессии: удвоение шагов даёт ×2.4 токенов.
habr.com · #ai #cost #llm #optimization #tokens
В утекшей аудиозаписи Accenture обсуждают, что основные потребители токенов — не разработчики, а нетехнические сотрудники. Главный «пожиратель» — преобразование PDF в изображения и затем в Markdown; компания пытается сократить расходы на AI.
simonwillison.net · #ai #business #cost #llm
Ploy.ai пишет, что после перевода рабочего AI-агента на GPT-5.6 получили 2,2× ускорение и минус 27% к стоимости. В статье именно про production-агента, а не про красивый синтетический бенчмарк на коленке. Интересно, что обычно такие апгрейды продают как «модель стала лучше», а тут считают вполне приземлённые деньги и время.
ploy.ai · #ai #agents #cost #gpt #production
Ars Technica пишет, что пользователи Copilot столкнулись с новой usage-based моделью цен. Некоторые умудрились сжечь весь месячный лимит AI-кредитов за один день — и это очень по-современному, когда инструмент для ускорения работы первым делом ускоряет расходы.
arstechnica.com · #ai #copilot #cost #pricing #subscription #usage