📰 IT Дайджест

#cost

4 материала

5. Агенты пересылают 97% токенов повторно: исследование 40 сессий

Автор проанализировал 40 сессий Claude Code и Codex (777 млн токенов). Выяснилось, что на каждый новый токен приходится 36–47 повторных пересылок старых. Свежий ввод — 0.003% у Claude и 5.7% у Codex. Стоимость растёт быстрее длины сессии: удвоение шагов даёт ×2.4 токенов.

habr.com · #ai #cost #llm #optimization #tokens

11. Accenture: не инженеры, а конвертация PDF в Markdown сжирает токены

В утекшей аудиозаписи Accenture обсуждают, что основные потребители токенов — не разработчики, а нетехнические сотрудники. Главный «пожиратель» — преобразование PDF в изображения и затем в Markdown; компания пытается сократить расходы на AI.

simonwillison.net · #ai #business #cost #llm

2. Миграция production-агента на GPT-5.6: быстрее в 2,2 раза и дешевле на 27%

Ploy.ai пишет, что после перевода рабочего AI-агента на GPT-5.6 получили 2,2× ускорение и минус 27% к стоимости. В статье именно про production-агента, а не про красивый синтетический бенчмарк на коленке. Интересно, что обычно такие апгрейды продают как «модель стала лучше», а тут считают вполне приземлённые деньги и время.

ploy.ai · #ai #agents #cost #gpt #production

6. GitHub Copilot перешёл на оплату по потреблению, и кредиты сгорают за день

Ars Technica пишет, что пользователи Copilot столкнулись с новой usage-based моделью цен. Некоторые умудрились сжечь весь месячный лимит AI-кредитов за один день — и это очень по-современному, когда инструмент для ускорения работы первым делом ускоряет расходы.

arstechnica.com · #ai #copilot #cost #pricing #subscription #usage