📰 IT Дайджест

#tokens

7 материалов

5. Агенты пересылают 97% токенов повторно: исследование 40 сессий

Автор проанализировал 40 сессий Claude Code и Codex (777 млн токенов). Выяснилось, что на каждый новый токен приходится 36–47 повторных пересылок старых. Свежий ввод — 0.003% у Claude и 5.7% у Codex. Стоимость растёт быстрее длины сессии: удвоение шагов даёт ×2.4 токенов.

habr.com · #ai #cost #llm #optimization #tokens

1. Claude Code тратит 33k токенов до первого чтения промпта

Авторы сравнили накладные расходы Claude Code и OpenCode, поставив логирование между агентом и моделью. По их замерам, Claude Code успевает отправить около 33 тысяч токенов ещё до того, как добирается до пользовательского промпта, тогда как OpenCode — примерно 7 тысяч. То есть часть «магии» оказывается не в модели, а в слое обвязки, который любит есть бюджет как не в себя.

systima.ai · #ai #claude-code #llm #prompting #tokens

3. OpenCode сравнили с Claude Code: один ест 7k токенов, другой — 33k

В этом разборе авторы не на глазок жалуются на расходы, а измеряют токенный оверхед агентных IDE. Их вывод: OpenCode стартует примерно с 7 тысяч токенов, тогда как Claude Code уже с порога уходит в район 33 тысяч. Для всех, кто платит за контекст из своего кармана, это довольно бодрый способ отрезвиться.

systima.ai · #ai #claude-code #llm #prompting #tokens

15. Palantir снова продаёт «суверенный ИИ» через манифест и голые токены

Habr разбирает пост Palantir в X, который журналисты назвали почти манифестом: «The Technological Republic, in brief». По сути это промо-выжимка из книги Алекса Карпа и Николаса Замиски, и автор статьи явно интересуется не лозунгами, а тем, как из языка про контроль и sovereignty делают упаковку для продукта.

habr.com · #ai #marketing #palantir #sovereign-ai #tokens

2. Xiaomi хвастается моделью MiMo-v2.5-Pro-UltraSpeed: 1 трлн параметров и 1000 токенов в секунду

У Xiaomi вышел пост про MiMo-v2.5-Pro-UltraSpeed — модель с заявленными 1T параметров и скоростью генерации до 1000 tokens/s. На HN у публикации 522 очка и 377 комментариев, так что спорить будут долго: это действительно про скорость или про очень громкий маркетинговый bench-театр.

mimo.xiaomi.com · #ai #blog #mimo #show-hn #throughput #tokens

2. lowfat режет CLI-вывод и говорит, что сэкономил 91,8% токенов

Автор выкатил lowfat — один бинарник, который умеет работать как shell-wrapper или hook для агента и фильтрует многословный вывод команд. Он утверждает, что на своих сценариях tool сэкономил 91,8% LLM-токенов; есть плагинная система, чтобы под каждую команду подсовывать свой фильтр, а не молиться на общий grep.

github.com · #tool #cli #llm #plugins #show-hn #tokens

1. Semble ищет код для агента и обещает съедать меньше токенов, чем grep

Open-source проект из GitHub заточен под поиск в больших кодовых базах для Claude Code и похожих агентов. Авторы пишут, что их поиск использует на 98% меньше токенов, чем тупой grep, потому что не скармливает модели целые файлы и не гоняет лишние subagents. Идея простая: сначала найти нужный кусок кода, а потом уже тратить модельные токены, а не наоборот.

github.com · #tool #agents #code-search #github #show-hn #tokens