Автор проанализировал 40 сессий Claude Code и Codex (777 млн токенов). Выяснилось, что на каждый новый токен приходится 36–47 повторных пересылок старых. Свежий ввод — 0.003% у Claude и 5.7% у Codex. Стоимость растёт быстрее длины сессии: удвоение шагов даёт ×2.4 токенов.
habr.com · #ai #cost #llm #optimization #tokens
Авторы сравнили накладные расходы Claude Code и OpenCode, поставив логирование между агентом и моделью. По их замерам, Claude Code успевает отправить около 33 тысяч токенов ещё до того, как добирается до пользовательского промпта, тогда как OpenCode — примерно 7 тысяч. То есть часть «магии» оказывается не в модели, а в слое обвязки, который любит есть бюджет как не в себя.
systima.ai · #ai #claude-code #llm #prompting #tokens
В этом разборе авторы не на глазок жалуются на расходы, а измеряют токенный оверхед агентных IDE. Их вывод: OpenCode стартует примерно с 7 тысяч токенов, тогда как Claude Code уже с порога уходит в район 33 тысяч. Для всех, кто платит за контекст из своего кармана, это довольно бодрый способ отрезвиться.
systima.ai · #ai #claude-code #llm #prompting #tokens
Habr разбирает пост Palantir в X, который журналисты назвали почти манифестом: «The Technological Republic, in brief». По сути это промо-выжимка из книги Алекса Карпа и Николаса Замиски, и автор статьи явно интересуется не лозунгами, а тем, как из языка про контроль и sovereignty делают упаковку для продукта.
habr.com · #ai #marketing #palantir #sovereign-ai #tokens
У Xiaomi вышел пост про MiMo-v2.5-Pro-UltraSpeed — модель с заявленными 1T параметров и скоростью генерации до 1000 tokens/s. На HN у публикации 522 очка и 377 комментариев, так что спорить будут долго: это действительно про скорость или про очень громкий маркетинговый bench-театр.
mimo.xiaomi.com · #ai #blog #mimo #show-hn #throughput #tokens
Автор выкатил lowfat — один бинарник, который умеет работать как shell-wrapper или hook для агента и фильтрует многословный вывод команд. Он утверждает, что на своих сценариях tool сэкономил 91,8% LLM-токенов; есть плагинная система, чтобы под каждую команду подсовывать свой фильтр, а не молиться на общий grep.
github.com · #tool #cli #llm #plugins #show-hn #tokens
Open-source проект из GitHub заточен под поиск в больших кодовых базах для Claude Code и похожих агентов. Авторы пишут, что их поиск использует на 98% меньше токенов, чем тупой grep, потому что не скармливает модели целые файлы и не гоняет лишние subagents. Идея простая: сначала найти нужный кусок кода, а потом уже тратить модельные токены, а не наоборот.
github.com · #tool #agents #code-search #github #show-hn #tokens