📰 IT Дайджест

#automation

16 материалов

10. Cognition запустила Devin Fusion для Desktop и CLI: две модели работают как lead и developer

Связка ведущего агента (планирование) и исполнителя (код) теперь доступна не только в облаке. Рекомендуется пара Claude Fable 5.1 + SWE-2, которая на DeepSWE 1.1 даёт 63.1 балла при цене $7.88 (на 46% дешевле одной Fable). Ведущий агент экономит контекст: Fable делает 11.5 шагов против 26.5 у Opus.

habr.com · #ai #ai #automation #coding #devin

13. Уволенные ради ИИ разработчики собрали open-source «ИИ-генерального директора»

В репозитории SenteLabsAI/OpenExecutive появился «виртуальный исполнительный директор»: одна персона, за которой стоят 8 специализированных Claude-агентов, стек FastAPI + Next.js, лицензия Apache 2.0. Проект позиционируется как советник с «уровнем Harvard MBA», адаптированный под конкретный бизнес.

github.com · #ai #ai #automation #employment

8. ИИ-ревью кода стало бизнесом: CodeRabbit и Blacksmith собрали $190 млн за день

По данным The Information, PR от ИИ-агентов на GitHub выросли с ~4 млн в месяц в сентябре 2025-го до более 17 млн в марте 2026-го. 12 августа CodeRabbit привлек $143 млн при оценке $1,5 млрд, а Blacksmith — $45 млн при оценке $550 млн, и оба продают проверку кода, а не его генерацию. CodeRabbit гоняет конвейер из 7–8 моделей с живым графом связей кода и моделью-судьей, а Anthropic заявляет, что ее Code Review поднял долю PR с замечаниями с 16% до 54%.

habr.com · #ai #automation #github #opensource

10. Anthropic делает auto mode по умолчанию и заявляет о победе над prompt injection

С 14 августа в Claude Code для Pro, Max и Team авторежим становится дефолтом. Anthropic опубликовала eval: из 1053 тестеров только 13.6% людей отказались выполнить опасную команду, а auto mode заблокировал бы 89% таких действий. Третья сторона Trajectory Labs протестировала 720 атак indirect prompt injection — ни одна не прошла на Claude Fable 5, Opus 5 и Sonnet 5.

simonwillison.net · #ai #anthropic #automation #claude

4. Cloudflare построила софтверную фабрику для Astro: число открытых issue упало с 200 до 30

Cloudflare запустила автоматизированный пайплайн Flue для триажа issue в репозитории Astro. Агенты воспроизводят баги в sandbox, диагностируют причину, фиксят и выкатывают preview-релизы через pkg.pr.new. За несколько месяцев число открытых issue снизилось с 200+ до ~30, цель — ноль впервые за 5 лет.

blog.cloudflare.com · #ai #agents #astro #automation #github

13. qm — мультиплеерный агентный харнес для стартапов в Slack и на вебе

Каждый сотрудник получает изолированное рабочее пространство с собственной памятью, файлами, keychain, кронами и песочницей. Агенты могут работать в каналах и групповых чатах. Харнес не привязан к вендору: поддерживаются Pi, OpenCode, Codex и Claude Code через одно ядро.

github.com · #ai #agents #ai #automation #harness

13. В США пилотируют AI для предварительного одобрения страховки — 61% врачей боятся, что станет хуже

Администрация Трампа запускает пилотную программу в шести штатах по использованию AI для принятия решений о предварительном разрешении страховых выплат. Опрос AMA показал, что 61% врачей опасаются, что AI увеличит число неправомерных отказов. По данным Commonwealth Fund, каждый пятый взрослый с частной страховкой сталкивался с отказом в 2025 году. Сроки принятия решений: 72 часа для срочных запросов, 7 дней для обычных.

arstechnica.com · #ai #automation #healthcare #policy

11. Codex Desktop теперь выпускает на рабочий стол пингвина-пеликана

Саймон Уиллисн случайно включил в Codex Desktop «pet» — маленького анимированного робота, а потом обнаружил, что можно сделать своего. Он собрал себе пеликана на велосипеде, который прыгает по десктопу и подсказывает статус задач Codex. Небольшой, но очень показательный пример того, как IDE-помощники быстро обрастают декоративной магией и начинают вести себя как тамагочи для разработчиков.

simonwillison.net · #blog #automation #codex #desktop #simonwillison

5. reaction: демон, который ищет повторяющиеся паттерны в выводе программ

На Framagit лежит reaction — daemon, который сканирует stdout/stderr программ на повторяющиеся шаблоны и может на них реагировать. Идея простая до боли: если ваш процесс начал печатать одну и ту же дрянь по кругу, пусть хотя бы кто-то это заметит раньше, чем вы.

framagit.org · #tool #automation #daemon #monitoring #patterns #show-hn

11. Как не втащить автоматизацию в бизнес раньше, чем посчитали базовые вещи

На Habr автор разбирает, какие решения нужно принять до первой строчки кода в проекте по автоматизации. Он отдельно цепляется за моду на «внедрение ИИ»: сначала надо понять процессы, данные и ограничения, а уже потом выбирать модель, стек и количество GPU — иначе получится дорогая имитация работы.

habr.com · #blog #automation #business #management

11. Хабр разобрал, как делать ботов для MAX с вложениями

В статье про “махоботоводство” авторы дошли до практики с вложениями разных типов в сообщениях и отдельно отмечают неприятное изменение в MAX Bot API. Это уже не теория про платформу будущего, а вполне приземлённая инструкция с оговорками о том, что документация опять успела поменяться.

habr.com · #other #automation #forum #robotics

9. Почему Tom MacWright бесит LLM-резюме и LLM-портфолио

Simon Willison цитирует Тома МакРайта, который уже начал видеть кандидатов с резюме, портфолио и GitHub-проектами, собранными LLM от начала до конца. Его претензия не к самому инструменту, а к тому, что за такими людьми почти не видно собственного следа: ни реального текста, ни живых решений, ни хоть какого-то трения об реальность. В итоге получается идеально отполированный профиль, по которому невозможно понять, что человек вообще умеет сам.

simonwillison.net · #ai #automation #fraud #github #jobs #llm

15. Онбординг за дни вместо недель: ИИ на базе знаний компании

Habr пишет о корпоративном ИИ для онбординга, который собирает обучение из внутренней базы знаний и обещает сократить ввод новичков в курс дела до нескольких дней. В самом тексте есть неприятная цифра: за последние пару лет в корпоративный AI вложили 30–40 миллиардов долларов, а к лету 2025-го выяснилось, что 95% внедрений не дали бизнесу ощутимого эффекта. То есть кейс подается как ответ на очень дорогую проблему, которую рынок уже успел частично купить и частично проигнорировать.

habr.com · #ai #ai #automation #corp #knowledgebase #onboarding

12. GM поставил роботов на флагманском EV-заводе после увольнения 1300 человек

Ars Technica пишет, что GM ставит роботов на флагманском заводе по выпуску электромобилей, и это происходит после увольнения 1300 работников. Профсоюз уже предупреждает о «dark factory» будущем — то есть о заводах, где людей будет меньше, чем табличек с правилами безопасности.

arstechnica.com · #drama #automation #autoworkers #robots

13. Как ревьюить ИИ-код: 84% разработчиков уже используют ИИ-инструменты

В материале ссылаются на данные Stack Overflow: 84% разработчиков уже используют или собираются использовать AI-инструменты. Авторы пытаются разложить по полочкам, что можно автоматизировать в ревью, а что всё ещё должен проверять человек — потому что скорость генерации кода и скорость поиска багов, как водится, живут в разных вселенных.

habr.com · #ai #ai #automation #code-review #developers #process

3. tail CI-логи по SSH, не открывая очередной веб-танец

Небольшой пост про то, как смотреть CI-логи через SSH, а не через очередной веб-интерфейс с тремя слоями JavaScript. Судя по названию, идея в том, чтобы просто стримить вывод, как нормальные люди, когда build уже горит.

blog.tangled.org · #tool #automation #ci #logs #ssh