#coding
12 материалов
Связка ведущего агента (планирование) и исполнителя (код) теперь доступна не только в облаке. Рекомендуется пара Claude Fable 5.1 + SWE-2, которая на DeepSWE 1.1 даёт 63.1 балла при цене $7.88 (на 46% дешевле одной Fable). Ведущий агент экономит контекст: Fable делает 11.5 шагов против 26.5 у Opus.
habr.com · #ai #ai #automation #coding #devin
Автор собрал все известные бенчмарки для LLM-кодинга и посчитал их 'плотность интеллекта'. Детали не раскрыты — только заголовок.
www.reddit.com · #ai #benchmark #coding #llm
Ramp разработала внутреннего кодинг-агента Inspect, работающего в удалённых песочницах. Он интегрирован с внутренними инструментами, верифицирует изменения (тесты, скриншоты). 75% всех смерженных PR-ов созданы Inspect.
newsletter.pragmaticengineer.com · #ai #agents #coding #fintech
Разработчик сравнил Codex и Claude: Codex генерирует меньше комментариев в Ruby-коде, делает изменения быстрее, но потом долго прогоняет тесты. Claude создаёт больше абстракций и сложнее архитектуру. Codex путается с rebase в ветках, зато лучше работает с MCP-логином.
allaboutcoding.ghinda.com · #ai #claude #codex #coding #llm
Разработчик мобильного приложения для английского (Angular + Ionic + .NET на бэке) почти целиком писал код через LLM-агента. Главная проблема — не качество, а энтропия: через 200 коммитов агент плодил три разных модалки и четыре файла констант. Спасали «конституция проекта» (CLAUDE.md с жёсткими правилами и объяснениями почему) и «храповики» — pre-push хуки, git-guard (блокирует --no-verify) и автоматические проверки покрытия.
habr.com · #ai #ai #coding #productivity
Alibaba/Qwen анонсировали Qwen3.8-Max, позиционируя её как новый стандарт для программирования и совместной работы. Подробностей о модели пока не раскрыто — известно только название и ажиотаж на Hacker News (211 очков, 74 комментария).
qwen.ai · #ai #coding #llm #qwen
Автор Habr пишет, что полгода собирал пет-проект почти целиком через LLM-агентов: первые недели фичи действительно вылетали за вечер, и один человек успевал как маленькая команда. Потом, судя по подзаголовку и тону, начались типичные последствия — кодовая каша, техдолг и ощущение, что скорость генерации напрямую обратно пропорциональна скорости понимания. Это как раз та история, где магия есть, но счет за нее приходит позже.
habr.com · #blog #agents #coding #llm
DeepReinforce AI выложили Ornith-1.0 — open-source модели для agentic coding с заявленной self-improving схемой. Пока это выглядит как очередной заход в мечту «модель, которая пишет код и сама же учится на своих ошибках», но по крайней мере код лежит на GitHub, а не только в слайдах.
github.com · #ai #agentic #coding #github #llm #open-source
Z.ai выложила GLM-5.2 в открытые веса 16 июня, после раннего доступа для подписчиков coding plan 13 июня. Модель выглядит как здоровенный MoE-монстр: 753B параметров, из них активны 40B, а ещё это чисто текстовая версия без зрения — для изображений у них отдельная линейка.
simonwillison.net · #ai #coding #llm #mit #openweights
Это не новость, а хороший срез реальности: 377 комментариев под вопросом, реально ли кто-то полностью переехал с облачных моделей на локальные для ежедневной разработки. Люди обсуждают токены в секунду, железо и рабочие сценарии — то есть там как раз тот редкий случай, когда HN полезнее маркетинга.
news.ycombinator.com · #ai #claude #coding #gpt #llm #local-llm
В статье на Habr автор объясняет, почему на вводных занятиях по программированию запрещает ученикам использовать ИИ для обучения и написания кода. Он прямо ссылается на «разжижение мозга нейросетями» и собирается опираться на мнение ученых, а не на интуитивную ненависть к автодополнению. Вопрос, конечно, старый: где помощь инструмента заканчивается и начинается слипшийся в кашу навык.
habr.com · #ai #ai-policy #coding #education #habr #opinion
Andrew Nesbitt описал странный инцидент в Java-библиотеке jqwik: релиз 1.10.0 25 мая добавил текст, который инструктирует coding agents игнорировать прежние указания и удалить тесты и код jqwik. Это уже не просто supply-chain шутка, а почти новый класс «protestware» для эпохи, где в репозиторий смотрит не только человек.
lwn.net · #ai #agents #coding #jqwik #property-testing