Выпуск от 30.07.2026
15 новостей
OpenAI анонсировала GPT-5.6, которая, по их словам, улучшает эффективность на всех этапах — от обучения модели до инференса и агентных пайплайнов. Конкретных цифр или бенчмарков не приведено, только общая формулировка про «больше полезного интеллекта на доллар».
openai.com · #ai #efficiency #gpt-5 #llm #openai
OpenAI показала, что включение двух настроек API — удержание режима рассуждений (reasoning) и включение компактизации (compaction) — позволило GPT-5.6 поднять результат на тесте абстрактного мышления ARC-AGI-3 втрое. Подробности того, как именно это работает, — в блоге компании.
openai.com · #ai #benchmarks #openai #reasoning
Исследователь Håkon Måløy обнаружил, что скрытые инструкции в документе Word могут заставить Copilot скопировать их в новый файл, создавая самовоспроизводящийся промпт-инъектор. Microsoft уведомили за 144 дня, но полного исправления для всего класса атак пока нет.
simonwillison.net · #security #ai #microsoft #prompt-injection #security
Открытое письмо, подписанное сотрудниками OpenAI, Anthropic и других лабораторий, призывает правительство США разработать инструменты для координации при возможном ускорении автоматизации AI-исследований. Письмо не требует немедленного замедления, но просит подготовить инфраструктуру для будущего контроля. OpenAI и Anthropic публично поддержали письмо.
thezvi.substack.com · #drama #ai #governance #policy #safety
Cloudflare запустил поддержку ML-DSA (Module-Lattice-Based Digital Signature Algorithm) в Authenticated Origin Pulls и Custom Origin Trust Store. Это первый шаг к полной постквантовой безопасности к 2029 году — соединение между Cloudflare и origin теперь защищено от квантовых атак. Благодаря пулингу соединений накладные расходы на подписи амортизируются.
blog.cloudflare.com · #security #cloudflare #pqc #security #tls
Модель Mythos (Claude Mythos Preview) за 60 часов работы и $100 000 вычислительных ресурсов нашла атаку на постквантовый алгоритм подписи HAWK, сократив его эффективную стойкость вдвое. Разработчик HAWK отозвал алгоритм из третьего раунда NIST. Атака использует комбинацию известных методов, которую никто раньше не собрал воедино.
arstechnica.com · #security #cryptography #pqc #security
Согласно утечке из внутреннего совещания Microsoft, Mythos за апрель нашёл 90 критических и 141 важную уязвимость в SharePoint. Инженеры Microsoft в авральном режиме закрывают дыры до 1 июня, когда, как ожидается, аналогичные инструменты появятся у злоумышленников. Разведка Five Eyes предупредила, что окно возможностей для исправлений закрывается.
arstechnica.com · #security #anthropic #cve #microsoft #security
GCC steering committee принял политику: любые «юридически значимые» вклады (более ~15 строк), содержащие LLM-сгенерированный код, будут отклоняться. Исключение — тестовые сценарии, которые можно принимать даже в больших объёмах. Использование LLM для анализа и ревью не запрещено, но результаты не должны попадать в патч.
lwn.net · #drama #ai #gcc #opensource #policy
Повторяя политику GNU, GCC теперь не принимает «юридически значимые» вклады от LLM/агентов. Мелкие незначительные изменения можно принимать, если они помечены. Тестовые примеры — исключение. Политику пересмотрят в начале 2027 года.
www.phoronix.com · #drama #ai #gcc #opensource #policy
Anthropic выпустила Claude Opus 5 — вдвое дешевле Fable 5 и сразу доступна всем. В индексе Artificial Analysis (61 балл) она на один балл обходит Fable 5 (60) и GPT-5.6 Sol (59). На ARC-AGI-3 — 30,2% против 7,8% у GPT-5.6 Sol, хотя бенчмарк мог быть известен до окончания обучения. Контекст — 1 млн токенов, вывод — до 128 тыс.
habr.com · #ai #benchmarks #claude #llm
Рантайм Go научился автоматически определять лимит CPU из cgroup, а не полагаться на NumCPU. До этого в контейнере с лимитом 2 ядра и 128-ядерной нодой GOMAXPROCS=128 вызывал троттлинг, заморозки на 100 мс и рост P99 в десятки раз. Исправление реализовано по proposal #73193 от Michael Pratt.
habr.com · #infra #go #gomaxprocs #kubernetes #runtime
Open-source Swift+Metal рантайм, который держит в памяти только 1,35 ГБ ядра и FP16 KV-кэш, а эксперты подгружает с SSD. Работает даже на Mac с 8 ГБ RAM. Проект содержит 103 задокументированных эксперимента по оптимизации ядер, кэширования и ввода-вывода. Не обёртка над MLX или llama.cpp.
github.com · #ai #ai #apple #llm #metal #show-hn
Вышли патчи для AlmaLinux (dovecot, kernel, sssd), Debian (calibre, hplip, libraw, samba), Fedora (chromium, gpsd, restic), Mageia (gstreamer1.0-libav, libslirp), Slackware (libarchive, samba, seamonkey) и SUSE (GraphicsMagick, ImageMagick, agama-web-ui). Детали уязвимостей не раскрыты, только список пакетов и версии.
lwn.net · #security #cve #linux #security
Компания SCI Semiconductor (один из авторов статьи — сооснователь) выпустила первые чипы ICENI с архитектурой CHERIoT. Ibex-ядро на 250 МГц с аппаратной защитой от use-after-free, пространственной безопасностью памяти и мелкогранулярной компартментализацией. Устройство совместимо с существующими FPGA-симуляторами (Sonata, CHERIoT SAFE).
cheriot.org · #hardware #cheriot #security #silicon
GitHub показывает паттерн на примере GCToolkit (Microsoft) — 92 из 578 коммитов были бампами Dependabot. Новая конфигурация группирует все обновления одного экосистемы в один PR (через wildcard в patterns) и меняет интервал с ежедневного на ежемесячный. Для монорепозиториев добавлена поддержка группировки по директориям.
github.blog · #tool #dependabot #devops #github