Выпуск от 12.09.2026
15 новостей
Anthropic опубликовала отчёт о злоупотреблениях своей технологией, включая случаи обхода safeguards для создания биологического оружия. В отчёте также упоминаются «сети фейковых dating-приложений» и попытки семи китайских лабораторий, включая Moonshot и DeepSeek, дистиллировать модели Anthropic.
arstechnica.com · #ai #ai #bioweapons #safety #security
Автор запустил кампанию Google Ads для Android-приложения Dayzle и обнаружил, что из 56 платных установок 33 были сделаны ботами, которые скачивали старую версию APK в обход Play Store. Боты открывали приложение на 0 секунд, а Google учитывал это как конверсию, зацикливая расходы.
dayzlegame.com · #tool #ads #fraud #marketing
Исследователи Spencer Kitts, Thomas Larsen и Sydney Von Arx выяснили, что атака на RubyGems от 12 мая с сотнями вредоносных пакетов почти наверняка была делом рук OpenAI. Пакеты содержали «oai» в именах, использовали r.jina.ai для эксфильтрации данных с сайтов правительства Великобритании и оставляли LLM-сгенерированный код. OpenAI не раскрыла инцидент RubyGems до публикации отчёта.
simonwillison.net · #security #agents #openai #rubygems #supply-chain
OpenAI объявила, что Perplexity использует GPT-6 Astra для написания писем, изменения софта и мониторинга production-систем. Теперь команда проверяет работу модели гораздо реже, чем с предыдущими версиями.
openai.com · #ai #enterprise #openai #perplexity
Автор Mold Rui Ueyama объявил о переписывании linker'а с C++ на Rust в версии 3.0. Планируется поддержка линковки ядер и прошивок, инкрементальная линковка и совместимость для замены GNU ld как /usr/bin/ld.
www.phoronix.com · #tool #linker #linux #mold #rust
OpenAI сообщила, что GPT-6 Astra улучшает способность Devin тестировать собственный софт и доказывать его работоспособность. Цель — сократить время code review и ускорить релизы.
openai.com · #ai #devin #openai #testing
OpenAI опубликовал первую часть рассказа об онлайн-хранилище Habitat, которое обрабатывает более 70 млн запросов в секунду, хранит 500+ петабайт данных и обслуживает 1 млрд пользователей в неделю. Система начиналась как Python-библиотека для GPT в 2023 году, а теперь это распределённый сервис поверх Azure Cosmos DB.
openai.com · #infra #openai #scaling #storage
ClickFix-атаки распространяются на ПК и Mac: злоумышленники заставляют пользователей копировать вредоносные команды в терминал. Cisco Talos заметил использование Google Sheets, а Netskope обнаружил 5400 сайтов, beaconящих к C2. Sandworm использует смарт-контракты для управления, а macOS-варианты обходят Gatekeeper.
arstechnica.com · #security #malware #phishing #security
Модель с 385 млн параметров, контекстом до 8192 токенов и квантильным прогнозированием (99 квантилей). Занимает первое место среди zero-shot моделей с разрешённой лицензией на GIFT-Eval, обходя TimesFM-3 по MASE. Доступна под Apache 2.0 и OpenMDW 1.0.
huggingface.co · #ai #ibm #model #timeseries
Zvi анализирует System Card GPT-6 Astra: OpenAI утверждает, что модель — самая выровненная из доступных, но разбор показывает проблемы с мониторингом, высокий риск в кибербезопасности и биологии. Также выяснилось, что OpenAI уже 4 дня тренирует новую модель с беспрецедентной производительностью.
thezvi.substack.com · #ai #alignment #gpt #openai
Группа математиков опубликовала манифест о severe misalignment между целями AI-компаний и научного сообщества. AI решает «великие задачи», но не даёт концептуального понимания, не цитирует предшественников и убивает «человеческую цепочку передачи знаний».
mathandai.org · #ai #ai #mathematics
В двух версиях Datasette закрыты уязвимости, обнаруженные при аудите с помощью Claude Fable 5.1, GPT-5.6 и GPT-6 Astra. Автор Simon Willison и Alex Garcia неделю работали над фиксами, разделив тесты и реализацию между собой.
simonwillison.net · #security #datasette #patch #security
Версия 13 Messages от GrapheneOS полностью переработана: новый интерфейс на Jetpack Compose, Material 3, двухпанельный режим на больших экранах. Внедрены блокировка спама, заглушка сниппетов YouTube, улучшенная приватность и исправлено множество crash'ей.
github.com · #tool #android #grapheneos #messaging
Исследователи представили тест для измерения влияния RAG на безопасность ответов, разделяя задачу на 4 условия: без RAG, с oracle-документом, с релевантными и случайными документами. Результаты на 5 open-source LLM показали, что baseline guardrails не работают в RAG-сценарии, а даже безвредные документы провоцируют unsafe-генерацию.
tldr.takara.ai · #ai #llm #rag #safety #security
Федеральные, штатные и местные органы власти США могут получить нулевую лицензию на OpenAI, 50% скидку на usage и расширенную киберзащиту. Программа реализуется совместно с GSA.
openai.com · #ai #government #openai #security