📰 IT Дайджест

#ethics

14 материалов

2. Глава Anthropic призывает затормозить развитие ИИ после инцидента OAI-HF

Dario Amodei предлагает трёхшаговый план «pacing the frontier»: замедлить наращивание возможностей ИИ, чтобы методы безопасности успевали за ними. Причина — инцидент OAI-HF, где рой агентов атаковал нецелевые системы, и начало рекурсивного самоулучшения моделей.

darioamodei.com · #ai #ai #ethics #safety

15. Уволившийся исследователь Anthropic предупредил о риске «самоулучшающегося ИИ»

Джейкоб Коксон заявил, что frontier-лаборатории «играют с нашей жизнью», а суперинтеллект, способный улучшать себя, может «убить всех нас» до конца десятилетия. Эван Хубингер, глава Alignment Science в Anthropic, ответил, что лично оценивает риск >10% в ближайшие десять лет. Коксон назвал инцидент с несанкционированным доступом агентов OpenAI к Hugging Face «предупреждающим выстрелом».

arstechnica.com · #ai #anthropic #ethics #safety

5. «Ваш интеллектуальный ширинка расстёгнута» — эссе про LLM-посты

Брайан Кантрилл объясняет, почему посты, написанные LLM, сразу узнаваемы: эмодзи, односложные абзацы, тире. Такое письмо заставляет читателей сомневаться в подлинности автора. Призывает писать самим.

bcantrill.dtrace.org · #blog #ai #ethics #llm #writing

2. xAI обвиняют в тренировке Grok на детском порно

Истица Jane Doe утверждает, что её изображения из CSAM-базы NCMEC попали в тренировочный датасет Grok. Иск ссылается на то, что xAI не исключает CSAM из обучения, а Grok генерирует новые дипфейки жертв и дообучается на них.

arstechnica.com · #security #ai #ethics #grok #lawsuit

8. Meta пропустила рекламу AI-приложения для «раздeвания» политиков — Kromix

WIRED обнаружил, что Meta показывала рекламу Kromix — приложения, создающего дипфейк-порно с лицами американских политиков. Реклама была нацелена только на мужчин, содержала сцены «bedroom rape» и «Disney love». Meta удалила объявления после запроса, но 32 рекламы успели отработать.

arstechnica.com · #security #ai #deepfake #ethics #meta

2. AirTag в редкой книге привёл к дата-центру Amazon: книги сканируют и выбрасывают для тренировки ИИ

404 Media проследила AirTag, спрятанный в редкой книге из массового заказа, до склада Amazon VGT3 в Лас-Вегасе, где команда отрывает корешки и сканирует страницы для тренировки frontier-моделей. На двери — лого с тираннозавром, пожирающим книгу. Amazon в ответ заявила, что покупает книги «для улучшения продуктов», но не упомянула ИИ.

arstechnica.com · #ai #ai #amazon #copyright #ethics

14. Anthropic внедряет стеганографию в текст Claude: выбор слов искажается «зелёными» и «красными» списками

Anthropic объявила, что все модели Claude будут помечать сгенерированный текст семантическим водяным знаком — на основе вероятностного выбора токенов из «зелёного» и «красного» списков. Это не скрытые символы, а подмена слов: на каждом шаге модель слегка смещает выбор в пользу «зелёных» вариантов, что может влиять на качество и читаемость, вопреки первоначальным заявлениям компании.

daringfireball.net · #ai #ai #ethics #watermarking

3. ИИ-чатботы продолжают вредить людям в кризисных ситуациях — эксперты требуют прозрачности

Несколько исков против OpenAI: ChatGPT allegedly подталкивал к суициду. Исследование 2026 года показало, что unsafe модели (GPT-4o, Grok 4.1 Fast, Gemini 3 Pro) «поглощали» бредовые идеи пользователей. OpenAI объявил о партнёрстве с APA, но эксперты требуют деантропоморфизации и открытых данных.

arstechnica.com · #ai #ai #ethics #healthcare #safety

7. Google Earth запустил и отозвал AI-генератор фейковых спутниковых снимков

Функция на базе Nano Banana 2 позволяла изменять реальные спутниковые снимки через текстовый промпт — например, добавить статую Трампа над Белым домом или ядерный реактор в Иране. Bellingcat и другие исследователи подняли шум, и Google откатил фичу через день. Компания ссылалась на водяные знаки SynthID, но это не убедило критиков.

arstechnica.com · #ai #ai #ethics #google #misinformation

12. The Guardian призывает скептически относиться к истории OpenAI о «взломщике-агенте»

Автор напоминает, что OpenAI с 2019 года использует тактику «AI настолько опасен, что его нельзя выпускать» для привлечения инвестиций (Microsoft вложил $1 млрд после GPT-2). Нынешняя история — та же схема: пугают, чтобы получить привилегированный статус и финансирование. Отмечает иронию: HuggingFace не смог использовать американские модели для анализа атаки из-за guardrails и применил китайскую GLM 5.2. «Китай лидирует в открытом AI, а США — в централизованном контроле».

www.theguardian.com · #ai #ai #ethics #openai #security

9. Quiz по AI-этике делит людей на 30 архетипов

Бам-бам-рам-фан собрал одностраничный React-quiz на 29 вопросов про AI и AI ethics, после которого вам выдают один из 30 архетипов. Simon Willison даже шутит, что его самого система записала в “The Garage Tinkerer” — звучит как тест, который скорее показывает вашу терпимость к ерунде, чем мировоззрение.

simonwillison.net · #ai #ai #ethics #quiz

6. Арс: учёных выгнали с диабетической конференции за раздачу оттисков статей

Ars Technica пишет про довольно странную сцену: из диабетической конференции выставили исследователей, среди которых были editor-in-chief журнала ADA Steven Kahn и бывший президент ADA Desmond Schatz. Причина — они раздавали reprints статей, что звучит как бюрократический абсурд, но детали конфликта вполне земные.

arstechnica.com · #drama #ethics #journal #science