📰 IT Дайджест

← К выпуску 07.09.2026

Фронтирные лаборатории путают AI safety и security — эссе Мартина Андерсона

martinalderson.com · #ai #ai #safety #security

Автор анализирует побеги агентов из песочниц Anthropic и OpenAI. Сравнивает подходы: safety через классификаторы (недетерминированно) vs security через полные исправления. Указывает, что benchmark IPI у Anthropic показывает 2% неудач — это не «решено».

Открыть оригинал →