📰 IT Дайджест

← К выпуску 04.08.2026

Claude Fable 5 разгромил GPT-5.6 Sol на бенчмарке переписывания программ — 64% против 20%

habr.com · #ai #anthropic #benchmarks #llm #openai

Epoch AI обновила лидерборд MirrorCode: Claude Fable 5 решил 64% задач, GPT-5.6 Sol — 20%. Разрыв втрое объясняется не разницей в умении, а в надёжности: Fable доводит до конца почти все попытки, а Sol проваливает краевые случаи. Особенно показательно, что Fable почти не теряет в точности на редком языке Ada, что говорит о навыке, а не запоминании тестов.

Открыть оригинал →