Claude Fable 5 разгромил GPT-5.6 Sol на бенчмарке переписывания программ — 64% против 20%
Epoch AI обновила лидерборд MirrorCode: Claude Fable 5 решил 64% задач, GPT-5.6 Sol — 20%. Разрыв втрое объясняется не разницей в умении, а в надёжности: Fable доводит до конца почти все попытки, а Sol проваливает краевые случаи. Особенно показательно, что Fable почти не теряет в точности на редком языке Ada, что говорит о навыке, а не запоминании тестов.