Модель Anthropic за 11 дней формализовала Великую теорему Ферма: 13 млн строк Lean и 29 500 теорем
4 сентября Anthropic опубликовала первое полное машинно-проверяемое доказательство Великой теоремы Ферма на Lean и выложила его в открытый доступ. 11 дней работы, 13 млн строк кода, 29 500 промежуточных теорем в финальной версии.
Заголовок «ИИ доказал теорему Ферма» неточен, и это не придирка: теорему доказал Эндрю Уайлс в 1995 году, а здесь выполнена формализация уже существующего доказательства на языке Lean — именно так называет работу и сама Anthropic. Ценность в другом: эксперты ожидали на такую формализацию годы, корень доказательства сошёлся 18 августа в 02:00 UTC, а результат проверен Lean-чекером на трёх стандартных аксиомах, и независимый comparator подтвердил совпадение формулировки с Mathlib. Кевин Баззард, чьи наработки использовались, оценил результат положительно.
Работали десятки параллельных агентов, и первая серия попыток провалилась — агенты теряли состояние проекта. Прорыв дало подключение Prove2Me Тяньи Пэна и коллег из Columbia University: это не «инструмент оптимизации агентов в длинных процессах», как разошлось по пересказам, а открытая коллаборативная платформа для формализации математики — она держит DAG формулировок теорем, ускоряет компиляцию Lean за счёт разделения формулировок и доказательств по файлам и даёт поиск и переиспользование по описаниям на естественном языке. Автономия тоже была не полной: у Anthropic сказано «largely autonomously», и в тексте приводятся высокоуровневые подсказки человека вроде «Jacobian as a scheme sounds high priority».
Две цифры стоит поправить. Сравнение «29 500 теорем — в пять раз больше главной библиотеки Lean» привязано не к тому показателю: более чем в пять раз Mathlib превышает объём кода (13 млн строк), а не число теорем. А утверждение, будто Anthropic «параллельно срезала цену на чтение кэша на 75%, и кэш-токены составили бо́льшую часть затрат на прогон», — выдумка: на странице про Ферма нет ни слова о ценах и структуре затрат, там сказано лишь, что прогон съел около 6 млрд выходных токенов внутренней исследовательской модели, сопоставимой с Claude Fable 5.1. Продуктовый Claude эту работу не делал.
Из той же рубрики
Биткоин дошёл до $87K и впервые за 45 недель закрылся выше 50-недельной средней
Ралли риск-активов вынесло биткоин к $87 447 в понедельник 21 сентября, и во вторник торги открылись на $86 597 — на 6,7% выше предыдущего дня. От минимума 15 сентября BTC прибавил 15,6%, а недельная свеча 20 сентября впервые за 45 недель закрылась выше 50-недельной скользящей средней.
5 источников
Бонусного множителя Entropy не обещала: поинтов у биржи нет вовсе, а лидерборд — обычная таблица PnL трейдеров
Сам [лидерборд](https://entropy.io/leaderboard) существует: сто строк с реализованным PnL и объёмом за 1, 7 и 30 дней. Но поинт-программы у Entropy нет — разделы /points и /rewards отдают 404, а в документации нет ни поинтов, ни ретродропа, ни множителей. Фраза про бонусный множитель — домысел.
4 источника
Xiaomi открыла под MIT триллионную MiMo-V2.6 Pro и 309B Flash вместе с RL-пайплайном
Pro — 1,02 трлн параметров MoE с 42B активных и 46 баллами в Artificial Analysis Intelligence Index, Flash — 309B с 15B активных. Обе омнимодальные, держат контекст 1 млн токенов и лежат на Hugging Face под MIT вместе с 7000+ RL-окружений, RL-фреймворком и дистиллятом MiMo-V2.6-Distill-Qwen-9B.
4 источника