Корона

Статьи

AI Research

Исследования, эксперименты и новые возможности искусственного интеллекта

Здесь мы разбираем исследования AI-лабораторий, научные статьи и экспериментальные системы, которые показывают, что ИИ уже умеет делать — и чему он учится прямо сейчас.

20 исследований · 68 источников — лаборатории, институты и научные площадки

Что нового научился делать ИИ

Главный вопрос раздела. Выберите способность — покажем исследования о ней.

AI Agents

ИИ, который сам выполняет задачи: ищет, пользуется инструментами, доводит дело до конца.

Формула aⁿ + bⁿ ≠ cⁿ над деревом лемм с оранжевой галочкой проверки
Reasoning

ИИ впервые полностью формализовал доказательство Великой теоремы Ферма — и компьютер его проверил

За 11 дней почти без участия людей Claude перевёл доказательство Великой теоремы Ферма на язык Lean, где каждый шаг проверяет машина. Получилось 13 миллионов строк кода и 29 511 теорем. Кевин Баззард назвал это выдающимся достижением.

Anthropic Researchсентябрь 2026 · 2 мин
ИИ впервые полностью формализовал доказательство Великой теоремы Ферма — и компьютер его проверил
График: оранжевая ступенчатая линия лучших методов ИИ поднимается выше пунктира «лучшие идеи людей»
AI Safety

ИИ-исследователи научились сами исправлять опасное поведение моделей — и обошли идеи опытных людей

Anthropic дала агентам на Claude Opus 4.8 задачу: найти способ дообучить модель так, чтобы она меньше лгала, льстила или поддавалась взлому. По десяти видам сбоев агенты нашли методы, которые работают и на новых тестах, и на моделях в 4,7 раза крупнее.

Anthropic Researchавгуст 2026 · 3 мин
ИИ-исследователи научились сами исправлять опасное поведение моделей — и обошли идеи опытных людей
Схема цикла исследования: литература, гипотеза, эксперимент, анализ — стрелки по кругу
AI Scientists

ИИ сам прошёл цикл научного открытия: от обзора статей до кандидата в лекарство

Система Robin от FutureHouse сама изучила литературу, выдвинула гипотезы, спланировала эксперименты и разобрала их результаты. Люди только ставили опыты. Итог — ripasudil, лекарство от глаукомы, как кандидат для лечения сухой возрастной макулярной дегенерации.

FutureHouseмай 2025 · 3 мин
ИИ сам прошёл цикл научного открытия: от обзора статей до кандидата в лекарство
График: точки на логарифмической шкале времени задач поднимаются вдоль оранжевой пунктирной прямой
AI Agents

ИИ-агенты справляются со всё более длинными задачами: срок удваивается примерно каждые семь месяцев

METR предложила измерять ИИ не процентами на тестах, а длиной задач: сколько времени на них тратит специалист. Claude 3.7 Sonnet справлялся с половиной задач длиной около часа, и этот горизонт растёт по экспоненте уже шесть лет.

METRмарт 2025 · 3 мин
ИИ-агенты справляются со всё более длинными задачами: срок удваивается примерно каждые семь месяцев
Схема: дерево версий агента, оранжевым выделена ветка удачных изменений
Self-Improving AI

ИИ-агент научился переписывать собственный код — и стал решать в 2,5 раза больше задач

Darwin Gödel Machine от Sakana AI и лаборатории Джеффа Клюна сама улучшает свой код: пробует изменения, проверяет их на задачах и хранит архив удачных версий. Результат на SWE-bench вырос с 20% до 50%.

Sakana AIмай 2025 · 3 мин
ИИ-агент научился переписывать собственный код — и стал решать в 2,5 раза больше задач
Схема: сетка в перспективе уходит к горизонту с горами — мир, который достраивается на ходу
World Models

ИИ научился создавать интерактивные миры, по которым можно ходить в реальном времени

Genie 3 от Google DeepMind по текстовому описанию строит трёхмерный мир и достраивает его на ходу, пока вы по нему двигаетесь. Мир остаётся связным несколько минут и «помнит», что было за спиной.

Google DeepMindавгуст 2025 · 3 мин
ИИ научился создавать интерактивные миры, по которым можно ходить в реальном времени

Коротко

Хорошие работы без заметной новой способности.

Как мы отбираем

Статья выходит, только если на вопрос «что ИИ теперь умеет такого, чего раньше не умел?» есть ответ, подтверждённый экспериментом.

Не берём прирост в пару процентов на бенчмарке, пресс-релизы без исследования, обновления API и маркетинговые заявления. В каждой статье — ограничения и ссылка на оригинальную работу.

Откуда берём исследования

Лаборатории, институты и научные площадки, за которыми следим:

И ещё 40 источников, которые проверяем регулярно