Блог

Показывать записи на:

Всё течёт, всё опровергается: гипотеза Диница — Гарга — Гёманса

Третья известная гипотеза за две недели покорилась обычным LLM. На этот раз речь о потоках в графах; давайте разберёмся.

Басня о якобиане: The Fable of the Jacobian Conjecture

Ещё одна широко известная открытая математическая проблема покорилась LLM, на этот раз обычному Claude Fable. Дивный новый мир…

“Я-пространство” в языковых моделях: Global Workspace in the J-Space

Новая работа Anthropic по интерпретируемости нашла у LLM глобальное рабочее пространство, совсем как у людей…

Охота на снарка: доказательство гипотезы о двойном покрытии циклами

Ещё одна знаменитая открытая проблема покорилась LLM: GPT 5.6 Sol доказала гипотезу о двойном покрытии циклами. И доказала настолько просто, что мы сейчас во всём разберёмся!

JEPA Яна Лекуна и модели мира: тридцать лет одной идеи

Ян Лекун уже несколько лет выступает против авторегрессивных LLM и считает их тупиком. Что он предлагает вместо этого? Давайте разбираться.

The AI Interviewer: LLM как психолог-исследователь

У нас с коллегами из Института психологии РАН вышла статья про LLM-интервьюеров. Очень кратенько о том, что это за работа.

Recoverable but not stationary: линейные структуры в весах и активациях

Наша с Ириной Пионтковской статья показывает, что линейная структура в обученных сетях реальна — но локальна и всё время движется.

AI 2027 в 2026: нам и правда остался год?

С выхода AI 2027 прошёл год, а тут и Claude Fable вышел. Как мы, близки к сингулярности? Давайте разбираться.

Мотивация в эпоху LLM: что говорит наука об образовании

Когда-то главным дефицитом в образовании был доступ к знаниям, потом — доступ к хорошим объяснениям. Теперь остаётся последний дефицит: собственно желание учиться. Давайте разберёмся, что наука о мотивации нам говорит и правда ли, что AI его убивает (спойлер: нет).

GPT и единичные расстояния: опровержение гипотезы Эрдёша

Свершилось: GPT доказал настоящую новую теорему, причём опроверг важную гипотезу Эрдёша, о которой люди думали долго и хорошо. Давайте разбираться!

Teaching Claude Why: не что, а почему

Исследователи из Anthropic докопались до источника agentic misalignment и даже придумали, как его исправить: современным LLM пора уже выдавать не рыбу, а удочку.

Разреженное префиксное кеширование, или где расставлять чекпойнты в гибридных LLM

У нас с моим аспирантом Михаилом Широких на днях вышел препринт под названием “Sparse Prefix Caching for Hybrid and Recurrent LLM Serving”. Постараюсь популярно рассказать, о чём она, да и вообще дать общее введение в тему.

Музей опиумных войн

Музей опиумных войн сразу показался мне очень перспективным делом. И я не прогадал: действительно очень необычная точка зрения!

Память для LLM-агентов: Милла Йовович и 20/20 hindsight

Яркая свежая новость: Милла Йовович стала вайб-кодером и разработчиком системы памяти для LLM-агентов. Воспользуемся этим поводом, чтобы обсудить память всерьёз…

Вечная математика TurboQuant: как сжать KV-кэш до предела Шеннона

Алгоритм TurboQuant внезапно завирусился и даже слегка обрушил цены на память, хотя на самом деле был опубликован почти год назад. Давайте разберёмся в нём внимательно.