Вчера ночью провел магический ритуал в Кольце Силы, глядя на восход Кроваво Полной Луны. Огонь растопил журналом Нейчур, остальные подробности излишни тут. https://www.nature.com/articles/s41586-022-05172-4 Обнаружение более быстрых алгоритмов умножения матриц обучением с подкреплением Главное Мы фокусируемся на фундаментальной задаче умножения матриц и используем глубокое обучение с подкреплением (DRL) для поиска доказуемо правильных и эффективных алгоритмов умножения матриц. Этот процесс обнаружения алгоритмов особенно поддается автоматизации, поскольку обширное пространство алгоритмов умножения матриц может быть формализовано как низкоранговые разложения определенного трехмерного (3D) тензора, называемого тензором умножения матриц. Это пространство алгоритмов содержит стандартный алгоритм умножения матриц и рекурсивные алгоритмы, такие как алгоритм Штрассена, а также (неизвестный) асимптотически оптимальный алгоритм. +++ Да, это та самая команда из Глубокого Разума, которая побила людей в игре Го, не говоря уже про какие-то там “шахматы”, где вообще все тривиально просто. Да, задача умножения матрицы, где они умудрились чуть “улучшить” человеческие решения, сложнее того же Го на тридцать три порядка. https://www.deepmind.com/blog/discovering-novel-algorithms-with-alphatensor Эта игра невероятно сложна — количество возможных алгоритмов для рассмотрения намного превышает количество атомов во Вселенной, даже для небольших случаев матричного умножения. По сравнению с игрой в го, которая десятилетиями оставалась проблемой для ИИ, количество возможных ходов на каждом шаге нашей игры на 30 порядков больше (выше 10**33 для одной из рассматриваемых нами настроек). Нет, все правильно - именно на тридцать три, и это для совсем простеньких матриц низкой размерности в сравнении с тем, что Автор делал, и между прочим его алгоритмы работали даже в джунглях надежно и точно, ага. Да, они там используют тривиальные приемы теории игр, давно размятые экономистами в полный прах с колоссальным прогрессом, о котором ровным счетом ничего среди всех эти докторов компьютерных дел неизвестно трудами завистников и клеветников. Шума вокруг всего этого - ушам больно. Но до неизвестного (ахахаха) асимптотически оптимального алгоритма очень, очень далеко. ТО ЛИ ЕЩЕ БУДЕТ! ОСТАЛИСЬ НЕ ДНИ! ОСТАЛИСЬ ЧАСЫ!