Четырнадцать лет назад Гэри Бернхардт сформулировал архитектурный принцип «Functional Core, Imperative Shell» («Функциональное ядро, императивная оболочка»): бизнес-логику держат в чисто функциональном ядре без побочных эффектов и ввода-вывода, а всё взаимодействие с внешним миром, базы данных, сеть, файлы, интерфейс, выносят в оболочку, которая вызывает ядро с готовыми значениями и передаёт результат наружу. Автор разбираемого поста утверждает: то, что на самом деле делает ядро удобным для тестирования,...
ИИтог
В блоге Терренса Тао вышло эссе: продвинутый ИИ создаст больше работы для людей, чем отнимет
На блоге математика Терренса Тао вышел гостевой пост По-Шеня Ло (текст целиком написан им самим; ИИ, Claude Code, использовался только для вёрстки и части заголовков страницы). Автор отвечает на волну открытых писем математиков, встревоженных наступлением ИИ на их профессию: Лейденская декларация собрала более 4000 подписей, «Math and AI», более 7000, письмо против Caltech Mathathon, более 2000. Часть экономистов возражала математикам: Тайлер Коуэн отверг «самые циничные трактовки», но заявил, что...
AMPLE-Math: эталонные решения почти не усиливают self-distillation Qwen3 и SmolLM3
Исследователи задались вопросом: при обучении методом on-policy self-distillation (OPSD, самодистилляция на собственных ответах модели) модель-учитель, замороженная копия самой модели-ученика, может видеть не только вопрос, но и готовый ответ или разобранное решение. Даёт ли эта «привилегированная информация» ученику что-то сверх того, что даёт сама дистилляция как таковая? Чтобы отделить одно от другого, авторы построили AMPLE-Math, многоразовый набор из 5 319 математических задач, для каждой из которых существует шесть вариантов решения (reasoning views), приводящих к одному и тому же ответу...
AMI Labs и World Labs скрывают, на чём заработают на world model
Журналист TechCrunch модерировал панель о world model на конференции All In (не связана с одноимённым подкастом) и решил разобраться, как компании этого сектора планируют зарабатывать. Двое главных игроков, AMI Labs, основанная Яном Лекуном (Yann LeCun), и World Labs Фей-Фей Ли (Fei-Fei Li), собрали много шумихи и денег инвесторов, но по шкале «стараются заработать» стоят низко. По сути, world model, это автоматизация пространственного интеллекта: направление может вести к роботам, интерактивному видео, более сложным системам беспилотного вождения...
Google представила AX, оркестратор для запуска ИИ-агентов в промышленных масштабах
Google представила AX, декларативную систему управления (control plane) для запуска ИИ-агентов в промышленных масштабах. Проект вырос из внутренних исследований агентных runtime-систем в Google, опирается на опыт Google DeepMind и построен поверх собственного вычислительного слоя Google под названием Agent Substrate; по словам авторов, AX добавляет поверх него агентные абстракции и генеративные функции рантайма. Идея в том, что агентные нагрузки, это новый тип вычислений, непохожий ни на микросервисы,...
OmniVBench: бенчмарк и датасет для генерации видео по референсам
Генерация видео по референсам (reference-to-video, R2V) движется к всё более универсальному и гибкому управлению референсами: модель должна учитывать сразу несколько типов образцов, по содержанию, движению, стилю, структуре, сюжету, и правильно их сочетать. Авторы работы отмечают, что существующие бенчмарки для этой задачи отстают: их тестовые наборы охватывают ограниченный набор типов референсов и их сочетаний, а протоколы оценки в основном проверяют общее сходство с референсом целиком, но не смотрят,...
