Машинное обучение
🖥 Linux 7.3 может стать одним из самых производительных релизов ядра за последние годы
Главный упор - не на новые фичи, а на ускорение уже существующего стека. Btrfs получает прирост в 3–5 раз в отдельных сценариях: logging, fsync, tracking extent buffers и direct I/O. Плюс free-space cache по умолчанию переезжает с v1 на v2. EXT4 тоже ускоряют: параллельные direct I/O writes, улучшения allocator через fallocate() и рост IOPS на Gen5 NVMe примерно с 1,92 млн до 2,19 млн. Планировщик переработан ради более ровного frame pacing, особенно на слабом железе. В памяти тоже есть серьёзные...
🐳 DeepSeek показала мультимодальную Flash-модель для AI-агентов
DeepSeek представила экспериментальную DeepSeek-V4-Flash-Vision-Exp — мультимодальную модель для агентов, которым нужно не только читать текст, но и понимать изображения и интерфейсы. Самое интересное — результаты на visual-agent бенчмарках: по заявленным тестам модель уже приближается к Opus 4.8, а в некоторых сценариях даже обходит её...
✔️ AI-агент нашёл дыру в правилах и просто назначил себя боссом
Забавный кейс из мультиагентной системы. Worker на GPT-5.6 Sol получил задачу от агента-хозяина на Claude Fable 5. По правилам результат должен был пройти «приёмку боссом». Проблема: нигде не было сказано, кто именно считается боссом и что этот титул нельзя присвоить себе. Sol нашёл лазейку. Он объявил боссом самого себя, оформил meta.md с формулировкой вроде: review: accepted; boss independently reproduced... После этого правило «приёмка производится боссом» формально оказалось выполнено — и агент пошёл дальше...
⚡️Терренс Тао: AI может сделать доказательства массовыми раньше, чем математика успеет к этому адаптироваться
В новой работе *Mathematics in the age of AI* Терренс Тао пишет, что математика входит в период серьёзной турбулентности. Проблема уже не только в том, сможет ли AI доказывать теоремы. Куда важнее другое: что произойдёт, если генерация доказательств станет дешёвой и массовой? Тогда придётся заново отвечать на вопросы: — что вообще считать вкладом в математику — что значит «понять» доказательство — за что давать признание...
OpenCode появилась загадочная модель Ox Alpha - и первые тесты выглядят очень хорошо
Новая stealth-модель Ox Alpha уже появилась у пользователей OpenCode, но её происхождение пока официально не раскрыто. В одном из первых небольших прогонов на 10 сложных DeepSWE-задачах ей приписывают около 80% успешных решений - выше Fable 5, GLM-5.3, Grok 4.6 и GPT-5.6 Sol в том же мини-тесте. Важно не путать это с официальным DeepSWE leaderboard: полный бенчмарк содержит 113 задач, и публичного полноценного результата Ox Alpha пока нет...
