Мультимодальная модель на 3,1 млрд параметров распознаёт интерфейсы, документы, диаграммы и предметы на изображениях. Она умеет определять координаты объектов и вызывать инструменты по текстовому запросу или картинке. Особенно заметно улучшили работу с интерфейсами: результат в ScreenSpot-v2 вырос с 5,4 до 80,7 балла. В ToolSandbox показатель поднялся с 26,4 до 59,5, а в RefCOCO — с 57,1 до 87,9...
end0
⚡ NVIDIA выпустила Nemotron 3.5 Lightning
Открытая MoE-модель содержит 30 млрд параметров, но при генерации использует только 3 млрд. Она рассчитана на агентов, которые постоянно вызывают инструменты, проверяют результаты и выполняют другие повторяющиеся операции. Гибридная архитектура объединяет Mamba-2, MoE и слои Attention. Контекст достигает 1 млн токенов, доступны версии BF16 и NVFP4, а ускорить генерацию помогают MTP, DFlash и DSpark. В тесте PinchBench модель набрала около 86% и выполнила 10 000 заданий на 30% быстрее Qwen3...
🐧 ChatGPT вышел на Linux
OpenAI выпустила предварительную версию настольного приложения ChatGPT для Linux. В разделе ChatGPT доступны обычный чат и режим Work для работы с файлами, документами, таблицами и браузером. Codex вынесен в отдельный раздел и предназначен для программирования, работы с репозиториями и проверки кода...
🎨 xAI выпустила Grok Imagine Image 2.0
Новая модель стала основой режима Quality в Grok Imagine. Она точнее следует промптам, лучше справляется с композицией, типографикой и мелким текстом, а также сохраняет детали между последовательными генерациями и правками. Появилось точечное редактирование отдельных областей, автоматическое выделение объектов, удаление фона, расширение изображения под другое соотношение сторон и работа сразу с пятью исходными изображениями. По данным Image Arena на 7 августа, Image 2...
🧠 OpenAI обновила GPT-5.6 Sol в ChatGPT
GPT-5.6 Sol стала точнее отвечать на вопросы, лучше подбирать объём ответа и реже перегружать его лишними подробностями и оформлением. В Plus и Pro одна и та же Sol теперь используется как для быстрых ответов, так и для глубокого рассуждения. Появился ползунок глубины рассуждения. Во внутренних тестах OpenAI на финансовых, медицинских и юридических вопросах ответы хотя бы с одной фактической ошибкой у Sol встречались на 68% реже, чем у GPT-5.5 Instant. Бесплатным пользователям и подписчикам Go моделью по умолчанию станет GPT-5...
🧠 Bad Theory Labs выпустила BTL-4 и BTL-4 Compact
BTL-4 — открытая агентная модель на 35 млрд параметров для программирования и работы с инструментами. Разработчики заявляют 78,4% на SWE-bench Verified и почти четырёхкратное ускорение относительно Qwen3.5-35B в их тестах. Главная особенность — BTL-4 Compact. Всю модель ужали в один файл размером 9,96 ГБ — около 2,3 бита на вес. По заявлению Bad Theory Labs, она помещается на видеокарте с 16 ГБ памяти и поддерживает контекст до 262 тысяч токенов...
