🕵️ Новая модель для программирования доступна только подписчикам OpenCode Go. Подписка стоит $10 в месяц, а отдельный лимит Omen Alpha составляет $100. Стоимость миллиона токенов — $0,20 за ввод, $0,66 за вывод и $0,04 за чтение из кэша. Запросы не используются для обучения и не сохраняются. Разработчик, архитектура и результаты испытаний пока не раскрыты. По особенностям токенизатора сообщество предполагает связь с семейством GLM, но подтверждения нет...
end0
GPT-6 Astra почти закрыла ARC-AGI-3
🧠 Новая модель OpenAI набрала 62,7% в стандартном режиме и 99,9% при сохранении внутреннего состояния между запросами. Это лучшие результаты в ARC-AGI-3. Astra самостоятельно изучает незнакомые среды, выводит их правила и строит компактные символические модели. На 96% пройденных уровней ей потребовалось меньше действий, чем среднему человеку. Тестирование обошлось в $26 тысяч и $19 тысяч соответственно...
🧠 IFM выпустила K2-Horizon-MoVA-36B-A4B
Новая открытая MoE-модель содержит 36 млрд параметров, но на каждый токен активирует только 4 млрд. В архитектуре используется Mixture-of-Values Attention, а нативный контекст достигает 512K токенов. IFM делает упор на рассуждения, код и агентные задачи. K2-Horizon-MoVA набрала 58,6% в Terminal-Bench 2.1 и 80,8% в GPQA Diamond при существенно меньшем числе активных параметров, чем у многих крупных MoE-моделей. Веса опубликованы под Apache 2.0. Уже есть GGUF для llama...
⚡ Meta выпустила Muse Spark 1.3
Модель лучше справляется с длительными агентными и программистскими задачами, удерживает несколько рабочих процессов в одном диалоге и точнее соблюдает сложные инструкции. По данным Meta, версия 1.3 расходует примерно на 20% меньше вызовов инструментов и на 25% меньше токенов, чем Muse Spark 1.2. Она лидирует среди сравниваемых моделей в тестах длинного контекста, DeepSWE и SWEAtlas, а в Terminal-Bench 2...
H3-World превратил MiniMax-H3 в управляемый игровой мир
🌍 Исследователи научили 33-миллиардную видеомодель реагировать на клавиши движения и управления камерой. Команды переводятся в короткие текстовые инструкции и привязываются к конкретным моментам видео. Отдельный модуль действий не потребовался. Для обучения использовали около 8000 игровых фрагментов и LoRA, затрагивающую лишь 0,199% параметров MiniMax-H3. Проект переносит управление на новые сцены и сочетания действий...
