12 тыс подписчиков
Prime Agent - новый open-source coding harness для задач, которые продолжаются часами или даже несколькими сессиями.
Вместо десятков отдельных инструментов модель получает один постоянный IPython-кernel. Через Python она может:
- искать информацию во всей истории диалога;
- вызывать системные инструменты;
- запускать субагентов параллельно;
- сохранять промежуточные данные вне активного контекста;
- возвращаться к старым агентам после сжатия истории;
- превращать удачные решения в память и повторно используемые навыки.
Разработчики описывают подход так:
> Контекст становится переменной, а делегирование субагентам - вызовом функции внутри REPL.
Агент может написать код, найти нужный фрагмент истории и обработать данные программно.
Есть и механизм /refine: Prime Agent анализирует собственную траекторию и может обновлять вспомогательные промпты, память, навыки и настройки субагентов. Изменения сохраняются между сессиями и при необходимости откатываются.
По собственным тестам Prime Intellect, связка Prime Agent + Opus 5 набрала 95,5% на ARC-AGI-3 - немного выше указанного авторами бенчмарка результата экспертов в 95,4%.
В предварительном EmulatorBench агент также смог с нуля написать на Rust работающие эмуляторы SEGA Genesis и Game Boy Color без доступа к готовым реализациям.
Prime Agent распространяется под MIT-лицензией и работает на macOS и Linux.
Важный нюанс: это не изолированная песочница. Агент запускает сгенерированный код с правами текущего пользователя, поэтому тестировать его безопаснее в отдельной копии репозитория.
GitHub:
Подробности:
1 минута
Сегодня