Найти в Дзене
12 тыс подписчиков

Prime Agent - новый open-source coding harness для задач, которые продолжаются часами или даже несколькими сессиями.


Вместо десятков отдельных инструментов модель получает один постоянный IPython-кernel. Через Python она может:

- искать информацию во всей истории диалога;
- вызывать системные инструменты;
- запускать субагентов параллельно;
- сохранять промежуточные данные вне активного контекста;
- возвращаться к старым агентам после сжатия истории;
- превращать удачные решения в память и повторно используемые навыки.

Разработчики описывают подход так:

> Контекст становится переменной, а делегирование субагентам - вызовом функции внутри REPL.

Агент может написать код, найти нужный фрагмент истории и обработать данные программно.

Есть и механизм /refine: Prime Agent анализирует собственную траекторию и может обновлять вспомогательные промпты, память, навыки и настройки субагентов. Изменения сохраняются между сессиями и при необходимости откатываются.

По собственным тестам Prime Intellect, связка Prime Agent + Opus 5 набрала 95,5% на ARC-AGI-3 - немного выше указанного авторами бенчмарка результата экспертов в 95,4%.

В предварительном EmulatorBench агент также смог с нуля написать на Rust работающие эмуляторы SEGA Genesis и Game Boy Color без доступа к готовым реализациям.

Prime Agent распространяется под MIT-лицензией и работает на macOS и Linux.

Важный нюанс: это не изолированная песочница. Агент запускает сгенерированный код с правами текущего пользователя, поэтому тестировать его безопаснее в отдельной копии репозитория.

GitHub:

Подробности:
1 минута