На звонке с инвесторами по итогам второго квартала финансовый директор Cloudflare Томас Зайферт сделал новый прогноз о соотношении трафика от людей и от машин в интернете. По его словам, если текущие тенденции сохранятся, через пять лет нечеловеческий (то есть сгенерированный ботами и ИИ-агентами) трафик может быть в 1000 раз больше человеческого, не из-за падения активности людей, а из-за того, насколько быстро растёт трафик от машин. Зайферт сам оговорился, что на каждом этапе прежде ошибался...
ИИтог
Китай начал проверку безопасности продуктов Palo Alto Networks, не объяснив причин
Китайское Управление по делам киберпространства (CAC) начало проверку продуктов американской компании Palo Alto Networks, специализирующейся на кибербезопасности. В официальном объявлении регулятор ограничился общей формулировкой: проверка нужна, чтобы «обеспечить безопасную и стабильную работу критической информационной инфраструктуры, предотвратить киберугрозы и уязвимости и защитить национальную безопасность». Конкретную причину проверки CAC не назвал. Palo Alto Networks в комментарии изданию...
Herdr вошёл в Y Combinator, ядро остаётся open-source
Herdr, терминальный рантайм и текстовый интерфейс (TUI) для управления несколькими ИИ-агентами, которые пишут код в консоли. Проект в одиночку сделал разработчик по имени Can: четыре месяца назад он искал новую работу и параллельно думал о будущем разработки программного обеспечения, пока не понял, что сам стал узким местом в собственной работе с агентами. Он не хотел ставить отдельное приложение под каждого агента и решил построить рантайм, который встраивается в привычную среду, терминал. В Herdr...
ABSeeker: агент на 4B параметров дотянулся до моделей в разы крупнее
Поисковые агенты, которые ищут, проверяют и собирают информацию за несколько шагов, обычно обучают так: вся цепочка действий получает одну общую оценку, успех или провал. Из-за этого модель не может понять, какие именно шаги были полезны, а какие, ошибочными или лишними, даже если итоговый ответ верный или, наоборот, неверный из-за одного неудачного шага. Авторы статьи предлагают метод Answer-Backtracked Credit Assignment (ABC), который превращает эту одну общую оценку в подробную, пошаговую. Работает...
EnvACE: агентов ИИ научили «репетировать мир» вместо обучения на реальной среде
Zishan Xu с соавторами предложили метод обучения ИИ-агентов с подкреплением под названием EnvACE. Обычно для обучения агентов на базе языковых моделей долгим цепочкам вызовов инструментов нужна настоящая или синтетическая исполняемая среда, её построение и проверка дорого стоят, либо внешние симуляторы, которые сложно привязать к реальности. EnvACE заменяет это взаимодействие «репетицией мира»: одна и та же политика (модель) поочерёдно выступает то агентом, то средой. Сначала она генерирует вызов...
