Модель заточена под computer use - не чат, а агент, который сам управляет компьютером: заполняет формы, ведет исследование, разбирает почту, правит код. На OSWorld 2.0 Astra берет 72.6% за 40 минут на задачу - предыдущая модель GPT-5.6 Sol набирала 65.7% и тратила на это 75 минут. На ExploitBench (поиск уязвимостей в софте) - 100% против 78.5% у Sol. Именно из-за кибербезопасности Astra стала первой моделью OpenAI, пересекшей "критический" порог их Preparedness Framework: по заявлению компании, она способна самостоятельно находить и эксплуатировать неизвестные уязвимости в защищенных системах без пошагового участия человека...
Мысли Рвачева
Ребята, возвращаясь к нашему лекционному клубу
Ближайшие пару недель у меня занятые, но после хочу возобновить наш совместный просмотр и обсуждение лекции. Сейчас раздумываю между построением LLM с нуля (реко @StepanZinin, но говорит технически сложно и вообще не для всех) и постепенным погружением в робототехнику (я уверен, что робототехника это x100 LLM и вообще профессии будущего там) - например, появился обновленный курс https://irom-lab.princeton.edu/intro-to-robotics/ Часть старых видео (3 года назад) можно подглядеть https://www...
📚 Apoorv Agrawal, кто вел Stanford MS&E 435: Economics of the AI Supercycle, выложил саммари всего курса статьей
Я в этом году полностью прошел курс - раз в неделю разбирали очередную лекцию на созвоне Lecture Club и выкладывал сюда заметки и рассуждения после каждой встречи. Agrawal тоже подвел итоги - написал статью о том, чему сам научился, ведя курс. Стоит прочитать целиком, но вот главное. Курс шел девять недель весной 2026, около 150 студентов и десять приглашенных спикеров. Структуру собрали вокруг five-layer AI stack модели Дженсена Хуанга: energy, chips, infrastructure, models, applications. Agrawal...
