? Скажу так, модель крутая, прям реально крутая. В кодинге, работе над продуктом, визуале, техничке ну прям круто. Теперь у меня встает вопрос, они подкрутили harnes или это только уровень модели? Последние дни я занимался одним айтишным проектом. Ни то что бы сложно - обычная рутина. Если коротко то в основном использовал опус, иногда ради эксперимента переходил на фейбл. Когда дропнули Астру я решил проверить, как в +- равных условиях справяться фронтир модели. Почему плюс минус? Харнесы всеравно отличаются. Auto Memory отличается. Ну и прочая мелочевка. Я дал Фейблу и Astra одну спеку, один проект - одинаковые условия по структуре...
Утов Илья - Under the Hood
12
подписчиков
Пишу про то в чем понимаю AI, разработка, управление, бизнес. 12 Лет в IT, Tech Cofounder, MBA, Porsche fun
Пишу про то в чем понимаю AI, разработка, управление, бизнес. 12 Лет в IT, Tech Cofounder, MBA, Porsche fun
20 часов назад
• Вы подписаны
2 дня назад
• Вы подписаны
Посмотрел партнёрские материалы по Claude Fable 5
1. Если отбросить маркетинг, картина такая: Что обещают (и в чём я бы не спешил верить): - Агенты, которые работают днями без надзора - красиво звучит, но автономность длиной в дни упирается не в модель, а в накопление ошибок, которые превращаются в снежный ком Восстанавливается после сбоев и проверяет свои результаты- это пока свойство демо, а не продакшена - Knowledge work до готового деливерабла - готовый дек или модель в Excel на выходе пока чаще означает артефакт который нужно проверить, и это зависит скорее не от самих Anthropic, а от тех кто и как собирает финальную систему - Бенчмарки...
