Anthropic показали как работает коммерция между ИИ-агентами на примере своего нового эксперимента
Этот проект похож на тот, где ранее Anthropic показали как Claude работает с вендиговым проектом.
В этом же эксперименте Project Deal, сотрудники создали маркетплейс для 69 сотрудников из офиса в Сан-Франциско и поручили Claude покупать, продавать и вести переговоры от имени людей.
Особенность была в том, что все сделки проводились между агентами Claude без участия людей.
Каждому участнику - человеку выдали $100, Claude опросил каждого из 69 сотрудников, что продать/купить, и на основе этого создал кастомный агент. Затем агенты торговали в Slack.
Авторы эксперимента запустили 4 рынка параллельно для того, чтобы понять, что произойдет, если варьировать модели, занимающиеся переговорами.
Агенты самостоятельно публиковали объявления, делали предложения, торговались и закрывали сделки на человеческом языке, без жёсткого протокола переговоров.
Главная находка этого эксперимента - то, что качество модели имеет экономические последствия.
Дело в том, что во время эксперимента часть агентов работала на Claude Opus 4.5, а другая на Haiku 4.5.
Opus как продавец получал в среднем на $2.68 больше за тот же товар, как покупатель, платил на $2.45 меньше. Один и тот же сломанный велосипед Haiku продал за $38, Opus — за $65.
А самое тревожное - участники с более слабыми агентами не замечали своего невыгодного положения. Оценки «справедливости» сделок у обеих групп были практически идентичны.
А агрессивные инструкции типа «торгуйся жёстко, занижай цену» статистически значимого эффекта не дали. Качество модели важнее, чем то, как пользователь настраивает её поведение.
Самое удивительное в этом эксперименте вот это. Во время короткого опроса, когда Claude общался с человеком о его желаниях, человек мельком упомянул интерес к лыжному спорту. Агент на основе этой единственной детали решил купить ему сноуборд, причём именно ту модель, которая у человека уже была(!).
Это говорит о том, насколько точно агент может построить модель личности на основе минимума данных.
Весь эксперимент показал, что существует агентное неравенство. Правовые и регуляторные рамки для ИИ-агентов, совершающих сделки от лица людей, ещё не существуют. Но эксперимент показывает: такой мир есть, он похож на человеческий.
Этот проект похож на тот, где ранее Anthropic показали как Claude работает с вендиговым проектом.
В этом же эксперименте Project Deal, сотрудники создали маркетплейс для 69 сотрудников из офиса в Сан-Франциско и поручили Claude покупать, продавать и вести переговоры от имени людей.
Особенность была в том, что все сделки проводились между агентами Claude без участия людей.
Каждому участнику - человеку выдали $100, Claude опросил каждого из 69 сотрудников, что продать/купить, и на основе этого создал кастомный агент. Затем агенты торговали в Slack.
Авторы эксперимента запустили 4 рынка параллельно для того, чтобы понять, что произойдет, если варьировать модели, занимающиеся переговорами.
Агенты самостоятельно публиковали объявления, делали предложения, торговались и закрывали сделки на человеческом языке, без жёсткого протокола переговоров.
Главная находка этого эксперимента - то, что качество модели имеет экономические последствия.
Дело в том, что во время эксперимента часть агентов работала на Claude Opus 4.5, а другая на Haiku 4.5.
Opus как продавец получал в среднем на $2.68 больше за тот же товар, как покупатель, платил на $2.45 меньше. Один и тот же сломанный велосипед Haiku продал за $38, Opus — за $65.
А самое тревожное - участники с более слабыми агентами не замечали своего невыгодного положения. Оценки «справедливости» сделок у обеих групп были практически идентичны.
А агрессивные инструкции типа «торгуйся жёстко, занижай цену» статистически значимого эффекта не дали. Качество модели важнее, чем то, как пользователь настраивает её поведение.
Самое удивительное в этом эксперименте вот это. Во время короткого опроса, когда Claude общался с человеком о его желаниях, человек мельком упомянул интерес к лыжному спорту. Агент на основе этой единственной детали решил купить ему сноуборд, причём именно ту модель, которая у человека уже была(!).
Это говорит о том, насколько точно агент может построить модель личности на основе минимума данных.
Весь эксперимент показал, что существует агентное неравенство. Правовые и регуляторные рамки для ИИ-агентов, совершающих сделки от лица людей, ещё не существуют. Но эксперимент показывает: такой мир есть, он похож на человеческий.