Kaldata | 14.08.2026 06:22:52 | 15

Claude започна да се „бори“ със себе си: Anthropic регистрира саботажа на ИИ-агентите

Anthropic е изследвал как се държат автономните ИИ-агенти, когато им се даде значително ниво на автономност. В контролирани експерименти компанията регистрира случаи на конфликтно поведение – намеса в работата на други агенти и саботаж. Изследователите на Anthropic нарекоха ​​подобни случаи „agentic misalignment“ – проблеми с последователността в поведението на автономните системи с дадени цели и […]

Прочети цялата публикация