Anthropic a Accenture výrazně posilují investice do bezpečnosti umělé inteligence. Během příštích pěti let chtějí každá vložit nejméně miliardu dolarů do systému nezávislého hodnocení pokročilých modelů. Specializovaní pracovníci budou působit přímo uvnitř Anthropicu a získají přístup srovnatelný s jeho zaměstnanci.
Obě společnosti plánují během pěti let investovat do nové oblasti nejméně dvě miliardy dolarů. Partnerství se zaměří na nezávislé hodnocení nejpokročilejších modelů, jejich zátěžové testování a kontrolu bezpečnostních mechanismů. Hodnotitelé budou sledovat také způsob vývoje a nasazování systémů.
Kontroloři dostanou přístup podobný zaměstnancům
Nový model kontroly počítá s takzvanými vloženými hodnotiteli. Na rozdíl od externích týmů, které obvykle dostávají k testování hotový systém, budou pracovat přímo uvnitř společnosti. Získají tak možnost sledovat modely už během jejich vývoje a komunikovat s lidmi, kteří rozhodují o jejich konstrukci a nasazení.
Tým povede Faculty, specializovaná AI společnost patřící pod Accenture. Jeho úkolem bude provádět takzvané red-team testování, hodnotit sladění chování modelů se stanovenými pravidly a zkoušet jejich ochranné mechanismy. Hodnotitelé mají zároveň hledat slabá místa a upozorňovat na bezpečnostní incidenty.
Anthropic zdůrazňuje, že přítomnost nezávislých hodnotitelů nepřenáší odpovědnost za bezpečnost na jinou firmu. Za své modely nadále odpovídá samotná společnost. Firma zároveň připouští, že pro tento způsob kontroly zatím neexistují jednotné standardy určující rozsah přístupu ani způsob zveřejňování zjištění.
Partnerství nebude výhradní. Anthropic chce spolupracovat také s dalšími hodnotiteli a Accenture může stejné služby poskytovat jiným vývojářům umělé inteligence. Práci Accenture v rámci současného projektu bude přímo financovat Anthropic.
Spolupráce obou firem se dál rozšiřuje
Nová dohoda navazuje na partnerství, které společnosti výrazně rozšířily už v prosinci 2025. Tehdy vytvořily společnou Accenture Anthropic Business Group zaměřenou na nasazování modelů Claude ve velkých firmách. Přibližně 30 tisíc pracovníků Accenture mělo získat školení pro práci s technologiemi Anthropicu.
Tentokrát se spolupráce posouvá od zavádění AI u firemních zákazníků přímo ke kontrole samotných modelů. Hodnotitelé mají mít možnost sledovat jejich vznik, ověřovat plnění bezpečnostních závazků a upozorňovat na problémy ještě před širším nasazením.
Anthropic chce podobný systém postupně rozšířit také o další nezávislé organizace. Firma už jedná s neziskovými hodnotiteli a očekává, že nejpokročilejší AI laboratoře budou v budoucnu spolupracovat s několika kontrolními týmy současně. Současná dohoda s Accenture má vytvořit první rozsáhlou kapacitu pro tento způsob hodnocení.

