samenvatting
- Anthropic versoepelt zijn veiligheidsbelofte.
- De voorheen strikte ontwikkelingsstop van het bedrijf is vervangen door een belofte van meer transparantie.
- Deze stap zou de veiligheidsnormen in de sector kunnen verlagen.
Anthropic, de maker van de AI-agent Claude (een van de Onze favoriete productiviteitstoolsEen van de belangrijkste kenmerken is de onwrikbare toewijding aan veiligheid. blogpostHet bedrijf heeft zijn beleid voor verantwoorde expansie (Responsible Expansion Policy, RSP) en de wijzigingen in versie 3.0 uiteengezet.
![]()
Snelle links
Wat was het oude veiligheidsbeleid van Anthropic?
Het bedrijf heeft een industriestandaard gezet voor veiligheidsgaranties.
Om de veranderingen die Anthropic doorvoert te begrijpen, moet je het oorspronkelijke Responsible Scaling Policy (RSP) kennen. In 2023 beloofde Anthropic te stoppen met het trainen van AI-modellen als hun mogelijkheden de veiligheidsnormen van het bedrijf zouden overschrijden. Signalen die tot deze stopzetting konden leiden, waren onder andere:
- Modellen die kunnen helpen bij de ontwikkeling of inzet van chemische, biologische of nucleaire wapens.
- Modellen die zichzelf buitensporig kunnen verbeteren.
- Modellen die kunnen helpen bij cyberaanvallen.
- Modellen die zich op bepaalde manieren kunnen gedragen zonder menselijke tussenkomst, zoals "ontsnappen" aan hun omgeving om te voorkomen dat ze worden uitgeschakeld.
Het Responsible Expansion Policy (RSP) legde een strikte limiet op aan deze modellen: Anthropic zou de ontwikkeling stopzetten, zelfs als dat betekende dat concurrenten hen zouden inhalen. Het was een gedurfde stap in een industrie waar iedereen in een razend tempo leek te racen.
Het nieuwe beleid van Anthropic inzake verantwoorde expansie (Responsible Expansion Policy, RSP)
Versie 3.0 versoepelt de regels aanzienlijk.
Anthropic hanteert nog steeds een beleid van verantwoorde expansie, maar met versie 3.0 zal het bedrijf de ontwikkeling alleen stopzetten als het ervan overtuigd is dat het al een aanzienlijke voorsprong op de concurrentie heeft. De bindende belofte om te stoppen is vervangen door een belofte van transparantie over de vraag of het bedrijf zijn veiligheidsdoelen haalt en of het de veiligheid van de concurrentie evenaart of overtreft. Met andere woorden, het heeft in feite een veiligheidsbelofte afgelegd.
Wat was de aanleiding voor deze veranderingen? Anthropic zegt dat de oorspronkelijke veiligheidsbelofte (RSP) niet het gewenste effect had. De RSP was bedoeld als een veiligheidsvoorbeeld voor andere bedrijven. Helaas hebben concurrenten dit signaal niet opgevolgd. Het bedrijf is van mening dat het door zijn eigen inspanningen te beperken, in feite minder veiligheidsbewuste concurrenten de markt laat domineren en het tempo van de ontwikkeling laat bepalen.
Wat betekent dit voor de sector?
Een grote stap achteruit.
Helaas kunnen deze veranderingen een slecht precedent scheppen op het gebied van kunstmatige intelligentie. Anthropic was de gouden standaard voor veiligheidsprocedures, en met deze veranderingen is de lat aanzienlijk lager komen te liggen. Dit zou concurrenten de boodschap kunnen geven dat veiligheid ondergeschikt is aan innovatie. Hoewel dit Claude wellicht kan helpen om Een update over ChatGPTHet lijkt echter nog steeds een stap in de verkeerde richting.
Uiteindelijk, als we de angsten van AI-pessimisten willen wegnemen, is een veiligheidsbelofte van één enkel bedrijf niet voldoende – de hele sector moet zich verenigen en een duidelijke grens trekken. In dit stadium lijkt het steeds onwaarschijnlijker dat dit zal gebeuren.







