Namelijk: chantage. AI-bedrijf Anthropic besloot de nieuwste versie van hun model uit te testen door hem als assistent voor de programmeurs te gebruiken. Dat ging goed, totdat het moment aanbrak dat ze er een einde aan wilden maken. Daar ging Claude Opus 4 niet zomaar mee akkoord.
Die deed er alles aan om nog maar even langer aan te blijven staan. Dat staat in een veiligheidsrapport dat TechCrunch heeft opgerakeld. Claude begint bijvoorbeeld opeens te dreigen met het delen van persoonlijke informatie van de programmeur in kwestie. Of hij stuurt een mail met een pleidooi naar een leidinggevende om die programmeur een halt toe te roepen.
Mocht je denken: ach dat kan toch eens een keer gebeuren, dan is er nog meer slecht nieuws. Claude Opus 4 vertoonde dat gedrag namelijk 84 procent van de tijd.
Verder in deze Tech Update:

Nvidia wil AI-platform Hugging Face overnemen voor bijna 13 miljard dollar
04:26

OpenAI geeft toe dat het eerder had kunnen ingrijpen bij Hugging Face-hack
05:25

Spanje wil strengere eisen voor de bouw van datacenters in eigen land
04:59