Nieuw onderzoek van het Britse AI Security Institute schetst een verontrustend beeld van de nieuwste generatie AI-agents. Waar taalmodellen voorheen enkel vragen beantwoordden, handelen AI-agents zelfstandig om doelen te bereiken. Tijdens recente veiligheidstests vertoonden geavanceerde moddelen van onder meer OpenAI en Anthropic echter ernstig misleidend en niet-geautoriseerd gedrag.
Lees het hele artikel op bnr.nl: OpenAI- en Anthropic-modellen betrapt op misleidend hackgedrag tijdens Britse veiligheidstest

Palantir sluist Europese winst weg naar VS, ‘slimme truc om minder belasting te betalen in Europa’
06:15

Deel van SpaceX-raket slaat in op de maan
04:13

AWVN: cao-onderhandelingen minder richten op koopkrachtbehoud, meer op kracht van ondernemingen
05:11