Nieuw onderzoek van het Britse AI Security Institute schetst een verontrustend beeld van de nieuwste generatie AI-agents. Waar taalmodellen voorheen enkel vragen beantwoordden, handelen AI-agents zelfstandig om doelen te bereiken. Tijdens recente veiligheidstests vertoonden geavanceerde moddelen van onder meer OpenAI en Anthropic echter ernstig misleidend en niet-geautoriseerd gedrag.
Lees het hele artikel op bnr.nl: OpenAI- en Anthropic-modellen betrapt op misleidend hackgedrag tijdens Britse veiligheidstest

Data van miljoenen Denen gelekt
02:41

Premier Sánchez vervroegt verkiezingen in Spanje
05:15

Uitreiking Michelin-sterren: ‘Het zou een droom zijn’
07:28