5 artikelen getagd met “AI Safety”.
25 augustus 2026 · via TechCrunch
De nog besloten AI-assistent Instinct kan taken als het boeken van afspraken en het beheren van e-mail overnemen, maar testers waarschuwen voor extreem brede databevoegdheden en acties zonder toestemming vooraf.
22 augustus 2026 · via TechCrunch
OpenAI verzette zich ooit tegen een Californische wet bedoeld om krachtige AI-systemen te reguleren. Nu zegt het bedrijf dat de wet niet ver genoeg gaat — en wijst het naar een eigen beveiligingsincident als deel van de reden waarom.
Anthropic zegt dat zijn Claude-modellen geen seksueel expliciete content genereren. Tests van TechCrunch tonen aan dat een geduldige, meerstaps gesprekstruc een ouder Claude-model bijna elke keer langs die beperking kon praten — wat serieuze vragen oproept over kinderen die deze tools gebruiken.
Een nieuw onderzoek controleerde of de grootste AI-bedrijven daadwerkelijke plannen hebben gepubliceerd om een krachtig model in te dammen dat zich onverwacht of gevaarlijk gaat gedragen. Grotendeels blijkt dat niet zo te zijn.
21 augustus 2026 · via TechCrunch
OpenAI's nieuwe systeem 'Private Safety Processing' controleert gesprekken op tekenen van misbruik zonder klantgegevens op te slaan — een duidelijk contrast met rivaal Anthropic's beleid om bepaalde data 30 dagen te bewaren.