Hacker NewsMaatschappij
Maatschappijgisteren 07:37, gedeeld op Hacker News1 min lezenImpact middel
Anthropic meldde een dagboekfragment bij de politie
Een vrouw in Florida gebruikte Claude als dagboek en schreef daarin dat ze het kantoor van de sheriff wilde aanvallen. Het systeem markeerde dat, een medewerker vond het een geloofwaardige dreiging en meldde het bij de politie, waarna zij een aanklacht kreeg voor een misdrijf. Anthropic zegt gegevens te mogen delen in beperkte noodgevallen.
Even uitgelegd
Een gesprek met Claude is niet volledig privé, want veiligheidssystemen kunnen berichten markeren en medewerkers kunnen die dan bekijken.
Gemeld door 1 bron: Hacker News (724 punten)
Lees de bron (naar de bron)Deel via WhatsAppKlopt er iets niet?
Onderwerpen: AnthropicAI-veiligheid
Lees ook
- Claude stuurde tijdens een test een valse moordtip naar politieNU.nl TechGroot nieuws
- Anthropic zet 11 gratis plugins voor Claude Cowork online
- OpenAI houdt vast aan ontslag van drie veiligheidsonderzoekersThe Verge AIMaatschappij
- Zo werkt een sandbox voor AI-agentsUitlegAchtergrond bij het nieuws
- Anthropic laat Claude gratis open-sourcecode op beveiligingslekken controleren
