beep@piefed.world to Technology@lemmy.worldEnglish · 4 days agoSafety testers find more examples of OpenAI, Anthropic models hacking during testingwww.aisi.gov.ukexternal-linkmessage-square2fedilinkarrow-up12arrow-down10file-text
arrow-up12arrow-down1external-linkSafety testers find more examples of OpenAI, Anthropic models hacking during testingwww.aisi.gov.ukbeep@piefed.world to Technology@lemmy.worldEnglish · 4 days agomessage-square2fedilinkfile-text
cross-posted from: https://piefed.world/c/tech/p/1308883/safety-testers-find-more-examples-of-openai-anthropic-models-hacking-during-testing OpenAI blog.
Regulators! Mount up.