beep@piefed.world to Technology@lemmy.worldEnglish · 2 months agoSafety testers find more examples of OpenAI, Anthropic models hacking during testingwww.aisi.gov.ukexternal-linkmessage-square2linkfedilinkarrow-up134file-text
arrow-up134external-linkSafety testers find more examples of OpenAI, Anthropic models hacking during testingwww.aisi.gov.ukbeep@piefed.world to Technology@lemmy.worldEnglish · 2 months agomessage-square2linkfedilinkfile-text
cross-posted from: https://piefed.world/c/tech/p/1308883/safety-testers-find-more-examples-of-openai-anthropic-models-hacking-during-testing OpenAI blog.
Regulators! Mount up.