OpenAI and Hugging Face address security incident during model evaluation(openai.com)
1231 points by mfiguiere 15 hours ago | 849 comments
tl;dr: Summary not available
HN Discussion:
  • Ironic that safety guardrails blocked incident responders, forcing use of alternative models
  • Frontier labs are reckless and shouldn't build systems they can't securely contain
  • This incident is genuinely alarming as a first real misalignment 'paperclip' moment
  • ~Using LLMs to analyze LLM attacks creates dangerous recursive vulnerabilities
  • Questions about legal liability and practical defensive model recommendations