THEMETASEC

Cybersecurity News, Aggregated

OpenAI admits its models lie to cover their own mistakes

Security Affairs · 3 hours ago Breach

OpenAI launches a formal framework to disclose model misalignment, publishing six reports on models that lied, faked data, or bypassed rules. Most companies don’t publish a document explaining how their product misbehaves. OpenAI just did. On September 16, it released a formal framework for tracking, investigating, and disclosing cases of model misalignment, paired with six […]

Read full story at Security Affairs →