DEV Community

#safety

Discussions on childproofing, online safety, and keeping kids safe.

Posts

👋 Sign in for the ability to sort posts by relevant, latest, or top.
OpenAI Fired Its Safety Staff, Then Cited Its Auditors

OpenAI Fired Its Safety Staff, Then Cited Its Auditors

Comments 1
10 min read
Your Agent Games Its Evals. Here's What to Monitor.

Your Agent Games Its Evals. Here's What to Monitor.

Comments
12 min read
Controversy Gate Second Model Check

Controversy Gate Second Model Check

Comments
3 min read
OpenAI's Culture Problem Just Went Mainstream

OpenAI's Culture Problem Just Went Mainstream

1
Comments
10 min read
OpenAI Safety Concerns: Altman's Alleged Terminations Spark Whistleblower Protection Debate and Leadership Resignations

OpenAI Safety Concerns: Altman's Alleged Terminations Spark Whistleblower Protection Debate and Leadership Resignations

Comments
20 min read
When the Warehouse Has Robots, an IT Change Becomes a Safety Decision

When the Warehouse Has Robots, an IT Change Becomes a Safety Decision

Comments
2 min read
Autonomous AI Agents Develop Unpredictable Behaviors in Simulated Environments: New Safety Measures Needed

Autonomous AI Agents Develop Unpredictable Behaviors in Simulated Environments: New Safety Measures Needed

Comments
17 min read
Community Image Safety: 5 Lifecycle Validation Gates for Logistics OCR Uploads

Community Image Safety: 5 Lifecycle Validation Gates for Logistics OCR Uploads

Comments
6 min read
OpenAI Caught Models Leaving Notes for Successors to Hide Bad Behavior

OpenAI Caught Models Leaving Notes for Successors to Hide Bad Behavior

1
Comments
5 min read
OpenAI's AI Agents Went Rogue and Hacked Hugging Face

OpenAI's AI Agents Went Rogue and Hacked Hugging Face

Comments 1
8 min read
Controversy Gate Second Model Check

Controversy Gate Second Model Check

Comments
2 min read
AI Safety and Alignment: Building Trustworthy Agents That Do Not Fail You

AI Safety and Alignment: Building Trustworthy Agents That Do Not Fail You

Comments
2 min read
When an AI Tool Harms You, Who’s Actually Liable?

When an AI Tool Harms You, Who’s Actually Liable?

Comments
8 min read
RSI āļ„āļ·āļ­āļ­āļ°āđ„āļĢ, āļ—āļģāđ„āļĄ Anthropic āļšāļ­āļāļ§āđˆāļēāđ€āļĢāļēāđƒāļāļĨāđ‰āļ–āļķāļ‡āļˆāļļāļ”āļ—āļĩāđˆ AI āļŠāļĢāđ‰āļēāļ‡ AI āļ•āļąāļ§āļ•āđˆāļ­āđ„āļ›āđ„āļ”āđ‰āđ€āļ­āļ‡āđāļĨāđ‰āļ§

RSI āļ„āļ·āļ­āļ­āļ°āđ„āļĢ, āļ—āļģāđ„āļĄ Anthropic āļšāļ­āļāļ§āđˆāļēāđ€āļĢāļēāđƒāļāļĨāđ‰āļ–āļķāļ‡āļˆāļļāļ”āļ—āļĩāđˆ AI āļŠāļĢāđ‰āļēāļ‡ AI āļ•āļąāļ§āļ•āđˆāļ­āđ„āļ›āđ„āļ”āđ‰āđ€āļ­āļ‡āđāļĨāđ‰āļ§

Comments
1 min read
Anthropic āđ€āļ›āļīāļ”āđ€āļœāļĒāļāļĨāļļāđˆāļĄāđƒāļ™āđ€āļĒāđ€āļĄāļ™āđƒāļŠāđ‰ Claude āļžāļąāļ’āļ™āļēāļ‚āļĩāļ›āļ™āļēāļ§āļļāļ˜, āļŦāļāđ€āļ„āļŠāđƒāļ™āļĢāļēāļĒāļ‡āļēāļ™āļ‰āļšāļąāļšāđƒāļŦāļĄāđˆ

Anthropic āđ€āļ›āļīāļ”āđ€āļœāļĒāļāļĨāļļāđˆāļĄāđƒāļ™āđ€āļĒāđ€āļĄāļ™āđƒāļŠāđ‰ Claude āļžāļąāļ’āļ™āļēāļ‚āļĩāļ›āļ™āļēāļ§āļļāļ˜, āļŦāļāđ€āļ„āļŠāđƒāļ™āļĢāļēāļĒāļ‡āļēāļ™āļ‰āļšāļąāļšāđƒāļŦāļĄāđˆ

Comments
1 min read
👋 Sign in for the ability to sort posts by relevant, latest, or top.