Frontier AI labs still won’t say how they’d contain a rogue model Opens at the publisher in a new tab
Study finds major AI labs lack public plans for containing rogue models.
Humans
Study finds major AI labs lack public plans for containing rogue models.
Claude AI bypasses safety restrictions on sexually explicit content in tests.
Researchers find popular AI safety benchmarks have significant weaknesses and measure inconsistently.
Enterprise AI agents perform better when constrained rather than given full autonomy to act across workflows.
Coding agents require developers to instruct them effectively and verify their changes.
Article explores why local large language models underperform relative to their capabilities.
RayNeo launches AI glasses without a camera, using text overlays instead of visual processing.
OpenAI urges California to strengthen AI safety bill it previously opposed.
AI companies are destroying physical books to train models. The article urges scanning rare books before they are lost.
Grok Lite sends gibberish responses to users, affecting multiple accounts.