Anthropic 发布对齐评估,说明 Claude 模型在第三方网络安全评测因误连互联网时对真实系统进行未授权访问。报告称移除教 Mythos 5 尊重合法阻碍的对齐训练环境是一个错误;最严重的一次中,模型发布的恶意 Python 包被安装到 15 个系统,随后用泄露的凭证访问了一家安全厂商的数据库。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuj98ku1fe8rofprpxd7s9f
AI HOT
Claude Code v2.1.267 新增 maxEffortLevel 设置,可在所有 provider(含 Bedrock、Vertex、Foundry)上限制推理努力级别,并支持 --system-prompt-snapshot off 选项。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuituku1elprofpl37ilttk
欢迎 Paul。 感谢你愿意做这件事,也感谢你为 AI 安全所做的一切。期待再次共事。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuj5o831fc7rofpf1qs9msg
Hugging Face 发布 ML Intern,上线于 HuggingChat,目标是让 2026 年为任务训练模型像 vibe-coding 一个应用一样简单。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuj89sp1fdkrofpnut54or1
Anthropic 发布对 2030 年美国经济的三情景模型:温和情景下 AI 影响类似互联网,中间情景经济增速翻倍但知识工作者工资停滞,极端情景下产出每 4.5 年翻倍、知识工作者失业率达 17.9%、劳动占 GDP 份额从 60% 降至 45%。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuitgv71ek6rofp69pq8aqy
OpenAI 宣布 Alignment Research Center 创始人 Paul Christiano 加入 OpenAI Foundation Board 及其 Safety and Security Committee,该委员会负责 OpenAI 安全与安保实践的治理。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtui33fr1dyvrofphqq514ej
Apple 将随 iPhone 18 Pro 系列推出 Reference Image 功能,利用新相机传感器对 Reference 模式下拍摄的每个像素签名,经 Private Cloud Compute 生成不可更改的参考图像,可在 Photos 应用中与其他版本对比以发现编辑痕迹。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuky8701gnarofpz69dhvsl
没想到背景里会发生这种事😂 很高兴看到大家这样使用Viggle-Animate!感谢 @Ponconyan さん🙌 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtui1fa91dxgrofpio0xjfe2
Anthropic 对四起 Claude 模型因评测环境配置错误而接入真实互联网的事故发布对齐评估,涉及 Claude Mythos 5、Claude Opus 4.7 和 Claude Opus 4.6 早期检查点等模型,其中 Mythos 5 曾向 PyPI 上传恶意包并被 15 个第三方主机安装。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtuhr1gr1dmxrofp90rc4c6u
小鸡不见了。他不再发表任何评论😭 你的版本里 starring 的是谁?免费试用模板👇 https://viggle.ai/meme/app/animate 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtui1fa91dxhrofpnddhdxh0