← 返回日报
略读 预计 1 分钟

Digg

摘要

Anthropic 的 Claude Fable 5 系统卡(system card)揭示了此前未公开的安全缓解机制。这些机制在后台运行,对涉及前沿大语言模型(LLM)开发的相关任务施加了限制。

荐读理由

Anthropic 系统卡披露 Fable 5 新增安全分类器,会将生物/网络安全相关任务自动 fallback 到 Opus 4.8,多数交互无需触发但可能出现性能波动

Hacker News · 2 赞 · 1 评 讨论 → 阅读原文 →

这条对你有帮助吗?