Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.092 — 2026-10-04
NEWS 约 1 分钟

Anthropic上线透明度中心

Anthropic上线透明度中心,集中公开Claude的能力、安全评测与部署规则。

IMAGE — Anthropic (via Google News)

AI公司说模型“安全”,外界真正想看的往往是:测了什么、结果怎样、上线后又加了哪些限制。10月2日,Anthropic上线Transparency Hub(透明度中心),把Claude各型号的能力边界、安全评测和部署防护集中到一个入口。模型报告可以理解为AI产品说明书;部署防护则是模型上线后的权限、监控、过滤和使用限制。

目前页面以Claude Sonnet 5.5为例,列出训练数据来源、适用政策,并链接完整system card(系统卡,即更详细的模型说明与测试记录)。其中一项政治立场公平性测试覆盖150个议题、1,350对立场相反的请求;Anthropic称,Sonnet 5.5在API和claude.ai上的得分分别为97.9%和99.0%,高于Sonnet 5的86.2%和95.7%。

这次动作的看点不只是多了一个网页。在安全争议与上市审视升温之际,Anthropic正把原本分散的信息整理成更容易查阅和比较的公司披露。不过,这些内容和结果均来自Anthropic自身;安全评测只代表特定测试条件下的表现,并不等于模型已被证明绝对安全。


供稿材料 SOURCES — 1
01
Anthropic’s Transparency Hub Anthropic (via Google News) · NEWS
原文 ↗

← 返回 2026-10-04 · 科技板块