研究

总览 可解释性 对齐科学 经济研究

安全

承诺 负责任扩展 信任中心

学习

学院 开发者文档 模型 新闻

公司

关于 招贤纳士 联系我们
试试 共振 登录

共益企业 · 创立于 2021 年

前沿 AI,把安全当作设计约束,而不是研究的注脚

我们是少数同时在做这两半工作的实验室:训练前沿模型,同时研究让这些模型值得部署的学科。 缺了任何一半,另一半都没什么用处——这不太舒服,但我们认为是对的。

总部
旧金山——团队分布于纽约、伦敦、都柏林、苏黎世、东京
专注方向
可解释性、对齐,以及前沿模型研发
组织属性
共益企业——使命与股东回报并列
新模型

Cortex 5.1 与 Pulse 5.1

为活得比单轮对话更久的工作准备的两款模型。它们都能跨工具保持状态、从自己的错误中恢复, 并在不确定时如实说明,而不是编造一个终点。

阅读发布公告

最新发布

全部公告
2026 年 9 月 1 日

Cortex 5.1 与 Pulse 5.1

面向长程智能体工作的双模型发布,配套重写的评测套件,覆盖工具滥用与多天任务中的指令漂移。

模型 评测 系统卡
阅读公告
2026 年 7 月 24 日

可解释性:一个注意力头的可用地图

我们追踪了决定模型何时保留答案的单个回路,随后证明可以引导它——而且这种引导在留出任务上同样成立。

可解释性 论文
阅读论文
2026 年 6 月 30 日

负责任扩展政策,第三版

能力阈值现在与必需的防护措施配对,并公布了一旦训练中途越过阈值将如何处理的流程。

政策 安全
阅读政策

AI 应当拓宽人们能做的事——而不是悄悄决定谁有资格去做。

部署

把它带到你的组织面前。

企业计划包含审计日志、SSO、区域锁定与指定的安全联系人。如果你需要确切知道数据在哪里, 我们宁愿在你第二次开口之前,就用书面回答你。