研究

总览 可解释性 对齐科学 经济研究

安全

承诺 负责任扩展 信任中心

学习

学院 开发者文档 模型 新闻

公司

关于 招贤纳士 联系我们
试试 共振 登录

一家把"使命不会在压力下第一个被牺牲"写进结构的公司。

我们是一家共益企业。这是法律结构,不是口号:它把设立目的写进章程,并要求我们据此报告—— 放弃使命因此成为一次治理事件,而不是一个安静的决定。

创立
2021 年注册为共益企业。
员工
1,200+ 人研究、工程、政策与运营。
办公室
6 个旧金山、纽约、伦敦、都柏林、苏黎世、东京。
发表
140+ 篇创立以来的论文,可公开的均附代码。
03 — 领导层

谁在负责

本设计研究使用占位姓名与职位。

A. Reyes

首席执行官 · 对发布决定与层级冻结负责

M. Kowalski

对齐科学负责人 · 主持可解释性与监督项目

T. Nakamura

政策负责人 · 扩展政策、政府沟通与信息披露

D. Okafor

工程负责人 · 训练基础设施与评测工具

S. Lindqvist

安全负责人 · 前沿威胁建模与事件响应

P. Bhatt

经济研究负责人 · 暴露指数及其方法论

04 — 历史

我们如何走到今天

2021 年

作为共益企业创立

十一位研究者,一个论题:安全问题由真正在造系统的人决定,所以我们应该去造。

2023 年

第一个公开模型,第一份系统卡

模型随附诚实能力披露的做法自此开始,从未间断。

2024 年

扩展政策,第一版

引入能力层级,写明防护措施,升级路径通向董事会而非发布团队。

2025 年

可用规模的可解释性

特征级分析从演示变成发布门槛,工具链已开源供外部复现。

2026 年

公开事件日志

安全相关事件持续记录,连同修复与时间线,而不是在年报里一笔带过。

06 — 活动

在哪里见到我们

2026 年 10 月

可解释性工作坊

两天上手我们工具链的实操工作坊,与学术伙伴合办,向公司外的申请者开放。

旧金山
2026 年 11 月

扩展政策圆桌

与监管者和独立研究者的闭门讨论:一个可检验的能力阈值,到底长什么样。

布鲁塞尔
2026 年 12 月

开发者日

平台路线图、智能体模式,以及与工程团队的公开问答。会后录像公开。

东京 · 直播
07 — 联系

告诉我们你需要什么,我们负责转达。

销售、媒体、安全披露与研究访问都抵达同一处,由真人回复,通常在两个工作日之内。

  • 部署:请说明用量、区域、合规要求与时间线。
  • 安全:请给最少复现信息,以及你的披露窗口期。
  • 研究:你想验证什么、打算发表什么。

静态演示——不会传输或存储任何数据。