LLM / AI SAFETY

如何让模型能力在复杂系统中保持可控、可解释、可追踪

关注大模型应用中的安全边界、工程基础设施与面向人的责任设计。

靛蓝、紫色与浅蓝色柔和交叠的抽象渐变色域

METHODS

研究方法
是方向变成能力的地方

公开内容会逐步说明我们如何采集信息、建立模型、验证系统,以及哪些问题仍然没有答案。

01安全边界设计
02评测与可观测性
03模型应用基础设施

OUTPUTS

从这个方向已经产生了什么

CONTENT IN PROGRESS相关成果正在整理,首版先保留研究结构和公开边界。

RELATED INSIGHTS

把方向变成可以被阅读的研究记录

CONTENT IN PROGRESS相关技术文章正在整理。