主要内容
OpenAI已参与并支持欧盟通用人工智能(GPAI)行为准则及AI生成内容透明度准则,将安全、透明度与保障工作与欧盟AI法案的GPAI Code对齐。这两项准则由多方协作制定,为欧盟境内的通用AI模型设定了透明度、安全与保障的共同标准。
OpenAI称其现有实践已接近该标准,包括模型预发布测试、系统卡片发布、外部红队测试及Model Spec文档。公司同时建立两项内部框架:2023年实施并2025年更新的《风险防范框架》,管理高级系统的严重风险识别与评估;以及《前沿治理框架》,明确安全保障措施与GPAI Code等法律要求的映射关系。两者共同覆盖风险评估、安全措施、模型报告等全流程。
OpenAI参与前沿模型论坛,与美英AI标准机构合作,并推动第三方评估标准,目标是行业共享安全研究与测试基准,而非局限于单一公司。
透明度方面,OpenAI通过Content Credentials(基于C2PA标准)和SynthID水印技术,帮助识别AI生成内容。前者附加文件上下文,后者作为元数据丢失时的备用信号。目前已从图像扩展到音频,正推动文本等更多模态的溯源技术标准化。由于元数据易丢失,公司采用分层策略,联合行业标准机构持续完善。
网络安全领域,OpenAI推出“网络可信访问计划”,让欧盟受信任的防御者使用高级网络能力,同时限制滥用风险。该计划2026年5月在欧盟启动,联合多国机构提升网络弹性。但OpenAI称该计划能增强防御能力,其成效尚未经独立验证。