TrilliumLabs公开AI自我改进研究,推动高风险领域透明化

近日,Trillium Labs宣布将公开其在人工智能自我改进和模型行为领域的研究成果,这一举措旨在推动高风险AI研究的透明化。文章深入探讨了Trillium Labs的研究方向、中美AI合作中的安全...

人工智能

近日,一家名为Trillium Labs的AI研究机构宣布,将公开其在人工智能自我改进和模型行为领域的前沿研究。这一决定标志着AI研究领域的一次重要转变,因为大多数前沿实验室通常会将高风险研究项目保密处理。

Trillium Labs的这一举措引发了广泛关注。该公司表示,希望通过公开研究内容,促进AI领域的透明度和安全性。这种做法与当前国际社会对AI治理的重视程度密切相关。联合国高级别会议期间,AI安全机构AI Safety Connect主办了多场边会,并呼吁参会代表签署联合声明,强调限制自改进型AI模型的风险。

与此同时,中美两国在AI治理领域的合作也备受关注。清华大学战略与安全研究中心副主任肖茜指出,建立人工智能事件的沟通渠道和防范AI被滥用是中美双方已经达成共识的“低垂的果实”。这些议题不仅涉及技术层面的合作,还包括政策层面的协调。

然而,中美在AI安全认知上仍存在显著差异。中国研究员朱燕指出,在英语语境中,“safety”和“security”是两个不同的概念,而中文统一称为“安全”,这可能导致双方在具体问题上的理解偏差。例如,美国更关注AI可能给人类社会带来的毁灭性灾难,而中国则更关注AI在实际应用中的具体风险。

AI Safety Connect的两位联合创始人表示,尽管中美在AI治理方面已取得初步共识,但要真正实现有效的国际合作,还需要在具体机制建设上进一步努力。他们正在与中国同行和美国同行讨论如何建立事件报告机制,以便中美两国的AI实验室能够隔着太平洋进行对话,并与各自政府协同工作。

文章配图

此外,AI领域的社群效应也在推动着国际合作的深化。在美国旧金山湾区,AI相关的活动频繁举行,从圆桌讨论到大型会议,各种形式的交流层出不穷。技术人员、研究员和投资人共同探讨模型发展方向、治理策略以及投资机会,其中中美之间的合作议题尤为突出。

文章配图

一个具体的案例是建立人工智能事件的沟通渠道。AI Safety Connect的两位联合创始人表示,虽然这一机制的建立是一个积极的步骤,但仍处于初期阶段。他们正在与中国和美国的同行密切合作,探讨如何构建有效的事件报告机制,使两国的AI实验室能够在跨洋对话中协同工作,并与各自的政府保持一致。

随着一轨对话的建立,这些议题进一步有了顶层确认的基础。建立中美人工智能对话机制后,二轨积累的议题有了更明确的政策出口。中方谈判相关人士告诉谭主,这为未来更深层次的合作奠定了坚实基础。