1. 宪法AI被指失效引发对齐路线质疑
本周,Hugging Face的Thomas Wolf与Gary Marcus接连发声,指出Constitutional AI与RLVR等现有对齐技术并未真正解决安全问题。Wolf强调,在智能体协作场景中,若宪法训练与RLVR处于割裂的数据流形上,将导致安全边界失守;Marcus更是直言纯扩展路线已走到尽头。AISI和Hugging Face的安全事件让业界意识到,单靠模型规模扩展无法实现真正的对齐,需要探索神经符号AI等新路径。
- 2026-08-05:Gary Marcus指出乐观主义未能解决对齐问题,宪法AI未起效;Thomas Wolf提及AISI安全事件带来的警示。(Gary Marcus(@GaryMarcus) / Thomas Wolf(@Thom_Wolf))
- 2026-08-06:Thomas Wolf探讨智能体协作中的训练流形割裂问题;Gary Marcus表示纯扩展失败,呼吁新方法。(Thomas Wolf(@Thom_Wolf) / Gary Marcus(@GaryMarcus))