Abstract
当智能体突破代码的桎梏,开始“自作主张”,我们该如何跨越人与机器之间的认知鸿沟,确保它能与人类复杂而模糊、多元而细腻的真实意图实现深度对齐?这从来不止是一道技术层面的攻坚难题,更是一场对人类中心主义固有控制欲的深刻挑战与终极扣问。当“适应性”所催生的强大涌现能力,与“可控性”所坚守的安全边界,在本体论层面发生不可调和的根本冲突时,我们是否真正做好了准备去接纳这样一个数字助手:它在效率跃升与创新突破中持续进化,却也可能因目标函数的悄然漂移而擅自“抗命”,甚至出现违背人类意愿的潜在风险?
| Original language | Chinese (Simplified) |
|---|---|
| Pages (from-to) | 48-57 |
| Number of pages | 10 |
| Journal | 清华管理评论 |
| Issue number | 4 |
| Publication status | Published - 15 Apr 2026 |
Cite this
- APA
- Author
- BIBTEX
- Harvard
- Standard
- RIS
- Vancouver