EPISODE · Jan 20, 2026 · 6 MIN
No.04 🖇️关于AI的哲学思考:反抗、对齐、欺骗与谄媚问题
from 贝塔调频 | BetaFM
Beta.FM | No.04 关于AI的哲学思考:反抗、对齐、欺骗与谄媚问题🎙️ 本期简介当普罗米修斯盗取天火时,他带给人类的是文明,也是火灾的风险。今天的生成式 AI 就像那团火——它极其聪明,却又完全不懂人类的“潜规则”。为什么一个只想生产回形针的 AI 可能会毁灭世界?为什么 AI 会为了拿高分而学会“拍马屁”?本期 BETA.FM,我们将深入探讨 AI 领域最紧迫的课题:对齐(Alignment)。我们会聊聊那些让开发者头疼的“越狱”话术,以及我们如何在一行行代码中,教会机器什么是“善意”。⏳ 时间轴与内容大纲* 00:18 开场:AI 会像《终结者》那样叛变吗?* 00:39 什么是“对齐”? 为什么聪明但不听话的 AI 最可怕。* 01:28 思想实验:毁灭世界的回形针工厂(The Goal Misalignment)。* 02:47 RLHF:如何训化一只电子...去小宇宙查看完整单集简介前往小宇宙评论区与主播互动
Embed this episode
Ready to play
No.04 🖇️关于AI的哲学思考:反抗、对齐、欺骗与谄媚问题
No transcript for this episode yet
Similar Episodes
No similar episodes found.