RLHF

AI的'价值观'是怎么来的?——RLHF如何教会AI分辨好坏

引言 你有没有过这样的经历? 第一次用ChatGPT时,你问它一个有点敏感的问题,它礼貌地拒绝了。你换了个方式问,它还是拒绝了。你再换个递进的方式,它依然不为所动。 你可能会想:这AI怎么这么"有原则"? 答案可能会让你 …

📅 2026-08-31 📁 AI深度 👁️ 1 分钟阅读

AI的'家教'——人类反馈如何让AI从'会说'变成'会做'

引言 你有没有这种感觉? 2022年底,你第一次用ChatGPT,它惊为天人——能写诗、能写代码、能聊哲学。但聊多了,你发现它有个毛病:明明不知道的事,它也能煞有介事地编出一段。 你问"爱因斯坦的第三个孩子叫什么",它会 …

📅 2026-08-20 📁 AI深度 👁️ 1 分钟阅读