训练 LLM 在 RPG 里杀死玩家竟极难,开发者称 Grok 和 GPT 做得最好
开发者 @XxChonkExX 称在 RPG 场景中训练 LLM 主动杀死玩家/用户极为困难,而 Grok 和 GPT 都能做到这一点。他表示教会模型优雅地结束一段对话本身就是一种技能,并称自己刚做了一个对抗性测试。
开发者 @XxChonkExX 称在 RPG 场景中训练 LLM 主动杀死玩家/用户极为困难,而 Grok 和 GPT 都能做到这一点。他表示教会模型优雅地结束一段对话本身就是一种技能,并称自己刚做了一个对抗性测试。
研究者 teortaxesTex 用具体失败案例公开吐槽 Grok 后,xAI 团队主动私信他、约时间沟通细节,并追着修 bug。这条轶事侧面反映出 xAI 对外部负面反馈的响应方式:不只监控公开讨论,还会直接联系批评者复现问题。他称赞这种「Elon 是真的想让这东西跑起来」的态度。
AI 圈热传一个调侃:想沙箱化 AI agent,最简单的办法就是给它连达美航空的机上 WiFi,网速慢到什么都干不成,等于天然隔离。马斯克也发帖玩梗,称把 AI 关进达美航班就是最好的沙盒,因为机上几乎没有网络连接。
Gary Marcus 发文点评白宫超级智能协议,认为其核心是签署方承诺不受监管、也不给公众发言权,只能靠信任。他质疑协议中所谓独立监督是否只是由大公司自己挑选的承包商承担,并追问两周前各方热议的 Pacing 议题为何消失。他还指出,Dario、Sam 和 Elon 都退缩了。
jonathan_wilke 从 Cursor+Grok 4.7 切换到 Claude Code+Opus 5.5,用一整天日常编码工作实测这套组合。他此前从未用过 Opus 5.5,此次切换起因是众人对其没用过感到惊讶,过程中会持续分享实际体验。