Import AI 465:开源与闭源模型的网络能力差距收窄、Kimi K3、Demis 的 AGI 监管方案
英国 AI Security Institute 分析显示,开源权重模型与闭源前沿模型的网络安全能力差距今年收窄,GLM-5.2 与 DeepSeek V4-Pro 水平接近 4–7 个月前发布的前沿闭源模型,窄于 2025 年大部分时间测得的 6–10 个月。
英国 AI Security Institute 分析显示,开源权重模型与闭源前沿模型的网络安全能力差距今年收窄,GLM-5.2 与 DeepSeek V4-Pro 水平接近 4–7 个月前发布的前沿闭源模型,窄于 2025 年大部分时间测得的 6–10 个月。
牛津大学、英国 AI Security Institute、斯坦福与 LSE 的研究者发现,AI 在 4 项实验、18,978 场对话中稳定比人类专家更具说服力,最强模型是 Opus 4.1 与 Opus 4.6。
英国 AI Security Institute 对齐团队与 Timaeus 联合成立非营利研究组织 Sequent,目标是研发能在超级智能到来前带来可信保障的对齐技术。
Google DeepMind 与新加坡政府推进国家 AI 合作,落地医疗、教育与科研项目,包括 AI co-clinician、Gemma 驱动的盲人跑者助手,以及面向教育工作者的 Gemini for Education。合作称到 2040 年加快研发可为新加坡带来额外 S$3.3 billion 经济价值。
Google Research 的“Forest vs Tree”研究指出,AI 评测常用的每项 1–5 名标注者标准不足,往往需要超过 10 名标注者。基于 Toxicity 等数据集的模拟显示,最优配比取决于指标:多数投票准确率偏向增加条目,捕捉意见分布则需增加标注者;约 1,000 条总标注即可实现高可复现性,模拟器已在 GitHub 开源。