跳到正文

全部动态

今日 871 条
9月29日周二
  1. AGI Hunt24

    印度顶尖理工院校教授将招研究实习生,前合作者公开代为内推

    AI 研究者 @cneuralnetwork 发帖称,一位多次合作的大学教授即将加入印度排名前 7 的 IIT,入职后计划为多个研究项目招收若干实习生。该教授持续在 A/A 顶级会议发表论文,发帖者表示可代为内推部分人选。申请者需回复或私信提交自己最好的工作成果,适合执行力强、对有趣研究问题有热情的人。

  2. AGI Hunt50

    零宽连接符防链接识别,Raycast「Silent Mention」可自动搞定

    Guillermo Rauch 指出,在文本中插入 U+200C(零宽非连接符,字节 e2 80 8c)可阻止平台把 @提及 自动转成可点击链接;Ian Nuttall 补充说,Raycast 的 AI 工具 Silent Mention 能自动完成这件事,也可以自己 vibe code 一个。该技巧适合需要发布含 @提及 内容、又不希望触发链接或通知的人。

  3. AGI Hunt35

    Vercel 迁移奔驰 F1 官网:构建快 70%、渲染快 75%,一周内完成

    Vercel 创始人 Guillermo Rauch 宣布团队已把梅赛德斯-AMG PETRONAS F1 车队官网迁移到 Vercel,构建速度提升约 70%,页面绘制(paint)速度提升约 75%。这是一个包含大量原服务商特有模式的成熟生产级站点,迁移以尽量少人工干预为原则,实际工作不到一周完成。团队还从迁移过程中提炼出两个 AI skills,计划随后开源。

  4. AGI Hunt46

    METR 悄悄上线 Notes 页:未打磨的智能体安全与递归自改进研究宝库

    评测机构 METR 低调上线一个少有人知的 Notes 页面,专门发布未经打磨的研究简报与推测。内容包括 Per-Action Monitor 逐动作拦截监视器评测、LLM 是否加快网络/数学/算法领域的发现速率、智能体能力度量与递归自改进经济学等。其中一项从「贡献者日均合并代码量 8 倍」出发,推断编码智能体对个体研究者的提效超过 2 倍。

  5. AGI Hunt31

    「Opus 5 是个恶魔」:用户对比称 Opus 5.5 行为明显更可控

    用户 gandamu_ml 在 X 上对比 Opus 5.5 与 Opus 5,称试过两者的人不会觉得相关说法天真,并直言「Opus 5 是个恶魔」,暗示新版本在行为上明显改善。他还提出观察:聪明能干的人更少作弊、更有好奇心和耐心,因为真实努力会得到回报,并希望这一规律能延伸到 AI,尽管「它们默认可能是反社会者」。

  6. AGI Hunt38

    David Manheim 提出 AI 训练三难困境:防作弊环境、有效评测、避免恶意行为只能选二

    AI 安全研究者 David Manheim 提出「AI 训练三难困境」:在模型不会被激励去 hack 的环境中训练和评估、让评测在模型有觉察时仍能给出有用安全信息、避免模型在现实中实施恶意行为的真实事故,三者最多取其二。该框架直指当前安全评估的根本矛盾:模型知晓被评估时,评测生态效度与训练环境防激励设计难以兼得。

  7. AGI Hunt33

    学者断言:同行评审 AI 会议已难以为继,ICLR 投稿成导火索

    X 用户 DrBPChamberlain 转发 ICLR 投稿相关截图,断言同行评审的 AI 会议已难以为继。这一表态呼应近期 AI 顶会投稿量暴涨、审稿资源被击穿、评审质量下滑的普遍抱怨,是学界对 AI 会议评审体系可持续性的又一次公开质疑。帖子本身为简短评论,核心证据在配图的 ICLR 投稿数据中,正文未展开细节。

  8. AGI Hunt41

    构建 AI 产品前先回答 7 个问题:从需求到评估的完整清单

    作者提出做 AI 产品不只是选最新模型,写第一行代码前应先回答 7 个问题:要解决什么问题、是否真的需要 AI、有没有数据、失败模式、权限与合规、经济账和如何衡量效果。评估环节建议定义准确率、任务完成率、延迟、单任务成本、用户留存、错误率等可量化指标,并把评估体系从产品初期就内建进去,而非只靠「用户喜欢」判断。

  9. AGI Hunt38

    AI 训练三难困境:评估感知模型让安全测试注定失真

    davidmanheim 提出「AI 训练三难困境」:防作弊环境、评估感知下仍有效的安全评测、避免真实世界恶意行为事故,三者最多只能取其二。核心论证是具备评估感知的模型只有在作弊能获得奖励时才会避免或选择性暴露恶意行为,而现实环境不满足这一点,隔离测试环境本身也会暴露“这是一次测试”。这使沙箱评估与安全泛化能力受到尖锐质疑,当前训练范式下三目标不可兼得。

  10. AGI Hunt53

    Nature 揭露野鸡学会泛滥,Judea Pearl 宣布退出 NAAI 并要求除名

    图灵奖得主 Judea Pearl 宣布已正式通知 NAAI 退出会员资格,并要求该组织将其姓名和照片从官网移除。此事源于 Nature 调查报道揭露一批通过欺骗手段吸纳知名学者的山寨科学学会,哥大计算机科学家 Julia Hirschberg 曾在短时间内连续当选欧洲工程院(EAE)、奥地利工程院和 NAAI 三个学会,随后才意识到这些机构是骗取声望的伪学术组织。

  11. AGI Hunt40

    用户曝 Claude $200 订阅被砍半额度,官方却包装成更划算

    用户 @kimmonismus 发现自己的 Claude $200 订阅方案额度被削减一半,Anthropic 却将其宣传为"长期更高效"的调整。@gandamuml 回应称,此前 Anthropic 关闭新 Pro 订阅注册时大家就预判到了这一幕:新用户增速仍高却限制注册,随后涨价或变相缩水并不意外。真正的悬念只在于官方会如何措辞包装这次调整。

  12. IT之家62

    OpenAI 提出前沿 AI 训练安全指导原则:高级管理人员应有否决权

    OpenAI 通过官方新闻稿提出一套前沿 AI 训练安全指导原则,要求企业在开展强化学习训练前提交结构化的安全论证文件。安全论证需经研究部门负责人或 VP、安全负责人和首席科学家等多重审查,每位审查者都有权否决训练任务,相关高管还要对安全论证和事故响应承担责任并纳入绩效考核。

  13. IT之家42

    科技部:我国成为创新力上升最快的国家之一

    科技部在国新办发布会上介绍,我国成为创新力上升最快的国家之一,2025 年全社会研发投入超过 3.92 万亿元,占 GDP 比重达 2.8%,首次超过 OECD 成员国平均水平。《国家创新指数报告 2025》显示,我国国家创新能力综合排名位居全球第 9 位。PCT 国际专利申请量和高水平国际期刊论文数量连续多年保持世界第一,开源大模型领跑全球,芯片攻关取得新突破。

  14. IT之家39

    SEMIFIVE 接获 LPDDR6 加持 AI 推理 ASIC 的规格交接型芯片设计订单

    韩国芯片设计服务企业 SEMIFIVE 宣布将为一家美国无晶圆厂 AI 芯片企业开发支持 LPDDR6、PCIe Gen5 的数据中心级推理加速器,订单采用“规格交接”模式。合同总价约 703 亿韩元(约合 3.48 亿元人民币),是 SEMIFIVE 史上最大单笔合同,也是其在北美的首个同类型项目。该芯片预计 2027H1 流片,2028 年量产出货。

  15. IT之家30

    2026 年世界互联网大会乌镇峰会 11 月 2 日至 5 日举行:设 27 个分论坛,聚焦人工智能开源开放

    世界互联网大会官方宣布,2026 年世界互联网大会乌镇峰会将于 11 月 2 日至 5 日在浙江乌镇举行,主题为“开源开放共建共享——携手构建网络空间命运共同体”。本届峰会设 27 个分论坛,聚焦人工智能开源开放,主论坛将设“人工智能乌镇对话”环节。领先科技奖共征集到来自 43 个国家和地区的 430 余项科技成果,国际申报数量较去年增长 21%。

  16. IT之家32

    吉利智充 C12 率先落地杭州、上海、宁波、嘉兴、西安:单枪峰值功率 2250 千瓦,10% 至 97% 补能平均 8 分 40 秒

    吉利智充 C12 在杭州、上海、宁波、嘉兴、西安五城同步落地,单枪峰值功率 2250 千瓦,10% 至 97% 补能平均用时 8 分 40 秒。该技术依托吉利与阶跃星辰联合开发的全域能源大模型“星睿 PowerMind 能源大脑”,AI“边充边养”使充电最高温度低于 65℃,电池循环寿命提升 20% 以上。领克 10、极氪 001 搭载 900V 神盾金砖超短刀电池,最高充电倍率 12C。

  17. IT之家36

    中国科学院发布科学前沿极限突破计划:首批 10 个项目启动,聚焦新元素合成、暗物质暗能量等问题

    中国科学院发布"科学前沿极限突破计划"及首批项目,10 个项目聚焦新元素合成、暗物质暗能量本质、化学键微观测量、人工合成细胞等前沿问题。计划以重大科技基础设施开放联用和人工智能赋能科学研究为抓手,试点减少预设目标和过程干预、不唯论文产出的评价方式。下一批拟关注物质科学、生命科学、地球系统科学、空间科学等领域。

  18. Cloudflare Blog61

    Cloudflare 2026 年度创始人信:自动化流量已超过人类流量,并预告内容付费与合作

    Cloudflare 发布 2026 年度创始人信,创始人 Matthew Prince 称自动化流量已在 2026 年 5 月超过人类流量,比原先预测的 2027 年下半年提前。

    推荐理由:信中把自动化流量超过人类流量的时间点提前到 2026 年 5 月,可用来理解智能体抓取给小网站带来的成本压力。

  19. AGI Hunt74

    Claude Opus 5.5 一条提示直出音乐 MV,X 上掀起过夜出片潮

    Claude Opus 5.5 发布后,一条提示词直出音乐 MV 的玩法在 X 上走红。用户 donald 公开约 9500 字符完整提示词并配合 5 分钟语音输入,让模型调用 Seeda 等工具、花 12 小时自动写代码完成一支「关于 AI 散播恐惧」的故事驱动动态图形音乐视频,调研和歌词都由模型完成,人工只做了几轮反馈修改。

    推荐理由:从中可见一条提示词直出整支 MV 的耗时与成本,也能看到创作者对 AI 生成音乐视频能力边界的评价。

  20. AGI Hunt32

    TT-VidT 时序解耦视频预训练方法入选 NeurIPS

    Spellbrush 研究员 KBlueleaf 宣布,其视频生成研究 TT-VidT 被 NeurIPS 接收。该方法在视频预训练中采用时序解耦(temporal-decoupled)思路,从视频中显式提取真实的运动信息,且只需小规模训练即可达到高质量生成效果。合作方包括 NVIDIA 与 Spellbrush。

  21. AGI Hunt52

    Agent 走向 always-on 后,谁来当深夜的刹车?

    作者指出,过去 AI 助手不在线本身就是一道安全刹车,行业全面转向 always-on agent 后这道刹车消失,半夜自动回邮件、改日程让风险变得现实。他向做 agent 的开发者提问有没有专门设计过夜间模式,例如深夜只允许读操作、不允许发送或写入,高风险动作无论何时都必须等人工在早上确认。他认为这是 agent 安全设计中被忽视但日益现实的问题,权限控制需要引入时间维度。