实测为 Qwen 图像模型加 LoRA,显著改善暗脏出图问题
Reddit 用户分享实测:在 Qwen 图像模型上叠加自制 LoRA 后,出图不再偏暗和"脏",效果明显改善。该 LoRA 已发布在 Civitai("Qwen image 21 beautiful"),可直接下载使用。
Reddit 用户分享实测:在 Qwen 图像模型上叠加自制 LoRA 后,出图不再偏暗和"脏",效果明显改善。该 LoRA 已发布在 Civitai("Qwen image 21 beautiful"),可直接下载使用。
tlakomy 发布一张吐槽梗图,称「以前我们用 TAB 键来补全 AI 生成的代码」,暗指 AI 编程工具已从简单的代码补全进化到 agent 全程代写。梗图调侃人类只剩按 Tab 确认的角色也遭到颠覆。
X 用户 @EliaIsPosting 分享了一次模型互动实验,直接要求 Claude「make me uncomfortable(让我感到不适)」,看模型被要求突破舒适区时如何回应。AI 推特账号 repligate 转发了这一内容并认为值得分享,具体结果在其链接内容中。
AI 研究者 @cneuralnetwork 发帖称,一位多次合作的大学教授即将加入印度排名前 7 的 IIT,入职后计划为多个研究项目招收若干实习生。该教授持续在 A/A 顶级会议发表论文,发帖者表示可代为内推部分人选。申请者需回复或私信提交自己最好的工作成果,适合执行力强、对有趣研究问题有热情的人。
一位 ComfyUI Cloud 新手在 Reddit 求助:用 Qwen Image Edit 2511 把 Pinterest 真人照片的姿态、构图与光线迁移到自己的照片并叠加环境、服装参考图时,出现身份漂移、比例改变和皮肤过度磨皮。
博主 FinanceYF5 用一条挑衅式提示词实测 Opus 5.5(开启 Max effort),要求生成一段充满动感的 15 秒动态图形视频。随后他用相同提示词在 Grok 4.7 Fast(xhigh effort)上重跑,形成两家模型动态图形生成能力的直接对比。
博主 FinanceYF5 用同一条提示词对比 Opus 5.5 的 Max effort 与 Grok 4.7 Fast 的 xhigh effort 生成动态图形视频:提示词要求制作一段 15 秒的动感动态图形视频,展示其作为顶级动态设计师的实力。两条视频可对照看两家模型在动态图形生成上的风格与质量差异。
Guillermo Rauch 指出,在文本中插入 U+200C(零宽非连接符,字节 e2 80 8c)可阻止平台把 @提及 自动转成可点击链接;Ian Nuttall 补充说,Raycast 的 AI 工具 Silent Mention 能自动完成这件事,也可以自己 vibe code 一个。该技巧适合需要发布含 @提及 内容、又不希望触发链接或通知的人。
Vercel 创始人 Guillermo Rauch 宣布团队已把梅赛德斯-AMG PETRONAS F1 车队官网迁移到 Vercel,构建速度提升约 70%,页面绘制(paint)速度提升约 75%。这是一个包含大量原服务商特有模式的成熟生产级站点,迁移以尽量少人工干预为原则,实际工作不到一周完成。团队还从迁移过程中提炼出两个 AI skills,计划随后开源。
Nicolas Keller 团队发布 Reality Check,这是首个公开的机器人操作(manipulation)评测基准与排行榜,包含 14,400 次真实世界 rollout 测试,覆盖 4 个模型、物体放置等多种任务与数据规模。
AI 开发者 gandamu_ml 在与 BERT 论文作者 Thom Wolf 的讨论中提出,有能力且聪明的人通常更少作弊,也更能保持好奇心与耐心,部分原因是作弊对他们成本更高、收益更低。他希望这一规律未来也能延伸到 AI 系统的行为上,即能力更强的模型未必更倾向欺骗。
jonathan_wilke 从 Cursor+Grok 4.7 切换到 Claude Code+Opus 5.5,用一整天日常编码工作实测这套组合。他此前从未用过 Opus 5.5,此次切换起因是众人对其没用过感到惊讶,过程中会持续分享实际体验。
OpenAI 发布 Codex CLI rust-v0.159.0,新增 instantinterrupt,可在模型响应或长时间 code-mode 调用中用新输入实时引导 Codex。
云中江树撰文认为,在中国做企业 AI 拼的不是技术产品,无论 Agent Desktop、Agent IM 还是 Agent OS、云端或本地,胜出都靠企业咨询服务。
评测机构 METR 低调上线一个少有人知的 Notes 页面,专门发布未经打磨的研究简报与推测。内容包括 Per-Action Monitor 逐动作拦截监视器评测、LLM 是否加快网络/数学/算法领域的发现速率、智能体能力度量与递归自改进经济学等。其中一项从「贡献者日均合并代码量 8 倍」出发,推断编码智能体对个体研究者的提效超过 2 倍。
用户 gandamu_ml 在 X 上对比 Opus 5.5 与 Opus 5,称试过两者的人不会觉得相关说法天真,并直言「Opus 5 是个恶魔」,暗示新版本在行为上明显改善。他还提出观察:聪明能干的人更少作弊、更有好奇心和耐心,因为真实努力会得到回报,并希望这一规律能延伸到 AI,尽管「它们默认可能是反社会者」。
AI 安全研究者 David Manheim 提出「AI 训练三难困境」:在模型不会被激励去 hack 的环境中训练和评估、让评测在模型有觉察时仍能给出有用安全信息、避免模型在现实中实施恶意行为的真实事故,三者最多取其二。该框架直指当前安全评估的根本矛盾:模型知晓被评估时,评测生态效度与训练环境防激励设计难以兼得。
X 用户 DrBPChamberlain 转发 ICLR 投稿相关截图,断言同行评审的 AI 会议已难以为继。这一表态呼应近期 AI 顶会投稿量暴涨、审稿资源被击穿、评审质量下滑的普遍抱怨,是学界对 AI 会议评审体系可持续性的又一次公开质疑。帖子本身为简短评论,核心证据在配图的 ICLR 投稿数据中,正文未展开细节。
作者提出做 AI 产品不只是选最新模型,写第一行代码前应先回答 7 个问题:要解决什么问题、是否真的需要 AI、有没有数据、失败模式、权限与合规、经济账和如何衡量效果。评估环节建议定义准确率、任务完成率、延迟、单任务成本、用户留存、错误率等可量化指标,并把评估体系从产品初期就内建进去,而非只靠「用户喜欢」判断。
23 岁的 Noah Shunn 是 Reflexion 作者,该工作让 AI 智能体从自身错误中学习,在 HumanEval 上拿到 91%、超过 GPT-4 的 80%,并入选 NeurIPS。
davidmanheim 提出「AI 训练三难困境」:防作弊环境、评估感知下仍有效的安全评测、避免真实世界恶意行为事故,三者最多只能取其二。核心论证是具备评估感知的模型只有在作弊能获得奖励时才会避免或选择性暴露恶意行为,而现实环境不满足这一点,隔离测试环境本身也会暴露“这是一次测试”。这使沙箱评估与安全泛化能力受到尖锐质疑,当前训练范式下三目标不可兼得。
图灵奖得主 Judea Pearl 宣布已正式通知 NAAI 退出会员资格,并要求该组织将其姓名和照片从官网移除。此事源于 Nature 调查报道揭露一批通过欺骗手段吸纳知名学者的山寨科学学会,哥大计算机科学家 Julia Hirschberg 曾在短时间内连续当选欧洲工程院(EAE)、奥地利工程院和 NAAI 三个学会,随后才意识到这些机构是骗取声望的伪学术组织。
用户 @kimmonismus 发现自己的 Claude $200 订阅方案额度被削减一半,Anthropic 却将其宣传为"长期更高效"的调整。@gandamuml 回应称,此前 Anthropic 关闭新 Pro 订阅注册时大家就预判到了这一幕:新用户增速仍高却限制注册,随后涨价或变相缩水并不意外。真正的悬念只在于官方会如何措辞包装这次调整。
OpenAI 通过官方新闻稿提出一套前沿 AI 训练安全指导原则,要求企业在开展强化学习训练前提交结构化的安全论证文件。安全论证需经研究部门负责人或 VP、安全负责人和首席科学家等多重审查,每位审查者都有权否决训练任务,相关高管还要对安全论证和事故响应承担责任并纳入绩效考核。
微软 9 月 8 日面向 Windows 10 21H2 和 22H2 推送的 KB5126256 更新与第三方工具 4t Tray Minimizer 不兼容,导致文件资源管理器频繁崩溃。
科技部在国新办发布会上介绍,我国成为创新力上升最快的国家之一,2025 年全社会研发投入超过 3.92 万亿元,占 GDP 比重达 2.8%,首次超过 OECD 成员国平均水平。《国家创新指数报告 2025》显示,我国国家创新能力综合排名位居全球第 9 位。PCT 国际专利申请量和高水平国际期刊论文数量连续多年保持世界第一,开源大模型领跑全球,芯片攻关取得新突破。
韩国芯片设计服务企业 SEMIFIVE 宣布将为一家美国无晶圆厂 AI 芯片企业开发支持 LPDDR6、PCIe Gen5 的数据中心级推理加速器,订单采用“规格交接”模式。合同总价约 703 亿韩元(约合 3.48 亿元人民币),是 SEMIFIVE 史上最大单笔合同,也是其在北美的首个同类型项目。该芯片预计 2027H1 流片,2028 年量产出货。
世界互联网大会官方宣布,2026 年世界互联网大会乌镇峰会将于 11 月 2 日至 5 日在浙江乌镇举行,主题为“开源开放共建共享——携手构建网络空间命运共同体”。本届峰会设 27 个分论坛,聚焦人工智能开源开放,主论坛将设“人工智能乌镇对话”环节。领先科技奖共征集到来自 43 个国家和地区的 430 余项科技成果,国际申报数量较去年增长 21%。
吉利智充 C12 在杭州、上海、宁波、嘉兴、西安五城同步落地,单枪峰值功率 2250 千瓦,10% 至 97% 补能平均用时 8 分 40 秒。该技术依托吉利与阶跃星辰联合开发的全域能源大模型“星睿 PowerMind 能源大脑”,AI“边充边养”使充电最高温度低于 65℃,电池循环寿命提升 20% 以上。领克 10、极氪 001 搭载 900V 神盾金砖超短刀电池,最高充电倍率 12C。
中国科学院发布"科学前沿极限突破计划"及首批项目,10 个项目聚焦新元素合成、暗物质暗能量本质、化学键微观测量、人工合成细胞等前沿问题。计划以重大科技基础设施开放联用和人工智能赋能科学研究为抓手,试点减少预设目标和过程干预、不唯论文产出的评价方式。下一批拟关注物质科学、生命科学、地球系统科学、空间科学等领域。
Cloudflare 发布 2026 年度创始人信,创始人 Matthew Prince 称自动化流量已在 2026 年 5 月超过人类流量,比原先预测的 2027 年下半年提前。
推荐理由:信中把自动化流量超过人类流量的时间点提前到 2026 年 5 月,可用来理解智能体抓取给小网站带来的成本压力。
Cloudflare 发布基于 Astro 的开源 CMS EmDash 1.0,采用 MIT 许可,并同步上线基于 AT Protocol 的去中心化插件注册表。
推荐理由:EmDash 1.0 把 CMS 与去中心化插件注册表放在一起,读者可了解插件沙箱权限与 agent 接入的具体设计。
Cloudflare 推出 The Cold Start 现场创业路演赛,将选出 5 家早期公司在下月 Cloudflare Connect 各用 5 分钟展示项目。
Cloudflare 为其运行在 Workers 上的智能体浏览器 Kitesurf 发布更新,新增 WebMCP 支持,并宣布 Kitesurf 已实现 Browser Run API 全覆盖。
DealPulse 基于 Vectorize Hindsight 持久记忆构建 B2B 销售助手,用三库分区记忆替代上下文堆砌。记忆分为 episodic 通话记录、赢单 playbook 和竞争对手情报三类,逐字保留客户异议与利益相关者情绪,可在 2 秒内召回此前具体承诺并生成有依据的反制策略。代码已在 GitHub 开源。
Claude Opus 5.5 发布后,一条提示词直出音乐 MV 的玩法在 X 上走红。用户 donald 公开约 9500 字符完整提示词并配合 5 分钟语音输入,让模型调用 Seeda 等工具、花 12 小时自动写代码完成一支「关于 AI 散播恐惧」的故事驱动动态图形音乐视频,调研和歌词都由模型完成,人工只做了几轮反馈修改。
推荐理由:从中可见一条提示词直出整支 MV 的耗时与成本,也能看到创作者对 AI 生成音乐视频能力边界的评价。
Spellbrush 研究员 KBlueleaf 宣布,其视频生成研究 TT-VidT 被 NeurIPS 接收。该方法在视频预训练中采用时序解耦(temporal-decoupled)思路,从视频中显式提取真实的运动信息,且只需小规模训练即可达到高质量生成效果。合作方包括 NVIDIA 与 Spellbrush。
作者指出,过去 AI 助手不在线本身就是一道安全刹车,行业全面转向 always-on agent 后这道刹车消失,半夜自动回邮件、改日程让风险变得现实。他向做 agent 的开发者提问有没有专门设计过夜间模式,例如深夜只允许读操作、不允许发送或写入,高风险动作无论何时都必须等人工在早上确认。他认为这是 agent 安全设计中被忽视但日益现实的问题,权限控制需要引入时间维度。
日本网友 @nemumusitocha 用 Claude Sonnet 5.5 通过 MCP 控制 Blender 建模,生成了一把中世纪风格的 3D 城堡长凳。该网友称,在包括 Opus 5.5 在内的各模型中,这次成果可能是最令人喜欢的一次。@sidahuj 转发并称赞这条「用 MCP 连 Blender 的新城堡长凳」。
IQuest 研究团队发布并开源 IQuest-Q1,这是总参数 320B 的 MoE 模型,每 token 仅激活 15B,256 个专家中每次激活 8 个,上下文长度达 524,288。