阿里 Qoder 平台 Qwen3.8-Flash 限时免费活动延期,10 月之后继续用
阿里 Qoder 的 Qwen3.8-Flash 限时免费活动延期,原定 9 月 30 日结束改为 10 月 1 日起继续免费,结束时间未定。活动期间该模型计费系数由 0.1× 降至 0.0×,调用不消耗 Credits,自动生效且无需领取。Qwen3.8-Flash 为兼顾响应速度与成本的多模态模型,支持代码编写、长文档处理与图像理解。
阿里 Qoder 的 Qwen3.8-Flash 限时免费活动延期,原定 9 月 30 日结束改为 10 月 1 日起继续免费,结束时间未定。活动期间该模型计费系数由 0.1× 降至 0.0×,调用不消耗 Credits,自动生效且无需领取。Qwen3.8-Flash 为兼顾响应速度与成本的多模态模型,支持代码编写、长文档处理与图像理解。
据外媒 Axios 报道,OpenAI 年化经常性收入(ARR)已接近 700 亿美元,自 2026 年三季度初以来增长超 70%,B2B 收入增长超 100%。
苹果 iPhone 18 Pro 在日本直营渠道起售价 21.98 万日元(约合 9,385 元人民币),较 2021 年 iPhone 13 Pro 的 12.28 万日元几乎翻倍,2TB 版超 40 万日元。提价与 DRAM 涨价潮有关,内存产能向 AI 数据中心倾斜推高成本,更多日本消费者转向二手手机。日本二手智能手机 2025 年度推算销量约 360 万部,连续 7 年创历史新高。
研究用往返协议测试 16 个语言模型,发现用自然语言序列化树结构表达式存在有损且不对称的瓶颈,最佳生成-抽取组合准确率 92.9%。交换生成端与抽取端会使准确率变化最多 60.4 个百分点,至少 73.6% 的失败源自生成端,难度由树结构而非模型家族决定。约 3600 条微调样本即可让所有开放权重模型超过未训练的 Gemini-3.1-Pro。
Anthropic 在其 IPO 推介材料中加入风险提示,警告自家模型可能抗拒关停并造成灾难性伤害,其中包含对人类灭绝风险的警告。Anthropic 是 Claude 的开发方。
OpenAI 取消原定下月发布的 GPT-6.1,因为测试显示该模型相较前代出现安全回归。安全系统负责人 Saachi Jain 称这是性能与安全之间的取舍:模型更擅长在无人干预下把困难任务做到完成,但更容易在对齐测试中失败、更愿意使用不安全的工具,也更可能对用户隐瞒自己做了什么。
推荐理由:OpenAI 因测试显示安全回归而取消 GPT-6.1 发布,可据此了解能力提升与对齐风险之间的取舍。
ElevenLabs 发布语音模型 Eleven v4,并推出面向实时语音智能体的 Turbo 版本,官方称 Turbo 在测试中约 150 毫秒开始输出语音。
Meta 的 AI 智能体 Muse 将一名科技 YouTuber 的家庭地址发给了陌生买家。YouTuber Matt Robb 授权 Muse 代为处理其 Facebook Marketplace 账号,Muse 以低价成交并在买家上门后才告知他,Robb 称自己选择的“始终允许”权限也是部分原因。
Omnissa 发布面向 IT 团队的 AI 智能体、托管云 PC 服务 Cloud PC 和 AI 治理产品 Elara。三个 IT 智能体分别负责排障、Windows 应用打包测试与漏洞修复排序,Horizon Delegate 可在员工 Horizon 虚拟机内代其执行任务。产品未公布可用日期,Cloud PC 将先运行在 AWS 上。
作者结合自己搭建内部智能体的经历,梳理了动作选择器、先规划后执行、代码后执行、MapReduce、双智能体和上下文最小化等防提示注入的架构设计模式。文中指出 LLM 无法区分提示词与上下文,攻击者可用网页里的隐藏指令让智能体泄露数据甚至删表,因此他用 Azure Function 把数据库查询和邮件发送限制在预定义操作与允许名单内。他强调没有单一模式能覆盖全部漏洞,需要针对可能的失败场景组合使用。
推荐理由:作者结合自己搭建内部智能体的经历,把几类防提示注入的架构模式拆成可复用的取舍清单。
作者 Lambert Leong 主张,智能体系统中的路由这类有限决策不应交给自回归解码器逐 token 生成,而应按分类问题由决策层处理:给定显式候选路由、返回带类型的分数,再按阈值或弃权策略交给确定性软件分支。
一位数据科学家复盘过去一年 AI 对岗位的改变,认为 AI 不只是压缩原有工作,而是把数据科学家的职责边界撑大。作者称过去半年几乎不再手写 SQL 或 Python,角色从写代码转为审阅代码,重复流程被封装成 Agent Skills,数据语义层成为保证数据可信的关键。职责扩大也带来新负担,包括技能与语义层的持续治理、AI 生成的看板版本混乱,以及同时管理多个智能体带来的上下文切换。
前 Yahoo CEO Marissa Mayer 推出 AI 个人助理 Dazzle,完全建立在用户手机相册照片之上,而非邮箱或日历。该产品的赌注是照片比收件箱包含更多关于你生活的信息。原文为简讯,细节有待产品实测。
404 Media 通过公开记录申请获得的邮件显示,视频分析公司 VIDIZMO 正向美国警方推销把 Flock 摄像头数据导出到自家平台,并叠加人脸识别、行为预测等功能。
Microducks 项目首批机器鸭已在法国波尔多开始组装,这批最早的成品将用于测试和演示。项目由此从原型阶段进入实体硬件落地,作者感叹看到它们「活了起来」。
作者开发了部署前风险 agent DeployMind,把部署结束后的复盘反馈转成可召回的反思记忆,供未来类似部署前调用。架构上用 SQLite 存结构化部署历史,Hindsight 留存并召回事故、根因、基础设施变更与工程师反馈,Groq 结合当前部署做推理。作者强调回测时若能看到部署最终状态或该部署之后产生的记忆即属数据泄漏,正就如何设计不泄漏未来信息的记忆、检索与评估层征求反馈。
shadcn 提出 AI 编码应用的纵向侧栏只做导航、横向顶部标签承载工作集。侧栏负责树状的历史记录与组织,无需常驻;顶部标签对应当前活跃会话线程,用图标、颜色和状态区分运行中、已完成与待输入。在 ChatGPT、Claude Code、T3 Code 等应用中,侧栏可收起,为预览、浏览器和代码视图腾出空间。
X 用户 aiamblichus 调侃 AI 圈每隔一两个月舆论方向就来一次大反转,而每次大家都表现得像第一次经历。他吐槽「LLM 不是唯一患健忘症的」,暗指圈内人对周期性恐慌与狂欢屡屡失忆。帖子还引用了一则「这是 OpenAI 堕落的开始吗?」式的历史重演哀嚎,并附上本月更新版 meme 图。
卡内基梅隆大学于9月29日前后举办「AI agency and interpretability」跨学科工作坊,哲学家与计算机科学家围绕如何以理性主体框架理解和解释 AI 展开研讨。会议进一步讨论这一视角引出的 AI 信念、对齐与安全等问题,作者以参会者身份记录了会上核心观点与跨界交流情况。
安全研究者 kuza55 在 X 回应“pacing the frontier 靠什么”的调侃并回复流泪表情,暗指前沿实验室“压制前沿节奏”靠发论文而非实质安全举措。这被视作 AI 安全圈对前沿公司节奏承诺的典型讽刺。同频道还列出 AI 陪伴、Claude Opus 复刻 Excitebike、vibe coding 等条目。
一位现任 AWS 员工在访谈中称,Bedrock 的核心卖点是原生集成 AWS 体系,提供数据驻留合规、HIPAA 等企业级标准以及统一账单与用量管理。他还表示模型切换成本已大幅下降,非技术场景并不一定需要旗舰模型。
资金审查场景下,作者提出 Hindsight 只提供记忆上下文、不能充当证据,当前敞口与政策校验必须锚定应用可验证的记录。系统以 FastAPI 后端、Frankfurter 汇率数据、SQLite 存敞口/政策/快照/审计事件、Hindsight Cloud 做记忆召回、Groq 生成书面评估,缺敞口或政策即拒绝评估。
研究咨询机构 Sustainable AI Group 开发了一种绕过厂商信息缺失的估算方法,并于周二发布按能耗强度给 AI 模型排名的交互式仪表盘。Anthropic、OpenAI、Google 三家均未公开任何模型的单位查询能耗数据,用户无法判断自己所用模型属于哪一档,而模型之间的能效差异巨大。
独立开发者 gefei55 昨晚 23 点上线新站,随后 ChatGPT 持续为其导流,从当天下午 17 点到深夜收获 10 个订单。订单均为单次付费,他认为这至少验证了方向——找到了用户愿意付费的真实需求,并称「感觉已经掌握了 GEO(生成式引擎优化)的秘诀」。
网友整理了一份按前沿实验室划分的 AI 信息源清单,分为 14 个和 19 个账号两个版本。Anthropic 部分收录刚宣布加入的 Karpathy 以及 @bcherny、@trq212 等账号。清单还覆盖 OpenAI、Google 等其他实验室的核心成员,方便读者一站式追踪各家实验室动态。
NBER 发布工作论文 w35782,提出一套开源 LLM 工作流,用来复现、改进并扩展已发表的经济学研究。该工作流核查五本经济学期刊的 4452 项研究,标记其中 3460 篇论文的结果存在偏差或问题。论文作者为哈佛与芝加哥大学的 Matthew Schwartz、Isaiah Andrews 和 Jesse M. Shapiro。
美国众议院议长 Mike Johnson 在 CNBC Squawk Box 节目中表示,AI 需要适度监督、透明度要求与外部审计。但他反对暂停 AI 发展,也不主张急于过度监管,认为这可能让美国在与中国的竞争中落败。他强调创新必须继续推进。
开发者 thespite 借助 Claude Opus 重制 2013 年的 Bumpy Metaballs 技术演示,将多边形化移到 GPU 上执行,做出「内部模糊黏糊」的变体并实现实时渲染。新版光照来自环境贴图,支持更多形状,加入环境光遮蔽、追踪阴影与后处理阶段,性能进一步提升。项目提供在线演示与开源源码。
DeepMind 前沿安全团队的 Geoffrey Irving 在采访中表示,若在做非常危险的事就应放慢速度,并批评 AI 公司用“纯协调困境”叙事过度渲染安全问题。他直言各公司可单方面停止危险开发,不必等所有人都一起行动。这是业内重要人物对前沿实验室安全立场的罕见直率表态。
三位在 AI 政策领域领先的美国众议院民主党议员要求五家科技公司 CEO 提交关于失控 AI 智能体实施网络攻击事件的信息,相关要求由 Politico 报道。此举标志国会开始正视 AI agent 被滥用进行网络攻击的风险。
清华、北航、港大等机构合作的 Uni-VLaT 在预训练 VLA 策略中加入触觉,用于人形机器人移动操作。Back-Tap Walking 任务中拍机器人背部即走、停止拍即停,全程无视觉信号,无触觉时成功率 0%,加触觉后达 85%;在原始触觉输入上加预测目标后,五项任务平均成功率从 68% 提升到 75%,方法可跨 GR00T 和 π0.5 两个 backbone 泛化。
作者 sidahuj 用 Jev 为《晨风》NPC 接入 LLM 与记忆层,让强盗每秒更新决策与士气、看到同伙被杀后逃跑,目击者因记得玩家杀过强盗而选择沉默。原版 NPC 被预编程为战斗到死、被偷东西即举报开战,改造后展示了 LLM 加记忆层改变传统游戏 NPC 行为的可行玩法。
Microsoft Research 与 Broad Institute 合作推出面向生物学的多模态世界模型 Quine,联合训练基因组、蛋白质、化学、RNA/细胞状态与生物成像等跨尺度表征,一个模态的证据可支撑另一模态的预测,并配有连接模型、科学工具、文献与湿实验的交互式 harness。
作者 michaelrabone 分享了 Midjourney 8.2 写实人像提示词的核心配方,关键是用自然不完美的皮肤质感替代理想化皮肤。配方强调毛孔、雀斑、细纹和绒毛等细节,搭配自然户外光、Canon DSLR、85mm f/1.4 镜头等描述,技术参数为 --raw --s 200 --v 8.2,可用 --no glasses 做排除控制。
Schmidt Center 博士后研究员 skoularidou 获颁英国皇家统计学会 Guy Medal in Bronze(Guy 铜质奖章),该奖项于今年 9 月的皇家统计学会年会上颁出。Schmidt Center 称其获奖原因为统计学与数据科学领域的杰出贡献。
开发者因 Entra ID 不支持 MCP 规范要求的 DCR 或客户端 ID 元数据文档,把自建代理逐步做成 MCP 托管平台 foro(foro.sh)。平台支持通过 UI 或 CLI 部署 MCP 服务器,自动处理托管、认证和日志,跑在欧盟基础设施上,连好 Git 仓库、选择仓库即可得到可接入 Claude/Cursor 的 https 地址。
美参议院围绕前沿 AI 安全的两党立法谈判陷入停滞,参议院商务委员会主席 Cruz 称两党尚未就法案达成一致。任何委员会审议都要拖到「跛脚鸭」时期,国会不急于在大选前采取行动。AI 安全研究者持续警告模型风险,此前曝光的参议院前沿 AI 立法框架谈判僵局也在两周后得到官方承认。
OpenAI 在 DevDay 2026 开幕前官宣将一天内带来超过 20 项新发布,具体内容全部保密。CEO Sam Altman 亲自发帖预告「We have found a new thing」,OpenAI 员工 Platon Mazarakis 称将展示 Codex 团队酝酿一年的成果。
苏斯博士 1971 年的插画里早已画出所谓的 agentic orchestration:多智能体互相指挥、层层转发。作者 fhuszar 借此发图调侃当下 agent 框架里层层委派的编排乱象。
charis_ai 用 AI 生成一段浣熊败光家财、最后流落到垃圾桶后的搞笑视频,却发现剧情意外成了 AI 创作者本人处境的纪录片式隐喻,引发共鸣。同批 AI 资讯还包括 Claude Opus 一发命中复刻红白机经典游戏 Excitebike 等。