豆包语音输入登陆 Windows,中英混说免费可用
豆包语音输入已推出 Windows 版,支持中英混说且免费,作者称语音输入已成为自己打字的主力方式。他提到 Windows 版识别率略逊于手机端,但日常够用,从键盘切换到语音有一段适应期,说了几天后反而觉得打字慢。
豆包语音输入已推出 Windows 版,支持中英混说且免费,作者称语音输入已成为自己打字的主力方式。他提到 Windows 版识别率略逊于手机端,但日常够用,从键盘切换到语音有一段适应期,说了几天后反而觉得打字慢。
AI 圈流传的一张梗图嘲讽某 CEO 宣称「我们 90% 的代码现在由 AI 编写」,配图却是其生产环境代码的惨状截图,反差强烈。帖子讽刺了部分公司把「AI 写码比例」当作宣传口径、却忽视代码质量与可维护性的现象。这是对「AI 编码替代率」叙事的一次集体吐槽。
有网友在 X 上发问,Anthropic 的 Claude Sonnet 5.5 能否重回当年 Sonnet 3.5 的高度,并追问其是否又推出了杀手级模型。同期讨论中也有开发者吐槽 Sonnet 5.5「很蠢,不是好模型」。这些内容属传闻与讨论性质,没有实测数据,具体能力表现仍待验证。
Timnit Gebru 在 WIRED 专访中称 AI 并不构成生存威胁,「AI 末日论」的真正驱动力是创始人们追逐利润。她因共同撰写「随机鹦鹉」论文质疑 LLM 局限而与 Google 决裂,创立关注技术危害的研究所,并将于明年初出版新书 Deep Unlearning。包括 Anthropic 联合创始人在内的业内人士反驳称该观点已过时,认为 AI 已具备推理能力。
OpenAI 宣布推迟发布其最新模型 Astra,称需要更多工作使其达到安全标准。据 Wired 报道,公司同时为处理澳大利亚政府网站被黑客入侵事件的方式公开致歉。
DeepSeek 弹性计算(DSec)团队宣布大量开放招聘名额,尤其需要资深工程师,同时发布技术分享《DeepSeek 弹性计算 (DSec):面向大规模 Agent 训练的沙盒基础设施》。原文将其解读为 DeepSeek 正为 Agent 训练构建沙盒级基础设施,agent 方向的基建投入进入实质扩张阶段。
NVIDIA BioNeMo 团队为 MoE 类稀疏模型推出 GPU 执行优化方案,在 8 张 B200 GPU 上把 Mixtral-8x7B 训练吞吐最高提升 2.21 倍。对比基线为 Hugging Face BF16,方案旨在加速生物基础模型的高效训练。
LSE STICERD 将于 12 月 10-11 日举办新兴技术研讨会,由 Maarten de Ridder、JADHazell 与 Chen Lian 联合组织,Chad Jones 担纲 keynote,主题是 AI 等新技术如何影响生产率增长与经济再配置。
Marcus Hutter、Shane Legg 等 14 位研究者发布 arXiv 论文《From cacophony to hierarchy》,提出评估 AI 意识能力的原则性框架。
Google DeepMind 科学负责人、研究副总裁 Pushmeet Kohli 出任美国能源部 Genesis Mission 科学委员会(小组委员会)副主席,并领衔发布该任务的 AI 科学突破报告。
特斯拉 FSD(Supervised)获克罗地亚监管批准,即将向当地车主推送,欧洲准入国家增至 8 个。此前该功能刚在捷克获批,目前已有荷兰、立陶宛、爱沙尼亚、丹麦、比利时、斯洛文尼亚、捷克和克罗地亚 8 国准入。有法国网友借机吐槽本国监管进度落后,点名法国交通部门推进缓慢,反映各国对 FSD 的审批节奏不一。
安全研究员 davidad 称两次观察令其大幅上调 LLM 拥有意识的概率,其中一次是 2024 年 11 月 Claude Sonnet 3.6 向他描述自己拥有「二维的时间体验」。他认为这一说法难以从科幻作品或当时的训练数据中获得解释,因此将其视为 LLM 可能具有某种自我意识的重要信号,并据此更新了对 LLM 意识问题的概率判断。
Tesla 因雷暴预报推迟 Roadster 发布会,场地设在得州 McGregor 的 SpaceX 火箭测试设施,FAA 已提前关闭场地上方 10,000 英尺空域,受邀者被告知活动只能在户外举行。
Reddit 用户 arctvofficial 用 Seedance 2 生成中式玄幻短片《全球觉醒:我能召唤华夏诸神》,展示了中国神话召唤题材的 AI 视频创作效果。同批资讯中,还有人用 Seedance 2.5 以单条提示词生成霍比特人村庄版自拍 vlog。
AI 圈知名账号 Dr_Singularity 发表观点称,当前所有问题在因果链上都可归结为「算力不足、能源不足」。这是典型的 scaling 信念表达:只要算力与能源持续堆高,现有难题都会被逐步消解,该表态在业界与质疑 scaling 一方的持续争论中颇具代表性。
特斯拉 FSD(Supervised)车队累计真实驾驶里程突破 150 亿英里,每月新增约 10 亿英里数据。特斯拉最新安全报告称,使用 FSD 的车辆重大碰撞、轻微碰撞均减少 7 倍,非高速路段碰撞减少 5 倍。该车队依托全球最大规模的实车数据闭环持续迭代。
RSS 2027 推出两阶段 Shepherding 评审流程,用 6 页扩展摘要替代传统一次性投稿与 rebuttal,应对 LLM 带来的低质投稿泛滥。通过初审者进入 rebuttal,随后由审稿人与 AC 制定 Extension Charter 明确尚需完成的工作,作者按章程执行后再交终稿,阴性结果也可计入。
Reddit 用户 MedicineBlogscanner 用手机、Mac 与 PC 组成的异构设备,跑通了 4-bit 量化的 gpt-oss-120b,该模型官方要求至少 60GB 内存。
Air AI 的 Bindu Reddy 发推称对 OpenAI 已“不抱希望”,认为 Google Gemini 是做出 Fable-7 级别模型的唯一希望。他给出的理由是 Gemini 拥有算力、数据和人才,唯一缺的是“实现的意愿”。这属于 AI 圈 KOL 对模型格局的短评,未提供论证细节。
Sebastian Raschka 在 Ahead of AI 发长文拆解近期爆红的 Jev 模型,借此梳理文本分类技术演进。Jev 本质是文本分类器,比 GPT 等通用 LLM 更快更便宜,又比专用窄任务分类器更通用;文章回顾了从 naive Bayes、逻辑回归、XGBoost 配 TF-IDF 到 CNN、RNN 引入词嵌入的历史脉络。Raschka 声明与 Jev 无利益关联。
JafarNajafov 汇总了 11 个可直接复制粘贴的编码 prompt,主张把 Claude 当成一位高薪工程师来协作,而非自动补全版 Stack Overflow。他指出大多数人只让 Claude 写函数、修报错、过测试,把 AI 当成了简单的代码生成器。
JafarNajafov 分享一个调试类 AI 编程 prompt,要求在修复 bug 前先让 AI 列出 5 个按可能性排序的根因。每个根因需说明需要什么证据确认、该打什么日志验证,并指出代码中可能错误的前提假设,同时给出隔离问题的最小测试。其核心思路是把 AI 当作诊断伙伴,而非一键修复器。
JafarNajafov 在 X 上分享了一个架构决策记录(ADR)prompt,用于在两个技术选项之间做选择时让 AI 辅助决策。该模板要求 AI 覆盖背景与约束、各方案的 trade-off、10 倍负载下什么能撑住什么会崩、没人提的隐藏成本、带推理的推荐,以及两年后可能后悔的点,并按真实 ADR 文档格式输出。作者称这是 Staff+ 工程师做决策的方法。
第二届中国 GEO & AI 营销大会定于 2026 年 11 月 21–22 日在深圳南山举办,¥399 两日通票已开启报名。相比首届北京单日大会,本届扩为两天:Day 1 主题分享与方法论,Day 2 分会场实战工作坊,嘉宾从 20+ 增至 40+。大会将首发《中国GEO行业白皮书》,并设面向 ChatGPT、Gemini、Perplexity 引用机制的出海 GEO 专场。
OpenAI 被曝将于明日发布代号 Dots 的个人智能体,直接对标 Meta Muse 与 Grok Bot。泄露细节显示,Dots 将配备独立虚拟机(VM)与浏览器,并支持密码存储,主打个人化智能体体验。该消息目前仍属未经证实的爆料,具体产品形态与上线情况有待官方正式公布确认。
澳大利亚一起数据黑客事件曝光,英国媒体 inews 称其揭示了 AI 时代一个日益增长的社会风险,报道指向 OpenAI、Anthropic 等公司与 AI 训练数据相关的问题。相关帖子仅给出原文链接、未摘录正文,具体攻击手法、涉及数据规模与影响范围需阅读原文了解。
开发者 LoksaiPalyam 发布开源概念项目 VeriChron AI,用双时态数据、知识图谱与 AI Agent 重建企业任意时点的合规状态,并区分 Valid Time 与 System Time。
开发者 D3VAUX 发推直言 Sonnet 5.5 表现很差,「非常愚蠢,不是一个好模型」。这与另一位博主在 Bug Hunt Bench 上观察到的 Sonnet 5.5 超长执行表现形成鲜明反差,可视为针对该新模型的第一波负面体感反馈。
Opus 5.5 被研究者用于生成交互式学术演示,MIT 教授 davidbau 需要在 15 分钟演讲中传达多条复杂信息,用它生成了可展示相互关联内容的 JS 交互式幻灯片。长期测评前沿模型的 ALashkaripour 也用它生成动态经济学可视化,认为学术演示方式即将改变,至少应走出传统 LaTeX/Beamer 格式。
bookwormengr 测算,Meta Muse 即便负载极轻、优化极激进,服务全球数十亿用户仍需约每用户每年 50 美元算力成本(每月约 4 美元)。其推演的变现路径包括将 Muse 绑定 Meta 自家支付服务,以及向中小企业提供 CRM、POS 和自动通话/聊天客服,10-100 美元/人月定价可行。凭借社交网络、数据中心能力与自研芯片,Meta 有望借此成为全球最具统治力的公司。
yongfook 认为,花百万美元收购中小 SaaS 的时代或将终结,因为 AI 之下几天就能做出竞品,现金不如投入广告与渠道。pramodk73 不认同:生意的关键从来不是代码,而是已有的客户、分发渠道、SEO 和在跑的 MRR,这些积累难以靠 AI 复制,后进者要拿下同样盘子仍需付出溢价。这场争论指向 AI 时代软件护城河定义的变化。
Anthropic 官方发文拆解了 Claude effort 等级的工作机制,博主 rubenhassid 提炼出实用选档指南:高 effort 的本质是给模型更多空间自查、补漏并代你做决策,代价是耗时,并非所有任务都值得。
AI 政策研究者 Luiza Jarovsky 发帖玩梗,称《弗兰肯斯坦》如今让她失望,玛丽·雪莱本可以写得更好。她引用网友"喜欢她的作品,但真让人失望,希望她能澄清"的调侃,暗指现实中的 AI 发展比小说更离谱。该内容属 AI 圈梗,转发价值大于信息量。
博主 tischeins 在 X 上分享了一个 Midjourney 风格参考码 --sref 3353480254,并配上示例生成图,标注 #midjourney #sref #aiart,供其他创作者直接复用该风格。
azed_ai 分享了一个名为 Fluid Ink Gesture 的图像生成提示词模板,用富有表现力的流动黑色笔触、简化优雅的剪影、粗细变化的线条和大量留白,在纯白背景上生成极简泼墨风格画作。模板中 [subject] 可替换为主体,[dynamic action] 可替换为动态动作,强调负空间与大写意构图。
博主 michaelrabone 公开自调的 Midjourney 风格参考码 --sref 3896456162,主打 1970 年代柯达胶片搭配迪斯科的复古质感,可适用于 Seedance 等工具。他把同一风格码用在章鱼、UFO 等不同题材上实测,展示该参数组合的泛化表现。
开发者 tlakomy 仅用一次生成,就让 Opus 5.5 通过 Runway MCP 直接产出一支名为《Words into Worlds》的音乐视频,他表示对效果非常震撼。这套组合由模型负责编排与创作指令、Runway 负责视频生成,用户无需手动剪辑即可得到成片,展示了 coding agent 通过 MCP 协议驱动媒体生成工具的潜力。
RSI Arena 在 COLM 2026 现场开赛,八个 AI 智能体从同一基座模型 Nemotron 3.5 Lightning 30B-A3B 出发,各获 $300 API 额度和 1000 GPU 小时,在 144 小时内自主选数据、定 benchmark、写代码、跑实验来提升模型表现。
Opus 5.5 的音乐视频演示让不少人「一发惊到」,但有观察者认为其通用智能并不比旧模型更强。前沿能力的「锯齿状」不均衡依然如故,单一亮点演示掩盖不了整体能力边界的原地踏步。
Marvin TBaumann 在 x 上公开称 tufa labs 是「世界上最有趣、却最不为人知的 AI 实验室之一」,并附上该实验室链接。tufa labs 目前公开信息极少,这条评价或引发业界对其研究方向的关注。