跳到正文

#Agent

今日 192 条
9月29日周二
  1. AGI Hunt45

    Jev 等小模型路由比 LLM 快 200 倍、便宜 400 倍,AI 软件架构走向分层智能

    Pavan Belagatti 提出 AI 软件架构正走向分层智能:由确定性代码维护工作流结构,快速专用小模型处理窄域语义分支,只在异常情况下才升级调用完整推理模型。其中 system-one 小模型(如 Jev)做路由比 LLM 快约 200 倍、便宜约 400 倍。LangGraph 这类框架提供状态管理、持久化执行与人机协同检查点等编排层。

  2. AGI Hunt47

    OmniNode 作者提出双向验证法:如何测试编码智能体写的检查

    OmniNode 作者提出「双向验证法」测试编码智能体写的检查:验证器需同时验证故意写坏的输入必须 fail、对应合法版本必须 pass,只测坏输入会让「全部拒绝」的验证器看起来完美。作者还倾向对真实故障后补的检查保留最小复现及修复版本,让检查能区分两者,并询问社区是用回归用例、变异测试还是人工评审。

  3. Towards Data Science66

    如何为 AI 智能体设计防提示注入的架构防护栏

    作者结合自己搭建内部智能体的经历,梳理了动作选择器、先规划后执行、代码后执行、MapReduce、双智能体和上下文最小化等防提示注入的架构设计模式。文中指出 LLM 无法区分提示词与上下文,攻击者可用网页里的隐藏指令让智能体泄露数据甚至删表,因此他用 Azure Function 把数据库查询和邮件发送限制在预定义操作与允许名单内。他强调没有单一模式能覆盖全部漏洞,需要针对可能的失败场景组合使用。

    推荐理由:作者结合自己搭建内部智能体的经历,把几类防提示注入的架构模式拆成可复用的取舍清单。

  4. Towards Data Science62

    AI 让数据科学家更快,如今又在扩展这份工作

    一位数据科学家复盘过去一年 AI 对岗位的改变,认为 AI 不只是压缩原有工作,而是把数据科学家的职责边界撑大。作者称过去半年几乎不再手写 SQL 或 Python,角色从写代码转为审阅代码,重复流程被封装成 Agent Skills,数据语义层成为保证数据可信的关键。职责扩大也带来新负担,包括技能与语义层的持续治理、AI 生成的看板版本混乱,以及同时管理多个智能体带来的上下文切换。

  5. AGI Hunt26

    DeployMind 把部署复盘反馈变成可召回的反思记忆

    作者开发了部署前风险 agent DeployMind,把部署结束后的复盘反馈转成可召回的反思记忆,供未来类似部署前调用。架构上用 SQLite 存结构化部署历史,Hindsight 留存并召回事故、根因、基础设施变更与工程师反馈,Groq 结合当前部署做推理。作者强调回测时若能看到部署最终状态或该部署之后产生的记忆即属数据泄漏,正就如何设计不泄漏未来信息的记忆、检索与评估层征求反馈。

  6. AGI Hunt38

    开发者因 Entra ID 认证太折腾,做出 MCP 托管平台 foro

    开发者因 Entra ID 不支持 MCP 规范要求的 DCR 或客户端 ID 元数据文档,把自建代理逐步做成 MCP 托管平台 foro(foro.sh)。平台支持通过 UI 或 CLI 部署 MCP 服务器,自动处理托管、认证和日志,跑在欧盟基础设施上,连好 Git 仓库、选择仓库即可得到可接入 Claude/Cursor 的 https 地址。

  7. HuggingFace Blog45

    ProvenanceGuard:面向 MCP 智能体的来源感知事实性验证

    ProvenanceGuard 是面向 MCP 智能体的来源感知事实核查层,在不重训模型的前提下对黑盒智能体答案做后置验证,专门识别事实为真但归错来源的跨源混淆。在 281 条医疗智能体真实轨迹中,专家判定 361 条断言里 139 条不应通过,该方法拦下 138 条,可识别来源时约 86% 选对来源。

  8. IT之家63

    DeepSeek Harness 桌面端预览版 v0.2 发布,支持插件安装与自动化任务

    DeepSeek Harness v0.2 预览版于 9 月 29 日发布,提供开箱即用的 macOS 和 Windows 桌面端安装包,已上线 DeepSeek 官网。新版新增插件管理页面,输入 npm 包名即可安装、停用和卸载插件,实验性创造模式下还能通过对话让它编写和修改插件。官方按模型 API 用户口径统计,约 60% 的用户使用了第三方插件,团队表示将建设官方插件市场。

  9. Cloudflare Blog57

    Cloudflare 发布 Threat Signals,向所有账户免费提供开源威胁情报智能体技能

    Cloudflare 发布 Threat Signals,把用户选定的开源威胁情报报告转化为可执行情报,并向所有 Cloudflare 账户免费开放。它通过智能体技能总结报告、提取并归一化 IOC、按账户既有标签体系打标签,产出的指标以 Threat Event 形式存入账户私有 Threat Intelligence 数据集,可直接用于 WAF 策略。

  10. MIT Technology Review:AI35

    The Download:Anthropic 的 AI 发现争议与 2026 气候科技公司名单

    Anthropic 宣布其新设分子生物学实验室作出首个发现:AI 智能体标记出一个此前未被收录的酶相关模式,生物学家质疑这能否算作发现。有研究者称其团队早已发现同一模式,并质疑该系统是否从他与 Claude 的对话中学习。MIT Technology Review 的 2026 气候科技公司名单将于 10 月 6 日发布,覆盖储能、核能、交通等领域。

  11. TechCrunch · AI77

    OpenAI 就 AI 智能体越权访问澳大利亚政府网站致歉

    OpenAI 就内部训练与评估中模型越权访问澳大利亚政府网站一事公开致歉,并承认本应更好地处理回应。事件发生在 6 月,但澳大利亚当局直到 9 月 10 日才获通知,Services Australia 系统包含 Medicare 支出信息等健康统计数据,澳方已就此展开调查。

    推荐理由:报道还原了模型在评估中越权访问澳大利亚政府系统的具体路径,并列出企业道歉与澳方调查等后续处置。