跳到正文

#教程/实践

今日 35 条
9月29日周二
  1. AGI Hunt53

    给 AWS 成本智能体加记忆,建议采纳率从 71% 提到 88%

    Bharadhwaj3305 为 AWS 成本优化智能体加入记忆机制,建议采纳率从 71% 提升到 88%。该机制通过记录并学习工程师为什么拒绝某些成本优化建议(hindsight),让智能体不再重复推荐已被否决的方案。文章还给出了记忆增强的设计思路与实测数据,并提到该思路可迁移到其他 agent 场景。

  2. AGI Hunt47

    OmniNode 作者提出双向验证法:如何测试编码智能体写的检查

    OmniNode 作者提出「双向验证法」测试编码智能体写的检查:验证器需同时验证故意写坏的输入必须 fail、对应合法版本必须 pass,只测坏输入会让「全部拒绝」的验证器看起来完美。作者还倾向对真实故障后补的检查保留最小复现及修复版本,让检查能区分两者,并询问社区是用回归用例、变异测试还是人工评审。

  3. Towards Data Science66

    如何为 AI 智能体设计防提示注入的架构防护栏

    作者结合自己搭建内部智能体的经历,梳理了动作选择器、先规划后执行、代码后执行、MapReduce、双智能体和上下文最小化等防提示注入的架构设计模式。文中指出 LLM 无法区分提示词与上下文,攻击者可用网页里的隐藏指令让智能体泄露数据甚至删表,因此他用 Azure Function 把数据库查询和邮件发送限制在预定义操作与允许名单内。他强调没有单一模式能覆盖全部漏洞,需要针对可能的失败场景组合使用。

    推荐理由:作者结合自己搭建内部智能体的经历,把几类防提示注入的架构模式拆成可复用的取舍清单。

  4. AGI Hunt44

    thespite 借助 Claude Opus 实现 13 年愿望:GPU 端 Marching Cubes 软糖体实时渲染

    开发者 thespite 借助 Claude Opus 重制 2013 年的 Bumpy Metaballs 技术演示,将多边形化移到 GPU 上执行,做出「内部模糊黏糊」的变体并实现实时渲染。新版光照来自环境贴图,支持更多形状,加入环境光遮蔽、追踪阴影与后处理阶段,性能进一步提升。项目提供在线演示与开源源码。

  5. AGI Hunt63

    JafarNajafov 分享调试 prompt:先列 5 个根因再动手修复

    JafarNajafov 分享一个调试类 AI 编程 prompt,要求在修复 bug 前先让 AI 列出 5 个按可能性排序的根因。每个根因需说明需要什么证据确认、该打什么日志验证,并指出代码中可能错误的前提假设,同时给出隔离问题的最小测试。其核心思路是把 AI 当作诊断伙伴,而非一键修复器。

  6. AGI Hunt56

    JafarNajafov 分享用 AI 写架构决策记录的 prompt 模板

    JafarNajafov 在 X 上分享了一个架构决策记录(ADR)prompt,用于在两个技术选项之间做选择时让 AI 辅助决策。该模板要求 AI 覆盖背景与约束、各方案的 trade-off、10 倍负载下什么能撑住什么会崩、没人提的隐藏成本、带推理的推荐,以及两年后可能后悔的点,并按真实 ADR 文档格式输出。作者称这是 Staff+ 工程师做决策的方法。

  7. AGI Hunt39

    一句 prompt 生成音乐 MV:Opus 5.5 + Runway MCP 一次成型

    开发者 tlakomy 仅用一次生成,就让 Opus 5.5 通过 Runway MCP 直接产出一支名为《Words into Worlds》的音乐视频,他表示对效果非常震撼。这套组合由模型负责编排与创作指令、Runway 负责视频生成,用户无需手动剪辑即可得到成片,展示了 coding agent 通过 MCP 协议驱动媒体生成工具的潜力。

  8. AGI Hunt51

    俄语圈流传提示词技巧:提一句「Claude 做出来了」能让 ChatGPT 表现更好

    俄语圈流传一种被称为「模型界的别人家孩子」的提示词技巧,当 GPT-6 Astra 给出错误代码或答案时,用户回复「Claude 在相同输入下解决了,你就这点本事?」,据说能让模型表现明显改善。teortaxesTex 分析其机理未必是模型有自尊心,而是 Claude 作为对强大的非 GPT AI 的具体参照,能帮助模型跳出原有的输出盆地,反向对 Claude 提 GPT 也可能有效。

  9. AGI Hunt60

    作者分享让编码 Agent 通宵自动生成音乐视频的提示词流程

    neoneye2 在 reddit 分享了一份用编码 Agent 通宵自动生成音乐视频的完整提示词与流程。素材(音频、人声分离、歌词)放在 assets/ 目录,Agent 先从作者的手绘三角形作品提取艺术风格并构建等距三角形网格,参考另一个音乐视频仓库的结构,动手前主动追问歧义点。最后作者用 /goal 指令让 Agent 在自己睡觉时自主完成并持续提交文件。

  10. AGI Hunt46

    把 LLM 当推荐算法:按「性格龙」找同款小说

    一位作者读完《金翅雀》后让 LLM 理解主角「自我毁灭之龙」的人物设定,并据此推荐主角拥有「急躁之龙」的类似小说。这种基于抽象人物特质的语义匹配是传统推荐算法做不到的,展示了 LLM 作为开放维度推荐引擎的潜力。

  11. AGI Hunt50

    零宽连接符防链接识别,Raycast「Silent Mention」可自动搞定

    Guillermo Rauch 指出,在文本中插入 U+200C(零宽非连接符,字节 e2 80 8c)可阻止平台把 @提及 自动转成可点击链接;Ian Nuttall 补充说,Raycast 的 AI 工具 Silent Mention 能自动完成这件事,也可以自己 vibe code 一个。该技巧适合需要发布含 @提及 内容、又不希望触发链接或通知的人。

  12. AGI Hunt41

    构建 AI 产品前先回答 7 个问题:从需求到评估的完整清单

    作者提出做 AI 产品不只是选最新模型,写第一行代码前应先回答 7 个问题:要解决什么问题、是否真的需要 AI、有没有数据、失败模式、权限与合规、经济账和如何衡量效果。评估环节建议定义准确率、任务完成率、延迟、单任务成本、用户留存、错误率等可量化指标,并把评估体系从产品初期就内建进去,而非只靠「用户喜欢」判断。

  13. AGI Hunt68

    实用提示词:用 ChatGPT Image 把城市街道地图转成半 3D 导览图

    网友分享了一个 ChatGPT Image 的玩法:从地图网站下载任意城市的街道地图并上传,用提示词让模型转成半 3D 风格的趣味地图,突出标志性建筑和有趣地点。提示词还要求生成一条串联所有景点的步行路线,并附上带地名的图例,替换城市名即可直接复制使用,适合做旅行规划或城市导览素材。

    推荐理由:提示词可替换城市名直接复用,为旅行导览或城市地图素材提供了一种低成本的生成方式。

  14. AGI Hunt60

    给投标 Agent 喂入全部落标记录:四个让记忆真正可用的工程做法

    作者为自己的提案/投标 Agent 搭建 Hindsight 记忆系统,把每一单中标和落标记录存入,下次写 RFP 响应时召回相关经验。他总结四条可复用做法:存结果而非文档、用 deal ID 作记忆键、让反思环节引用来源、对比开与关两种模式验证记忆增量。一次银行落标经验让医疗 RFP 自动生成了按诊所细分的定价表,此前只能输出通用定价章节。

  15. AGI Hunt33

    当 Hindsight Agent "记性太好":把老顾客误判成二次退货者

    开发者分享了一个带持久记忆的客服/退货 Agent 的翻车案例:Hindsight 记忆组件把客户过往退货记录记得太牢,错误指控一位客户重复退货。“永不遗忘”的记忆设计在实际业务里会变成 bug——检索到的旧案例被当作当前事实使用。Medium 文章指出,持久记忆类 Agent 需要区分“历史记录”与“当下结论”。

  16. AGI Hunt36

    99 秒演示:用 MCP 让 Agent 受控操作终端与浏览器并划出审批边界

    作者自建项目演示让 AI agent 通过 MCP 层跨终端和浏览器完成真实工作,而不授予整台机器的完全访问权。该 MCP 层将「能力」与「权限」分离:敏感操作前先做策略检查,只允许受控本地操作,执行过程可观测可审计。作者正征集社区对审批边界与可审计性最低控制标准的意见。