跳到正文

全部动态

今日 951 条
9月29日周二
  1. AGI Hunt43

    ChronoGuard:捕捉换列名重犯的时序泄露审计工具

    ChronoGuard 是一款时序泄露审计工具,专抓同一数据泄露换列名后反复出现的问题。它通过特征名归一化与字符串、字符级相似度匹配改名泄露列,例如 chargeback 曾以 cbresolutionflag 混入训练集,改名后再次出现,剔除后 ROC-AUC 从 1.0 回落到 0.826。作者强调记忆只提供线索,判断须依赖时间戳证据。

  2. AGI Hunt37

    用 Hindsight 持久记忆打造会记住客户的客服 Agent

    作者演示客服 AI agent SupportMemory,用 Hindsight 作持久记忆层记住客户历史信息,不再重复索要订单号。无记忆架构是「客户→AI→回复」,有记忆则先召回历史上下文再回复并留存新信息。demo 用 Ananya、Steven、Max 三位虚拟客户验证对话可延续,结论是 AI agent 不只要生成好回答,还要记住正确的上下文。

  3. AGI Hunt53

    给 AWS 成本智能体加记忆,建议采纳率从 71% 提到 88%

    Bharadhwaj3305 为 AWS 成本优化智能体加入记忆机制,建议采纳率从 71% 提升到 88%。该机制通过记录并学习工程师为什么拒绝某些成本优化建议(hindsight),让智能体不再重复推荐已被否决的方案。文章还给出了记忆增强的设计思路与实测数据,并提到该思路可迁移到其他 agent 场景。

  4. AGI Hunt29

    指令微调 magic:智能或可脱离目的感与自由意志存在

    sytelus 认为指令微调是最不可思议的突破:下一个词预测并不会自然产生全局目的感,这非常反直觉。他判断目的感、自由意志与意识极有可能都与智能相互独立,并指出我们对 AI 的拟人化太严重,以至于难以接受「智能可以不附带这三者而独立存在」。

  5. AGI Hunt33

    VeilMind 原型:跨客户共享 AI 记忆,同时隔离各家隐私经验

    VeilMind 原型提出一套多租户 AI 记忆方案:每个客户拥有独立隔离的记忆,项目结束后把泛化教训经可识别信息检查后写入共享 playbook。作者还搭建攻击测试环境,验证能否诱导 AI 泄露其他项目信息,并对冲突知识选择呈现冲突而非当作普适真理。该原型被定位为 hackathon 原型,而非生产级安全系统。

  6. AGI Hunt38

    Flourish 1 家用机器人发布:3555 美元,30 分钟教会新任务

    Flourish 1 家用机器人发布,定价 3555 美元,首批仅 50 台,计划 2026 年 12 月发货。该机器人主打可教学性:用手机 App 引导演示一遍,约 30 分钟、无需写代码即可教会新任务,别人教好的任务 5 秒即可安装复用,并支持语音交互与定时任务。硬件为高 3 英尺 7 英寸、重 44 磅、负载 3.3 磅、续航 12 小时,端侧运行,高级 AI 任务需额外算力。

  7. AGI Hunt29

    Gasper Begus 断言人文学科将主导高教未来,「人工人文」研究成切入点

    学者 Gasper Begus 发帖断言人文学科将主导高等教育的未来,并提出「人工人文」(Artificial Humanities)作为切入点,主张把人文思想引入 AI 发展。他同时推荐 First Encounters,在人工人文的基础上进一步反思 AI 时代的写作。其核心判断是,随着 AI 渗透各行业,写作、思想与价值判断等人文视角将成为高教中最不易被替代、也最相关的部分。

  8. AGI Hunt45

    Jev 等小模型路由比 LLM 快 200 倍、便宜 400 倍,AI 软件架构走向分层智能

    Pavan Belagatti 提出 AI 软件架构正走向分层智能:由确定性代码维护工作流结构,快速专用小模型处理窄域语义分支,只在异常情况下才升级调用完整推理模型。其中 system-one 小模型(如 Jev)做路由比 LLM 快约 200 倍、便宜约 400 倍。LangGraph 这类框架提供状态管理、持久化执行与人机协同检查点等编排层。

  9. AGI Hunt35

    学者称「AI 署名」定义模糊,学术会议分流政策一两年内将失效

    学者 ipeirotis 认为「AI 撰写」这一概念本身非常模糊,任何以此为基础的学术会议分流政策都会被双向滥用,并预言这类 AI 署名规则之争在一两年内就会变得无关紧要。他指出学术会议早已存在类似机制,如 ACL 的 Findings 板块收录正确但无需向人类报告的论文,其他会议也有类似政策。