跳到正文

#RAG

今日 13 条
9月16日周三
  1. Google Research37

    绕过推理瓶颈:Google Research 用 Retrieve-for-Train 加速复杂 AI 搜索

    Google Research 提出 Retrieve-for-Train 框架,用离线强化学习把奖励对齐的查询 fan-out 编译成监督信号,蒸馏进仅 53.9M 参数的扩散检索器,实现单次非自回归查询扩展。该框架微调 Gemma3-4B 和 Qwen3-4B,以集合级奖励评估整组结果,绕开零样本 LLM 的语义重复与数百个 CoT 推理 token 带来的自回归延迟。

9月3日周四
8月26日周三
8月20日周四
8月18日周二
  1. HuggingFace Blog69

    Sentence Transformers v6.0 新增 MultiVectorEncoder,支持 ColBERT 式后交互检索

    Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式后交互检索,可直接加载 PyLate 与 Stanford-NLP ColBERT 检查点。

    推荐理由:文章展示 Sentence Transformers v6.0 的多向量编码器如何用 token 级向量与 MaxSim 换取更高检索质量,并给出可直接运行的接入代码。

6月23日周二
  1. Mistral AI63

    Mistral 发布 OCR 4 文档解析模型,支持边界框与块分类

    Mistral 发布 OCR 4 文档解析模型,在文本提取之外新增边界框、块类型分类和逐页逐词置信度,支持 170 种语言并可单容器自托管部署。该模型在 OlmOCRBench 得 85.20、OmniDocBench 得 93.07,人类偏好评估中平均胜率 72%。

    推荐理由:OCR 4 把边界框、块分类和置信度一并输出,读者可据此判断结构化文档解析在检索与智能体流程里的接入方式。

6月5日周五
5月28日周四
3月17日周二
5月28日周三
4月9日周三
  1. Mistral AI41

    Mistral 如何用 LLM as a Judge 评估 RAG 系统

    Mistral 展示用 LLM as a Judge 评估 RAG:由 judge LLM 按数值或定性量表为 generator LLM 的答案打分。评判采用 TruLens 的 RAG Triad 三项指标,并通过 Mistral API 近期上线的结构化输出,按自定义 schema 返回可机读的评分与解释。

3月7日周五
  1. Mistral AI67

    Mistral 发布 OCR 模型与 API Mistral OCR

    Mistral 发布 Mistral OCR,一款以图像和 PDF 为输入、按顺序交错输出文本与图片的 OCR API,并已成为 Le Chat 文档理解的默认模型。

    推荐理由:官方列出与 Google Document AI、Azure OCR、Gemini 等模型的横向基准对比,可用于判断文档解析模型的当前水位。