跳到正文
9月30日周三
9月26日周六
  1. AWS Machine Learning Blog36

    NarrateAI:在 Amazon Bedrock 上实现生产级 LLM 质量保障

    AWS 的 NarrateAI 在 Amazon Bedrock 上通过五项技术实现约 99% 的数值准确率并实时流式返回结果,服务超过 4000 名 AWS 高管。这五项技术分别是自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证,其中约 90% 的查询走单次快速路径,仅约 10% 走并行批处理路径。

9月25日周五
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解五大 AI 热梗:读代码、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成代码仍需阅读,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是可读的 Markdown 打包经验,后者提供工具与数据的标准接入;RAG 并未消亡,检索能为模型提供训练数据外的文档、内部知识与代码库上下文,减少 token 浪费并降低答案不完整的概率。

9月3日周四
8月26日周三
8月21日周五
8月20日周四
  1. Mistral AI69

    Mistral 发布 Agentic Search 检索层,FinanceBench 准确率从 26.7% 升至 86%

    Mistral 发布 Agentic Search,一个面向企业复杂文档的多步检索层,通过 search、open、navigate、read、grep 五个工具让模型在索引之上迭代查找并核对证据。

    推荐理由:Mistral 给出 Agentic Search 在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可对照传统 RAG 判断检索层改造的收益。

8月18日周二
  1. Hugging Face Blog62

    Sentence Transformers v6.0 新增 MultiVectorEncoder 支持 ColBERT 式晚交互检索

    Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,可直接加载 PyLate、Stanford-NLP ColBERT 以及 colpali-engine 的视觉文档检索模型。

    推荐理由:Sentence Transformers v6.0 新增多向量编码器,读者可据此判断晚交互检索的接入成本与索引开销。

6月23日周二
  1. Mistral AI62

    Mistral 发布 OCR 4,支持边界框、块分类与置信度分数

    Mistral 发布 OCR 4,在提取文本之外返回边界框、块类型分类和逐页逐词置信度分数,支持 170 种语言并可在单个容器中自托管部署。该模型在 OlmOCRBench 上取得 85.20 分,独立标注者在 600 多份文档的盲评中平均 72% 更偏好其输出。

    推荐理由:OCR 4 在文本之外返回边界框、块分类与置信度,读者可据此判断它如何改变 RAG 与智能体的文档处理流程。

6月5日周五
5月28日周四
  1. Mistral AI71

    Mistral AI 发布开源 Search Toolkit 公开预览版

    Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架,将摄取、检索和评测统一到共享接口下,开源并支持云端、本地和边缘部署。

    推荐理由:Mistral 把检索管线的摄取、检索与评测收进同一框架,读者可据此判断自建 RAG 的集成成本会如何变化。

3月17日周二
5月28日周三
5月27日周二
4月9日周三
3月7日周五
  1. Mistral AI78

    Mistral AI 发布文档理解模型 Mistral OCR

    Mistral AI 发布光学字符识别 API Mistral OCR,可接收图片和 PDF,按顺序交错提取文本与图像,并支持表格、公式和 LaTeX 等复杂版式。

    推荐理由:官方给出 Mistral OCR 的基准对比、定价与自托管选项,可据此判断文档解析在 RAG 流程中的位置。