AI资讯新闻榜单内容搜索-RAG

2U服务器碾压超算集群！1000美元电费算出314万亿位圆周率

2022年，Google Cloud 将π计算到100万亿位，在2025年，高性能计算界的知名评测机构 StorageReview只用了4个月的时间，花了不到一千美元电费就将π算到314万亿位，这可不是为了炫技，而是说明高性能计算也可以很节能。

来自主题: AI资讯

6864 点击 2026-01-12 09:34

都有混合检索与智能路由了，谁还在给RAG赛博哭坟？

最近一年，互联网上各种为RAG赛博哭坟的帖子不胜枚举。

来自主题: AI技术研报

10226 点击 2026-01-09 10:53

刚刚！阿里开源 Qwen3-VL-Embedding 和 Qwen3-VL-Reranker 模型！图片和视频也可以做RAG了～

今天，Qwen 家族新成员+2，我们正式发布 Qwen3-VL-Embedding 和 Qwen3-VL-Reranker 模型系列，这两个模型基于 Qwen3-VL 构建，专为多模态信息检索与跨模态理解设计，为图文、视频等混合内容的理解与检索提供统一、高效的解决方案。

来自主题: AI资讯

10484 点击 2026-01-08 23:28

检索做大，生成做轻：CMU团队系统评测RAG的语料与模型权衡

在检索增强生成中，扩大生成模型规模往往能提升准确率，但也会显著抬高推理成本与部署门槛。CMU 团队在固定提示模板、上下文组织方式与证据预算，并保持检索与解码设置不变的前提下，系统比较了生成模型规模与检索语料规模的联合效应，发现扩充检索语料能够稳定增强 RAG，并在多项开放域问答基准上让小中型模型在更大语料下达到甚至超过更大模型在较小语料下的表现，同时在更高语料规模处呈现清晰的边际收益递减。

来自主题: AI技术研报

8493 点击 2026-01-06 09:30