AI 模型库:大模型、Agent 与开发工具

收录并解读主流 AI 模型、Agent 与开发工具的能力、场景与选型对比。

专业解读持续更新RSS 订阅

标签:向量与RAG

共 17 篇文章 · 清除标签

2周前

大模型 RAG 技术解析:从基础流程到高级检索架构与评估优化

我想把 RAG(Retrieval Augmented Generation,检索增强生成)从基础到进阶讲清楚,因为它已经成为目前大模型应用落地最热门的方案。如果你正在把大模型接入实际业务,很快会发现通用模型根本不够用——知识过时、回答幻觉、数据安全这三大痛点几乎无法回避。这篇文章适合两类读者:一类是刚接触 RAG、想理解整体流程和核心概念的开发者;另一类是已经搭过简单 RAG 系统、想在检索质量

向量与RAGAI安全大语言模型
2026年9月11日阅读全文 →
3周前

zg(zvec-grep)- Zvec AI 开源的本地优先统一检索基础工具

zg(zvec-grep)是 Zvec AI 开源的本地优先统一检索基础工具,面向开发者与 AI Agent 设计。该工具将 ripgrep 的精确匹配能力、BM25 词法检索与向量语义检索整合为单一检索链路,有效解决自然语言意图与代码或文档实际表述之间的词汇鸿沟,实现从模糊探索到精确定位的完整检索流程。文件扫描、Embedding 生成、索引构建与检索查询默认全部在本地设备完成,内置轻量端侧模型...

AI AgentAI编程向量与RAG
2026年9月4日阅读全文 →
3周前

FireRedAudio – FireRedTeam 推出的通用音频语言模型

FireRedAudio 是 FireRedTeam 推出的通用音频语言模型,代码、权重和论文都已公开。它用一个共享的 9B 自回归 LLM 做推理主干。理解与生成走解耦的连续表征:Audio Encoder 负责理解,RedAE 与 flow-matching DiT 负责生成。

语音AIAI编程向量与RAG
2026年9月1日阅读全文 →
1个月前

MyContext – 阿里千问办公开源的Agent上下文基础设施深度评测

MyContext是阿里云千问办公团队推出的开源Agent上下文基础设施,采用本地优先架构,能够将钉钉、飞书等即时通讯工具、文档及会议系统中的多源工作数据,自动加工为持续更新、可回溯的专属工作档案。该档案涵盖职责范围、协作关系与工作结论,遇到矛盾信息时通过语义分析判断合并或覆盖,无法确定时交由用户确认。基于该档案可构建个性化Agent,实现工作信息查询与拟人化自动回复,补齐了Agent在办公场景中...

AI Agent向量与RAGAI评测
2026年8月18日阅读全文 →
1个月前

PixelRAG – 伯克利开源的视觉原生 RAG 框架

PixelRAG是伯克利SkyLab/BAIR开源的一款视觉原生RAG框架。它跳出传统RAG从网页或PDF中抽取文本再检索的范式,改用无头Chromium将文档渲染为截图瓦片,并通过LoRA微调的Qwen3-VL视觉向量检索模型直接读取图像中的表格、图表和版式信息,从而解决了传统RAG在表格、图表和复杂版式上信息丢失的痛点。该框架提供从渲染、索引到检索、生成的完整工具链,并附带覆盖828万维基百科...

多模态向量与RAG文档AI
2026年8月13日阅读全文 →
1个月前

MindMemOS – 华为诺亚方舟开源的 AI Agent 记忆操作系统

MindMemOS是由华为诺亚方舟实验室开源的AI Agent记忆操作系统,旨在解决传统Agent在每次交互后遗忘历史信息的根本缺陷。该系统将记忆从单个Agent中解耦为可跨框架复用的独立资产,采用实体-属性-时间三维结构来保存最新状态与完整演变轨迹,并通过Dreaming离线整理、Feedback反馈闭环和Skill Evolution技能自演进等机制,实现记忆与系统的共同进化。它定位为Agen...

AI Agent多模态向量与RAG
2026年8月3日阅读全文 →
2个月前

Nemotron 3 Embed – 英伟达开源的文本嵌入模型系列

Nemotron 3 Embed是NVIDIA开源的多语言文本嵌入模型系列,专为检索增强生成(RAG)与智能体检索场景设计。该系列包含8B和1B两种参数规模,支持32k上下文窗口与34种语言,采用OpenMDW-1.1许可证开放商业使用。旗舰版8B模型在RTEB多语言检索排行榜上以78.5%的得分位居第一,而1B版本通过结构化剪枝与知识蒸馏,在大幅降低推理成本的同时保留了95%的检索精度。

AI Agent向量与RAG模型推理
2026年7月20日阅读全文 →
2个月前

RedKnot – 小红书开源的长文本推理加速引擎

RedKnot 是小红书技术团队开源的长文本 LLM 推理加速引擎,通过将 KV Cache 按注意力头维度解耦,离线分类为需全局重算的全局头与可局部复用的局部头,配合 SegPagedAttention 实现按头分页存储与融合变长注意力内核,避免 attn_mask 带来的内核惩罚。同时引入稀疏 FFN 机制,对高注意力分数的 token 执行稠密计算,解决短上下文下 FFN 占预填充延迟过半的...

AI Agent向量与RAG模型推理
2026年6月30日阅读全文 →
2个月前

LongCat-2.0 – 美团开源的一代万亿参数语言模型

LongCat-2.0是美团开源的新一代大规模MoE语言模型,拥有1.6万亿总参数,每token激活约480亿参数,基于五万卡国产AI ASIC超算集群完成全链路训练与部署。该模型原生支持高达1M token的超长上下文窗口,并引入了LongCat Sparse Attention(LSA)稀疏注意力机制与N-gram Embedding架构,在代码生成、自主Agent任务执行以及复杂推理等场景中...

AI AgentAI编程向量与RAG
2026年6月30日阅读全文 →
3个月前

Mistral OCR 4 – Mistral AI 推出的最一代文档理解模型

Mistral OCR 4 是法国人工智能公司 Mistral AI 于 2026 年 6 月推出的最新一代文档理解模型,专注于从 PDF、图片、演示文稿等复杂文档中高精度提取文本与结构化信息。该模型支持 170 种语言,能够返回带边框定位、区域类型分类和逐词置信度评分的结构化输出,专为检索增强生成(RAG)、智能体工作流和企业搜索等下游场景设计,在独立人工评估中平均胜率达到 72%,并以每千页 ...

AI Agent向量与RAG文档AI
2026年6月28日阅读全文 →
上一页12
第 1 页,共 2 页(17 篇文章)

订阅 AI 模型评测

新模型上线第一时间收到深度评测,了解能力与适用场景

我们不会泄露你的邮箱,可随时退订