01WHAT IT SOLVES
这个项目解决什么问题?
LlamaIndex 是一个面向 LLM 应用的 Python 数据框架,定位介于裸 LLM 接入层与完整企业文档平台之间。它通过数据连接器接入多源异构数据,提供索引结构化能力,并暴露检索和查询接口给上层智能体或应用使用。在同类方案中,LlamaIndex 强调对 RAG 场景的端到端支持:三百余个官方集成覆盖主流 LLM、嵌入和向量库;同时把核心文档能力沉淀到 LlamaParse 企业级文档智能体平台,形成开源工具链与商业平台并行的双层结构。
02CORE CAPABILITIES
核心能力
数据连接器
提供 API、PDF、数据库等多种数据源接入能力
索引与图结构
支持向量索引、列表索引与属性图等多种组织方式
检索查询接口
在数据之上提供统一的检索与增强生成查询接口
多 LLM 集成
兼容 OpenAI、Anthropic、Bedrock 等三百余个插件
智能体工作流
提供 Workflows 与 Agent Workflow 构建文档智能体
03适合谁
- 需要搭建 RAG 与智能体应用的 Python 开发者
- 接入私有文档或数据库的中型技术团队
- 评估多 LLM 与向量库组合的技术决策者
- 对文档解析与结构化抽取有需求的企业用户
04典型使用场景
- 基于私有文档构建问答或检索增强系统
- 搭建多步检索增强的智能体工作流
- 在多个 LLM 与向量库之间进行实验与切换
- 企业级文档结构化抽取与索引管道
05为什么值得关注
- 官方生态提供三百余个集成,组合能力强
- 开源框架与 LlamaParse 商业平台并行推进
- 近半年版本持续引入多模态合成与查询能力
- 头部 LLM 厂商新模型适配节奏较快
06采用前要注意
- 主要面向 Python 生态,其他语言接入成本较高
- 涉及索引、检索器、查询引擎等多个抽象层
- 企业级文档能力正逐步迁移至 LlamaParse 商业平台
- 集成包数量众多,版本碎片与依赖维护需跟进
07RELEASE INTELLIGENCE
近期版本变化
LlamaIndex v0.14.24:Claude 新模型接入与核心模块修复
本次发布同步 Anthropic Claude Sonnet 5 与 Opus 5 模型适配,修正 Opus 4.6 上下文窗口为 100 万 token。核心模块集中修复若干边界问题,包括 HTML 解析跳过空节点、MMR 阈值处理、CitationQueryEngine 节点编号、流式聊天记忆写入等。Bedrock 相关集成将 aioboto3 改为可选依赖,FalkorDB 图存储修正向量排序与过滤逻辑,LanceDB 修复图片摄取崩溃,并新增 LLM 路径抽取器的 raise_on_error 选项与 LLMRerank 异步实现。影响使用相关集成、检索与记忆功能的开发者,建议升级以获
- Anthropic 集成新增 Claude Sonnet 5 支持并将 Opus 5 加入白名单
- 修正 Claude Opus 4.6 上下文窗口为 100 万 token
- 核心检索、节点解析与记忆模块集中修复一批缺陷
- Bedrock 集成将 aioboto3 改为可选依赖并增强嵌入校验
LlamaIndex v0.14.23:多模态合成与查询引擎落地
本版本重点推进多模态能力,新增多模态合成第二阶段与多模态查询引擎。核心模块修复若干稳定性问题,包括 PromptHelper 空输入除零保护、FunctionTool 解析文档与视频块、UTF-8 编码显式声明、Workflow 初始状态深拷贝、TokenTextSplitter 与 SentenceSplitter 递归栈溢出等。同时回调和嵌入相关多个集成包批量升级依赖。影响正在试验多模态或受上述缺陷影响的用户,建议升级。
- 多模态合成第二阶段与多模态查询引擎进入核心
- 核心模块修复多处崩溃与边界缺陷
- 多个回调与嵌入集成包批量升级依赖
LlamaIndex v0.14.22:多模态合成起点与摄取流水线改进
本次发布引入多模态合成能力作为起点,修复摄取流水线在多进程下的缓存写入问题,避免响应对象被意外修改。FunctionTool 在同步到异步桥接时正确传递上下文变量,记忆模块可估算文档块 token 用量。同时清理公开 API 的过时导出,并对几乎全部集成包批量升级依赖锁。影响使用摄取流水线、FunctionTool 或关心公开 API 整洁度的开发者。
- 多模态合成能力首次进入核心
- 摄取流水线在多进程下正确写入缓存
- 公开 API 清理过时导出并批量升级依赖
LlamaIndex v0.14.21:持久层编码与结构化输出修复
本版本修复删除无效节点时的 KeyError,以及结构化输出失败时的 ValueError 与 TypeError 处理。持久层文件操作显式声明 UTF-8 编码,并回滚上一版本对消息块缓冲解析的破坏性变更。NVIDIA 嵌入集成新增 HTTP 客户端支持,便于自托管或代理环境接入。其余主要为多组嵌入与回调包的依赖升级。影响在升级过程中遭遇上述回归或使用 NVIDIA 嵌入自部署的用户。
- 持久层文件 I/O 全面声明 UTF-8 编码
- 回滚并修复消息块缓冲解析的破坏性变更
- NVIDIA 嵌入集成新增 HTTP 客户端支持
LlamaIndex v0.14.20:批量修复 nltk 漏洞与依赖同步
本次发布主要修复内置 nltk 资源相关的安全漏洞,覆盖几乎全部 callbacks、agent、embeddings 集成包,同时对多个 uv 与 pip 依赖组进行批量升级。官方说明未提供更多细节说明本次漏洞的影响范围与升级紧迫性。建议所有使用受影响包的用户升级到当前最新版本。
- 修复 nltk 资源相关的安全漏洞并覆盖全量集成包
- 多个依赖组统一升级以保持一致基线
- 官方说明未提供更多细节
llama_index v0.14.19:新增 MiniMax 提供商与多模型默认升级
新增 MiniMax LLM 集成并将 M2.7 设为默认;OpenAI 集成支持 GPT 5.4 Mini 与 Nano 变体;Google GenAI 集成默认改为 Gemini 3 并支持自定义温度;Azure OpenAI 集成增加 responses 接口支持;启用 llama-cloud 1.0 以上版本安装;若干索引与检索修复。影响使用上述云端模型与 llama-cloud 服务的开发者。
- 新增 MiniMax LLM 提供商集成,默认模型 M2.7
- OpenAI 集成支持 GPT 5.4 Mini 与 Nano 变体
- Google GenAI 默认改为 Gemini 3,Azure OpenAI 支持 responses 接口
- 启用 llama-cloud 1.0 以上版本安装