← 返回项目库

run-llama/llama_index

llama_index:本地大模型运行与推理工具

LlamaIndex 解决如何把大语言模型与私有数据结合的问题,提供数据接入、结构化索引与检索查询的工具链。适合需要搭建 RAG 检索增强或智能体应用的 Python 开发者。主要门槛是需要熟悉 Python 生态,自行选择 LLM、嵌入和向量库等组件,并理解索引与检索器的工作机制。

官方名称:llama_index资料更新:2026/9/12
打开 GitHub
Stars
5.2万
7日增长
+108
Forks
8121
活跃度
100
维护状态
活跃

01WHAT IT SOLVES

这个项目解决什么问题?

LlamaIndex 是一个面向 LLM 应用的 Python 数据框架,定位介于裸 LLM 接入层与完整企业文档平台之间。它通过数据连接器接入多源异构数据,提供索引结构化能力,并暴露检索和查询接口给上层智能体或应用使用。在同类方案中,LlamaIndex 强调对 RAG 场景的端到端支持:三百余个官方集成覆盖主流 LLM、嵌入和向量库;同时把核心文档能力沉淀到 LlamaParse 企业级文档智能体平台,形成开源工具链与商业平台并行的双层结构。

02CORE CAPABILITIES

核心能力

01

数据连接器

提供 API、PDF、数据库等多种数据源接入能力

02

索引与图结构

支持向量索引、列表索引与属性图等多种组织方式

03

检索查询接口

在数据之上提供统一的检索与增强生成查询接口

04

多 LLM 集成

兼容 OpenAI、Anthropic、Bedrock 等三百余个插件

05

智能体工作流

提供 Workflows 与 Agent Workflow 构建文档智能体

03适合谁

  • 需要搭建 RAG 与智能体应用的 Python 开发者
  • 接入私有文档或数据库的中型技术团队
  • 评估多 LLM 与向量库组合的技术决策者
  • 对文档解析与结构化抽取有需求的企业用户

04典型使用场景

  • 基于私有文档构建问答或检索增强系统
  • 搭建多步检索增强的智能体工作流
  • 在多个 LLM 与向量库之间进行实验与切换
  • 企业级文档结构化抽取与索引管道

05为什么值得关注

  • 官方生态提供三百余个集成,组合能力强
  • 开源框架与 LlamaParse 商业平台并行推进
  • 近半年版本持续引入多模态合成与查询能力
  • 头部 LLM 厂商新模型适配节奏较快

06采用前要注意

  • 主要面向 Python 生态,其他语言接入成本较高
  • 涉及索引、检索器、查询引擎等多个抽象层
  • 企业级文档能力正逐步迁移至 LlamaParse 商业平台
  • 集成包数量众多,版本碎片与依赖维护需跟进

07RELEASE INTELLIGENCE

近期版本变化

全部版本动态 →

LlamaIndex v0.14.24:Claude 新模型接入与核心模块修复

本次发布同步 Anthropic Claude Sonnet 5 与 Opus 5 模型适配,修正 Opus 4.6 上下文窗口为 100 万 token。核心模块集中修复若干边界问题,包括 HTML 解析跳过空节点、MMR 阈值处理、CitationQueryEngine 节点编号、流式聊天记忆写入等。Bedrock 相关集成将 aioboto3 改为可选依赖,FalkorDB 图存储修正向量排序与过滤逻辑,LanceDB 修复图片摄取崩溃,并新增 LLM 路径抽取器的 raise_on_error 选项与 LLMRerank 异步实现。影响使用相关集成、检索与记忆功能的开发者,建议升级以获

  • Anthropic 集成新增 Claude Sonnet 5 支持并将 Opus 5 加入白名单
  • 修正 Claude Opus 4.6 上下文窗口为 100 万 token
  • 核心检索、节点解析与记忆模块集中修复一批缺陷
  • Bedrock 集成将 aioboto3 改为可选依赖并增强嵌入校验

LlamaIndex v0.14.23:多模态合成与查询引擎落地

本版本重点推进多模态能力,新增多模态合成第二阶段与多模态查询引擎。核心模块修复若干稳定性问题,包括 PromptHelper 空输入除零保护、FunctionTool 解析文档与视频块、UTF-8 编码显式声明、Workflow 初始状态深拷贝、TokenTextSplitter 与 SentenceSplitter 递归栈溢出等。同时回调和嵌入相关多个集成包批量升级依赖。影响正在试验多模态或受上述缺陷影响的用户,建议升级。

  • 多模态合成第二阶段与多模态查询引擎进入核心
  • 核心模块修复多处崩溃与边界缺陷
  • 多个回调与嵌入集成包批量升级依赖

LlamaIndex v0.14.22:多模态合成起点与摄取流水线改进

本次发布引入多模态合成能力作为起点,修复摄取流水线在多进程下的缓存写入问题,避免响应对象被意外修改。FunctionTool 在同步到异步桥接时正确传递上下文变量,记忆模块可估算文档块 token 用量。同时清理公开 API 的过时导出,并对几乎全部集成包批量升级依赖锁。影响使用摄取流水线、FunctionTool 或关心公开 API 整洁度的开发者。

  • 多模态合成能力首次进入核心
  • 摄取流水线在多进程下正确写入缓存
  • 公开 API 清理过时导出并批量升级依赖

LlamaIndex v0.14.21:持久层编码与结构化输出修复

本版本修复删除无效节点时的 KeyError,以及结构化输出失败时的 ValueError 与 TypeError 处理。持久层文件操作显式声明 UTF-8 编码,并回滚上一版本对消息块缓冲解析的破坏性变更。NVIDIA 嵌入集成新增 HTTP 客户端支持,便于自托管或代理环境接入。其余主要为多组嵌入与回调包的依赖升级。影响在升级过程中遭遇上述回归或使用 NVIDIA 嵌入自部署的用户。

  • 持久层文件 I/O 全面声明 UTF-8 编码
  • 回滚并修复消息块缓冲解析的破坏性变更
  • NVIDIA 嵌入集成新增 HTTP 客户端支持

LlamaIndex v0.14.20:批量修复 nltk 漏洞与依赖同步

本次发布主要修复内置 nltk 资源相关的安全漏洞,覆盖几乎全部 callbacks、agent、embeddings 集成包,同时对多个 uv 与 pip 依赖组进行批量升级。官方说明未提供更多细节说明本次漏洞的影响范围与升级紧迫性。建议所有使用受影响包的用户升级到当前最新版本。

  • 修复 nltk 资源相关的安全漏洞并覆盖全量集成包
  • 多个依赖组统一升级以保持一致基线
  • 官方说明未提供更多细节

llama_index v0.14.19:新增 MiniMax 提供商与多模型默认升级

新增 MiniMax LLM 集成并将 M2.7 设为默认;OpenAI 集成支持 GPT 5.4 Mini 与 Nano 变体;Google GenAI 集成默认改为 Gemini 3 并支持自定义温度;Azure OpenAI 集成增加 responses 接口支持;启用 llama-cloud 1.0 以上版本安装;若干索引与检索修复。影响使用上述云端模型与 llama-cloud 服务的开发者。

  • 新增 MiniMax LLM 提供商集成,默认模型 M2.7
  • OpenAI 集成支持 GPT 5.4 Mini 与 Nano 变体
  • Google GenAI 默认改为 Gemini 3,Azure OpenAI 支持 responses 接口
  • 启用 llama-cloud 1.0 以上版本安装