AI资讯 / 工程

工程 / 工程

亚马逊云科技推出Bedrock托管知识库,为智能体打造企业级检索能力

AWS Machine Learning

亚马逊云科技宣布Amazon Bedrock托管知识库正式可用。该服务把企业数据接入、多模态解析、向量存储、检索逻辑与运维打包为全托管方案,让开发者不必再拼凑连接器、解析器、向量库与权限层。通过AWS管理控制台无需选择模型,数分钟内即可完成首次检索,并支持自定义嵌入模型、重排模型与分块策略。服务内置六种企业连接器,支持实时访问控制列表校验,确保LLM仅看到有权限的文档。多模态解析自动适配PDF、PPTX、DOCX、扫描件、音视频,存储层由服务自动配置与扩展,混合检索默认开启。OpenAI、先正达集团、MRH Trowe等已在内部知识搜索与RAG场景中使用。

传统的企业知识检索流水线需要自行搭建连接器、解析器、向量或图存储与检索逻辑,还要叠加文档级访问控制、可观测性与安全机制,每一环节都带来独立的工程负担。亚马逊云科技此次将Amazon Bedrock托管知识库推向正式可用,把扩展能力、高精度检索与文档级权限校验全部纳入托管范围,企业只需接入数据源即可开始摄入。

在搭建层面,服务消除了模型选型、向量库选型与容量预置的门槛。控制台提供合理默认配置,数分钟内即可完成首次检索;同时保留对嵌入模型、重排模型、分块策略与上下文窗口的自定义空间。六种原生连接器覆盖Amazon S3、SharePoint、Confluence、Google Drive、OneDrive与Web爬虫,未支持的来源也可通过直接摄入接口接入,后续同步仅处理变更文件。

权限层面,服务在检索前过滤的基础上叠加实时访问控制列表校验,过滤后的文档仅在API调用生命周期内存在,对大模型与用户均不可见,从而避免依赖可能过期或映射错误的ACL数据。Syngenta与MRH Trowe等客户已据此为员工提供跨SharePoint与Confluence的多语言知识搜索。

解析与存储同样由服务托管。多模态解析自动适配表格、图表、混合排版与媒体内容,单个PDF可达500 MB,音频2 GB,视频10 GB;存储层自动配置向量维度与相似度指标,从GB级扩展至TB级无需人工干预,关键词与语义混合检索默认开启,数据通过AWS KMS密钥在静态与传输中加密。

仅需三次API调用即可完成编程式搭建:创建知识库、添加数据源、启动摄入,整个过程无需填写嵌入模型ARN、向量库或分块配置。OpenAI、Syngenta与MRH Trowe等团队已将该能力用于RAG与智能体回答场景。

要点

  • Amazon Bedrock托管知识库正式可用,把企业检索流水线整合为全托管方案。
  • 内置六种企业连接器与实时ACL校验,LLM仅能访问授权文档。
  • 多模态解析覆盖PDF、音视频等格式,存储与混合检索由服务自动管理。
  • 控制台零配置即可数分钟完成首次检索,同时保留嵌入与重排模型的自定义空间。
  • 三次API调用即可完成搭建,无需预置向量库或选择分块策略。
查看原始来源

原始标题:Build enterprise search for agents with Amazon Bedrock Managed Knowledge Base

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。