通过数据连接器接入企业数据库、文档系统和对象存储,在应用中实时查询和引用数据
数据连接是管理外部数据源的统一入口。通过创建连接器,应用可以安全地访问企业数据库、文档系统和对象存储中的数据,在对话中实时查询和引用。
连接器按数据的存储和访问方式分为平台托管和流处理两类:
进入控制台 数据接入 → 数据连接,点击 创建连接器,选择连接器类型后按以下说明填写配置。
填写完成后,点击确认完成创建。
连接器创建完成后,需要向连接器中导入数据。
数据库连接器(MySQL / PostgreSQL / PolarDB-X 2.0)的数据保留在原数据库中,无需手动导入。连接器创建完成后即可在应用中实时查询数据。
文件类型数据连接器支持创建同步规则,从外部数据源自动同步文件到平台。在连接器详情页的文件标签下,点击右上角 同步数据规则 → 创建同步规则。
填写完成后点击连接检测验证连通性,通过后配置数据标签,点击确认创建规则。创建完成后显示在同步规则列表页,可对规则启用或禁用。
文件连接器创建成功后,系统自动生成以下工具,可在智能体应用或工作流中调用:
在数据连接列表页可对已有连接器进行以下操作:
除控制台操作外,也可通过 API 管理数据导入。详见 API 参考 — 数据导入。
连接器类型
连接器按数据的存储和访问方式分为平台托管和流处理两类:
| 联通格式 | 连接器 | 数据存储方式 | 适用场景 |
|---|---|---|---|
| 平台托管 | 文件 | 平台存储 | 上传和管理非结构化文档(PDF、Word、Markdown 等) |
| 平台托管 | 表格 | 平台存储 | 导入和查询结构化表格数据(CSV、Excel 等) |
| 流处理 | MySQL | 数据保留在原数据库,实时访问 | 连接 MySQL 数据库,执行 SQL 查询 |
| 流处理 | PostgreSQL | 数据保留在原数据库,实时访问 | 连接 PostgreSQL 数据库,执行 SQL 查询 |
| 流处理 | PolarDB-X 2.0 | 数据保留在原数据库,实时访问 | 连接阿里云 PolarDB-X 2.0 分布式数据库 |
语雀和 OSS 不作为独立连接器类型创建,仅作为文件连接器的同步数据来源,详见同步数据规则。
前置条件
- 账号权限:主账号或具有数据连接管理权限的 RAM 用户。
- 数据源准备(按连接器类型):
| 连接器 | 需要准备 |
|---|---|
| 文件 / 表格 | 待上传的文件,或已创建 OSS Bucket |
| MySQL | MySQL 数据库实例(阿里云 RDS 或自建),网络可达(公网或私网) |
| PostgreSQL | PostgreSQL 数据库实例,且已将 wal_level 参数设为 logical |
| PolarDB-X 2.0 | 阿里云 PolarDB-X 2.0 实例,所在地域支持私网访问 |
创建连接器
进入控制台 数据接入 → 数据连接,点击 创建连接器,选择连接器类型后按以下说明填写配置。
- 文件
- 表格
- MySQL
- PostgreSQL
- PolarDB-X 2.0
文件连接器用于管理非结构化文档(PDF、Word 等)。
导入数据
连接器创建完成后,需要向连接器中导入数据。
文件连接器
- 在数据连接列表页点击目标连接器的详情按钮,进入连接器详情页的文件标签。
- 在左侧类目树中选择现有类目,或点击 + 新建类目。
- 点击导入数据,选择本地导入,上传文件。也可选择 OSS 导入方式从 OSS 拉取文件。
- 选择解析方式(默认设置或自定义),系统自动完成文件解析。
- 目前平台不支持直接导入 JSON、CSV、YAML 格式文件,请转换为 XLSX 或 XLS 格式再导入。
- 文件导入后作为独立副本存储在平台中,与原始数据无关联。
数据库连接器
数据库连接器(MySQL / PostgreSQL / PolarDB-X 2.0)的数据保留在原数据库中,无需手动导入。连接器创建完成后即可在应用中实时查询数据。
同步数据规则
文件类型数据连接器支持创建同步规则,从外部数据源自动同步文件到平台。在连接器详情页的文件标签下,点击右上角 同步数据规则 → 创建同步规则。
- OSS
- 飞书
- 钉钉
- 语雀
通过阿里云服务关联角色(SLR)访问用户 Bucket,将 OSS 中的数据自动同步到平台。
- OSS 同步基于 SLR 访问用户 Bucket,无需配置 AccessKey。首次使用前需完成授权。
- 对象路径需包含 Bucket 名称,例如
my-bucket/docs/或my-bucket/docs/foo.md。 - 目标 Bucket 需添加
bailian-datahub-access标签(值为read)。
- 对象路径需包含 Bucket 名称,例如
文件连接器工具
文件连接器创建成功后,系统自动生成以下工具,可在智能体应用或工作流中调用:
| 工具名称 | 说明 |
|---|---|
searchFile | 按关键词搜索文件,返回匹配的文件列表和下载链接 |
getFile | 按 ID 获取文件,返回文件下载链接 |
管理连接器
在数据连接列表页可对已有连接器进行以下操作:
| 操作 | 说明 |
|---|---|
| 编辑 | 仅可修改连接器名称和描述 |
| 复制 | 复制连接器配置,生成新的连接器 |
| 删除 | 删除连接器,操作不可逆 |
连接器被知识库绑定为数据源后,该绑定关系不可更改。如需更换数据源,需创建新的知识库。
在智能体中使用数据连接器
- 在智能体编辑页面,进入技能 → 数据连接器。
- 点击 +,选择需要的数据连接器。
- 点击发布,智能体即可在对话中调用连接器的工具。
在工作流中使用数据连接器
- 在工作流编辑页面,添加数据连接器节点。
- 选择连接器和需要使用的工具(每个节点仅支持一个工具)。
- 工具输出为
result对象,包含content(Array)和isError(Boolean)字段。
数据导入 API
除控制台操作外,也可通过 API 管理数据导入。详见 API 参考 — 数据导入。
数据导入 API(
/api/v1/connector/dash/)与其他接口使用相同的 workspace 域名和鉴权方式,详见 API 概览。