适用于:Microsoft Fabric 中的✅ 仓库
Teradata 迁移有两个主要步骤:首先使用 Fabric 迁移助手 迁移元数据,然后使用 Copy 作业、Fabric 管道或 COPY INTO 移动数据。 通过验证结果和重新路由连接完成迁移。
关于项目规划,请参见 “计划从Teradata迁移”。 关于语法和对象映射,请参阅 面向 Fabric Data Warehouse 的 Teradata SQL 转换。
建议的迁移路径
| 阶段 | 推荐的方法 | 结果 |
|---|---|---|
| Metadata | 将 Teradata .sql 和/或.bteq文件的压缩包上传到 迁移助手 |
支持的对象会被翻译并在新的仓库中创建 |
| 修复 | 查看待修复的对象,并使用已记录的映射或 Copilot 建议 | 所需对象被修正并部署 |
| 数据 | 使用复制作业进行引导式传输;使用暂存文件和 COPY INTO 进行大规模批量加载 |
源数据已加载并完成核对 |
| 直接转换 | 验证工作负载并重新路由加载和报告连接 | 应用程序使用Fabric Data Warehouse |
注释
迁移助手 负责翻译和部署元数据和代码。 在迁移工作流中,数据移动会以单独的复制作业或数据引入步骤的形式运行。
先决条件
开始之前,请准备:
- 具有活动容量的 Fabric 工作区
- 由包含 Teradata 表、视图、存储过程、函数、宏及其他必需对象定义的
.sql和/或.bteq文件组成的 ZIP 压缩包。 - 迁移批次中所有架构的依赖项。
- 目的地仓库名称和排序选择。
- 如果你打算用Copy job进行数据移动,请提供源凭证。
包含DDL定义,而非仅包含独立 SELECT 语句的文件。 迁移助手 会忽略那些仅包含查询且未定义对象的文件。
使用 迁移助手 迁移元数据
迁移助手 支持 Teradata 作为源,并将上传的 Teradata 元数据转换为兼容 Fabric 的 T-SQL。
- 在 Fabric 工作区中,选择 迁移。
- 在 “迁移到仓库”中,选择 Teradata(预览) 源图块。
- 在 设置源代码后,选择“ 选择文件”,浏览你的压缩包,然后选择 “下一步”。
- 审查检测到的源对象,选择该迁移波的模式或单个对象。
- 当你选择单个对象时,你还可以看到已选择进行迁移的依赖对象。
- 在 设置目标 页上,选择工作区,输入新的仓库名称,然后选择排序规则。
- 查看输入,然后选择 迁移。
- 请等待 迁移助手 翻译支持的元数据并创建新的仓库。
- 请查看元数据迁移摘要。 展开 “显示迁移对象” 以查看每个对象及其状态。
- 选择一个对象来在 详情中查看数据类型或SQL调整。
- 需要离线记录用于审核或迁移跟踪时,可以导出摘要。
缺少依赖关系或不支持构造的对象会出现 在“待修复对象”下。
修复元数据翻译问题
使用 迁移助手 来审查和修正那些它不会自动创建的对象:
- 打开 “解决问题 ”并选择一个对象。
- 请查看共享查询中的源定义、自动翻译注释和错误细节。
- 如果您的租户和容量已启用 Copilot,请选择 “修复查询错误” 以生成建议的更正。
- 请审核所有AI生成的更改。 根据需要调整剧本。
- 选择 运行 以验证脚本并创建对象。
- 对每个所需对象重复此操作。 跳过目标中不需要的物体。
Copilot 可能会犯错。 将修正后的代码与Teradata行为及测试边界、空、精度和错误情况进行比较。
复制数据
在所需的表元数据存在后,选择一种数据移动方法。
使用复制作业
使用复制作业进行引导式的完全传输或增量传输:
- 在 迁移助手 中,打开“复制数据”,然后选择“使用复制任务”。
- 给作业命名,并用源凭证连接Teradata。
- 选择要复制的表格。
- 从OneLake目录中选择仓库。
- 复习表格和列映射。
- 选择一次性完整副本作为初始迁移,或在源配置支持时选择增量副本以共存。
- 选择 保存+运行,然后监控行数、持续时间和失败。
使用分阶段文件并复制
对于大型历史传输,可以批量卸载 Teradata 表到 ADLS Gen2。 在受支持的情况下使用 Parquet 文件,保留提取清单,并使用 COPY INTO 加载这些文件。
Example:
COPY INTO dbo.FactSales
FROM 'https://<storage-account>.dfs.core.windows.net/<container>/factsales/'
WITH (
FILE_TYPE = 'PARQUET'
);
当存储账户网络配置需要时,使用 可信工作区访问 和工作区身份。 当流程需要多步编排、转换、分支或自定义恢复时,则应改用 Fabric 管道。
替换 Teradata 加载工具
Teradata 工具既表示数据移动,也表示编排行为。 重建完整的行为,而不是只翻译加载语句。
| Teradata 工具 | Fabric法 | 迁移模式 |
|---|---|---|
| FastLoad |
COPY INTO 或复制工作 |
批量卸载到暂存文件,创建一个空目标表,并行加载 |
| MultiLoad |
COPY INTO 加 MERGE |
将文件加载到暂存表中,验证后再将插入、更新和删除操作合并到目标表 |
| Teradata平行运输机 | Fabric 管道,包含文案和脚本活动 | 将操作符、序列、错误处理和依赖关系作为显式的流水线步骤重新创建 |
BTEQ .IMPORT |
COPY INTO 一张桌子 |
以受管控的暂存文件加载取代客户端导入方式 |
BTEQ .EXPORT |
流水线、笔记本或支持的导出模式 | 根据消费系统选择目的地和文件格式 |
验证和重定向连接
切换前:
- 对行计数、聚合、零值、小数点、时间戳和对排序敏感值进行调和。
- 测试视图、过程、函数、BTEQ 替代项、报告和语义模型。
- 测试失败负载重放、部分失败、增量同步和峰值并发。
- 比较代表性商业周期的来源和目标结果。
- 运行最后一次增量加载并完成切换检查清单。
- 更新报表、语义模型、应用,以及与 Fabric Data Warehouse 的 ETL/ELT 连接。