从 Teradata 迁移到 Fabric Data Warehouse 的方法

适用于:Microsoft Fabric 中的✅ 仓库

Teradata 迁移有两个主要步骤:首先使用 Fabric 迁移助手 迁移元数据,然后使用 Copy 作业、Fabric 管道或 COPY INTO 移动数据。 通过验证结果和重新路由连接完成迁移。

关于项目规划,请参见 “计划从Teradata迁移”。 关于语法和对象映射,请参阅 面向 Fabric Data Warehouse 的 Teradata SQL 转换。

阶段 推荐的方法 结果
Metadata 将 Teradata .sql 和/或.bteq文件的压缩包上传到 迁移助手 支持的对象会被翻译并在新的仓库中创建
修复 查看待修复的对象,并使用已记录的映射或 Copilot 建议 所需对象被修正并部署
数据 使用复制作业进行引导式传输;使用暂存文件和 COPY INTO 进行大规模批量加载 源数据已加载并完成核对
直接转换 验证工作负载并重新路由加载和报告连接 应用程序使用Fabric Data Warehouse

注释

迁移助手 负责翻译和部署元数据和代码。 在迁移工作流中,数据移动会以单独的复制作业或数据引入步骤的形式运行。

先决条件

开始之前,请准备:

  • 具有活动容量的 Fabric 工作区
  • 由包含 Teradata 表、视图、存储过程、函数、宏及其他必需对象定义的 .sql 和/或 .bteq 文件组成的 ZIP 压缩包。
  • 迁移批次中所有架构的依赖项。
  • 目的地仓库名称和排序选择。
  • 如果你打算用Copy job进行数据移动,请提供源凭证。

包含DDL定义,而非仅包含独立 SELECT 语句的文件。 迁移助手 会忽略那些仅包含查询且未定义对象的文件。

使用 迁移助手 迁移元数据

迁移助手 支持 Teradata 作为源,并将上传的 Teradata 元数据转换为兼容 Fabric 的 T-SQL。

  1. 在 Fabric 工作区中,选择 迁移。
  2. 在 “迁移到仓库”中,选择 Teradata(预览) 源图块。
  3. 在 设置源代码后,选择“ 选择文件”,浏览你的压缩包,然后选择 “下一步”。
  4. 审查检测到的源对象,选择该迁移波的模式或单个对象。
    • 当你选择单个对象时,你还可以看到已选择进行迁移的依赖对象。
  5. 在 设置目标 页上,选择工作区,输入新的仓库名称,然后选择排序规则。
  6. 查看输入,然后选择 迁移。
  7. 请等待 迁移助手 翻译支持的元数据并创建新的仓库。
  8. 请查看元数据迁移摘要。 展开 “显示迁移对象” 以查看每个对象及其状态。
  9. 选择一个对象来在 详情中查看数据类型或SQL调整。
  10. 需要离线记录用于审核或迁移跟踪时,可以导出摘要。

缺少依赖关系或不支持构造的对象会出现 在“待修复对象”下。

修复元数据翻译问题

使用 迁移助手 来审查和修正那些它不会自动创建的对象:

  1. 打开 “解决问题 ”并选择一个对象。
  2. 请查看共享查询中的源定义、自动翻译注释和错误细节。
  3. 如果您的租户和容量已启用 Copilot,请选择 “修复查询错误” 以生成建议的更正。
  4. 请审核所有AI生成的更改。 根据需要调整剧本。
  5. 选择 运行 以验证脚本并创建对象。
  6. 对每个所需对象重复此操作。 跳过目标中不需要的物体。

Copilot 可能会犯错。 将修正后的代码与Teradata行为及测试边界、空、精度和错误情况进行比较。

复制数据

在所需的表元数据存在后,选择一种数据移动方法。

使用复制作业

使用复制作业进行引导式的完全传输或增量传输:

  1. 在 迁移助手 中,打开“复制数据”,然后选择“使用复制任务”。
  2. 给作业命名,并用源凭证连接Teradata。
  3. 选择要复制的表格。
  4. 从OneLake目录中选择仓库。
  5. 复习表格和列映射。
  6. 选择一次性完整副本作为初始迁移,或在源配置支持时选择增量副本以共存。
  7. 选择 保存+运行,然后监控行数、持续时间和失败。

使用分阶段文件并复制

对于大型历史传输,可以批量卸载 Teradata 表到 ADLS Gen2。 在受支持的情况下使用 Parquet 文件,保留提取清单,并使用 COPY INTO 加载这些文件。

Example:

COPY INTO dbo.FactSales
FROM 'https://<storage-account>.dfs.core.windows.net/<container>/factsales/'
WITH (
    FILE_TYPE = 'PARQUET'
);

当存储账户网络配置需要时,使用 可信工作区访问 和工作区身份。 当流程需要多步编排、转换、分支或自定义恢复时,则应改用 Fabric 管道。

替换 Teradata 加载工具

Teradata 工具既表示数据移动,也表示编排行为。 重建完整的行为,而不是只翻译加载语句。

Teradata 工具 Fabric法 迁移模式
FastLoad COPY INTO 或复制工作 批量卸载到暂存文件,创建一个空目标表,并行加载
MultiLoad COPY INTO 加 MERGE 将文件加载到暂存表中,验证后再将插入、更新和删除操作合并到目标表
Teradata平行运输机 Fabric 管道,包含文案和脚本活动 将操作符、序列、错误处理和依赖关系作为显式的流水线步骤重新创建
BTEQ .IMPORT COPY INTO 一张桌子 以受管控的暂存文件加载取代客户端导入方式
BTEQ .EXPORT 流水线、笔记本或支持的导出模式 根据消费系统选择目的地和文件格式

验证和重定向连接

切换前:

  • 对行计数、聚合、零值、小数点、时间戳和对排序敏感值进行调和。
  • 测试视图、过程、函数、BTEQ 替代项、报告和语义模型。
  • 测试失败负载重放、部分失败、增量同步和峰值并发。
  • 比较代表性商业周期的来源和目标结果。
  • 运行最后一次增量加载并完成切换检查清单。
  • 更新报表、语义模型、应用,以及与 Fabric Data Warehouse 的 ETL/ELT 连接。