使用 RcloneView 无需命令行即可在 Google Cloud Storage 和 AWS S3 之间传输文件
在 Google Cloud Storage 和 AWS S3 之间管理数据通常意味着要同时使用 gsutil、aws cli 和自定义脚本。RcloneView 让你可以在可视化界面中完成这一切——在几分钟内浏览、比较、同步和调度 GCS 与 S3 之间的传输。
对大多数工程团队来说,多云已成为现实。你的机器学习训练数据存放在 GCS 存储桶中,你的生产环境资源在 S3 上,而总得有人让它们保持同步。传统方式——用 gsutil 和 aws cli 编写 shell 脚本——虽然可行,但既脆弱又难以监控,非工程师更是无从管理。
RcloneView 原生连接 GCS 和 S3,为你提供统一的 GUI,用于在这两个最大的云平台之间浏览、传输、比较和自动化数据移动。

在一个地方管理和同步所有云端
RcloneView 是 rclone 的跨平台 GUI。通过清爽的可视化界面比较文件夹、传输或同步文件,并自动化多云工作流。
- 一键作业:复制 · 同步 · 比较
- 调度器与历史记录,实现可靠的自动化
- 支持 Google Drive、OneDrive、Dropbox、S3、WebDAV、SFTP 等
核心功能免费。Plus 提供自动化功能。
为什么要在 GCS 和 S3 之间迁移数据?
团队之间在 Google Cloud Storage 和 AWS S3 之间传输数据,通常出于以下几个常见原因:
多云冗余 — 将关键数据存储在两大主要服务商上,可以防范单一服务商级别的中断和厂商锁定。如果一个云出现故障,你的数据仍可从另一个云访问。
成本优化 — GCS 和 S3 在存储、出站流量和操作方面的定价不同。将冷数据迁移到对你的使用模式来说更便宜的服务商,可以节省大量费用。
跨平台工作流 — 你的数据科学团队使用 GCP(BigQuery、Vertex AI),而你的生产基础设施运行在 AWS 上。数据需要在两者之间流动。
迁移 — 在不停机的情况下从 GCP 迁移到 AWS(或反之),需要可靠的、可恢复的传输方式。
合规与数据驻留 — 某些法规要求在特定地区或服务商保留数据副本。
设置 GCS 和 S3 远程
添加 Google Cloud Storage
- 打开 RcloneView 并点击 Add Remote。
- 从服务商列表中选择 Google Cloud Storage。
- 选择你的身份验证方式:
- Service Account JSON — 推荐用于服务器到服务器的传输。上传你的服务账号密钥文件。
- OAuth (browser login) — 适用于个人 GCP 账号。请参阅 OAuth 登录指南。
- 如有提示,设置你的 project ID 和默认的 bucket location。
- 保存远程——现在你的 GCS 存储桶即可浏览。
添加 AWS S3
- 再次点击 Add Remote。
- 从服务商列表中选择 Amazon S3。
- 输入你的 Access Key ID 和 Secret Access Key。
- 选择你的 region 和 endpoint。
- 保存——你的 S3 存储桶就会出现在 Explorer 中。
有关 S3 的详细设置,请参阅 AWS S3 连接指南。
并排浏览 GCS 和 S3
两个远程都连接好后,在 RcloneView 的双栏 Explorer 中打开它们。GCS 存储桶显示在左侧,S3 存储桶显示在右侧(或反之)。你可以:
- 同时浏览 两侧的存储桶和文件夹。
- 查看文件大小、日期和数量,了解各处的数据情况。
- 拖放 文件,直接从 GCS 拖到 S3——或使用内置的复制/移动命令。
这种并排视图让你无需在 GCP 控制台和 AWS 控制台之间切换,即可即时了解两个云的情况。
传输场景
场景 1:一次性迁移(GCS → S3)
将所有数据从 GCS 迁移到 S3 以进行平台迁移:
- 创建一个 Copy job:
- 源:GCS 远程 → 选择你的存储桶
- 目标:S3 远程 → 选择目标存储桶
- 配置以实现最大速度:
- 并行传输数:8–16(GCS 和 S3 都能很好地处理高并发)
- 分块大小:对大文件使用 64MB–128MB
- 启用
--fast-list标志以加快目录列出速度
- 运行任务并实时监控进度。
对于大型迁移,可多次运行 Copy job。首次完整复制后,后续运行只会传输新增或更改的文件——这使得中断后恢复变得安全可靠。
场景 2:持续同步(双向)
持续保持 GCS 存储桶和 S3 存储桶的同步:
- 为主方向创建一个 Sync job(GCS → S3)。
- 使用任务调度调度它每小时或每天运行。
- 如果需要双向同步,添加一个反向 Sync job(S3 → GCS)。
- 使用批量任务(Batch Jobs)(v1.3)依次运行两个方向。
场景 3:选择性跨云备份
仅将特定数据备份到另一个云:
- 使用筛选规则 来包含/排除特定文件类型或文件夹。
- 示例:仅同步
*.parquet和*.csv文件(机器学习数据集) - 示例:排除
tmp/和logs/目录
- 示例:仅同步
- 创建一个应用了这些筛选条件的定时 Copy job。
比较 GCS 和 S3 的内容
在传输前后,使用文件夹比较来验证两个存储桶包含相同的数据:
- 仅存在于 GCS 中的文件 — 会被高亮标出,便于识别。
- 仅存在于 S3 中的文件 — 显示目标位置存在但源位置不存在的内容。
- 不同的文件 — 名称相同但大小或校验和不同的文件。
- 相同的文件 — 在两个云上确认匹配的文件。
这对迁移验证极为宝贵:在复制数 TB 的数据之后,你可以证明每个文件都完整无误地到达目的地。