0

0

使用 GCP BlobWriter 正确格式化 CSV 文件

DDD

DDD

发布时间:2025-09-27 18:24:02

|

942人浏览过

|

来源于php中文网

原创

使用 gcp blobwriter 正确格式化 csv 文件

本文旨在解决在使用 GCP BlobWriter 将字典列表数据写入 CSV 文件时,出现 JSON 格式而非 CSV 格式的问题。通过引入 csv 模块,定义字段名,并逐行构建 CSV 数据,确保数据以正确的 CSV 格式写入 Google Cloud Storage 桶。本文将提供详细的代码示例和步骤,帮助开发者避免常见的格式化错误。

在使用 Google Cloud Storage (GCS) 的 BlobWriter 将数据写入 CSV 文件时,如果数据源是字典列表,直接使用 json.dumps 可能会导致输出格式为 JSON 而非预期的 CSV 格式。这是因为 BlobWriter 只是简单地将传入的字节流写入文件,而不会自动进行 CSV 格式化。要正确地将字典列表数据写入 CSV 文件,需要使用 csv 模块进行格式化。

解决方案

以下是一个示例代码,展示了如何使用 csv 模块和 BlobWriter 将字典列表数据正确地写入 CSV 文件:

import csv
from google.cloud import storage

# 假设 defaults.bucket 是已经初始化的 GCS Bucket 对象
# 例如:
# client = storage.Client()
# bucket = client.get_bucket("your-bucket-name")
# defaults = SimpleNamespace(bucket=bucket) # 简化写法,实际根据你的情况调整

def write_data_to_csv(bucket, filename, data):
    """
    将字典列表数据以 CSV 格式写入 GCS 桶。

    Args:
        bucket: GCS Bucket 对象.
        filename: 要写入的文件名 (包含路径).
        data: 字典列表,每个字典代表一行数据.
    """

    blob = bucket.blob(filename)
    with blob.open("wb") as f:
        writer = csv.writer(f)

        # 假设 data 中的字典结构一致,取第一个字典的 key 作为 header
        if data:
            header = data[0].keys()
            writer.writerow(header)

            for row in data:
                writer.writerow(row.values())
        else:
            print("No data to write.")


# 示例用法
if __name__ == '__main__':
    # 模拟数据
    data = [
        {'name': 'Alice', 'age': 30, 'city': 'New York'},
        {'name': 'Bob', 'age': 25, 'city': 'Los Angeles'},
        {'name': 'Charlie', 'age': 35, 'city': 'Chicago'}
    ]

    # 你的 bucket name
    bucket_name = "your-bucket-name"
    client = storage.Client()
    bucket = client.get_bucket(bucket_name)

    # 设置文件名
    filename = "output.csv"

    # 写入数据
    write_data_to_csv(bucket, filename, data)

    print(f"CSV file '{filename}' successfully written to '{bucket_name}'.")

代码解释

SeoShop
SeoShop

SeoShop网店系统全站纯静态html生成更符合搜索引擎优化,并修改了以前许多js代码,取消了连接地址的js代码更换为纯div+css格式,并且所有文件可自定义url和文件名,自定义内部连接,自定义外部连接,等多个符合SEO搜索引擎优化的设置,让您的网店更容易让搜索引擎收录. 简单易用 极速网店真正做到以人为本、以用户体验为中心,能使您快速搭建网上购物网站。后台管理操作简单,一目了然,没有夹杂多

下载
  1. 导入 csv 模块: import csv 导入 Python 的 CSV 处理模块。
  2. 定义字段名: field_names = ['key1', 'key2', 'key3'] 定义 CSV 文件的表头,需要根据实际数据字典的键来设置。确保字段名的顺序与后续数据写入的顺序一致。
  3. 创建 csv.writer 对象: 使用 csv.writer(f) 创建一个 CSV 写入器,f 是文件对象。
  4. 写入表头: writer.writerow(header) 将表头写入 CSV 文件。
  5. 循环处理数据: 遍历 result.get('events') 中的每个字典。
  6. 构建 CSV 行: 使用列表推导式 [str(_source.get(key, '')) for key in field_names] 根据字段名从字典中提取值,并将其转换为字符串。_source.get(key, '') 用于处理字典中可能缺少某些字段的情况,如果字段不存在,则使用空字符串代替。
  7. 写入 CSV 行: writer.writerow(row.values()) 将构建好的 CSV 行写入文件。

注意事项

  • 字段名定义: 确保 field_names 列表中的字段名与字典中的键完全匹配,顺序也要一致。
  • 数据类型转换: 在构建 CSV 行时,需要将所有值转换为字符串,以避免写入错误。
  • 编码问题: 确保使用正确的编码格式,通常使用 utf-8 编码。
  • 错误处理: 添加适当的错误处理机制,例如捕获 KeyError 异常,以处理字典中缺少字段的情况。
  • GCS Bucket 初始化: 确保正确初始化 GCS Bucket 对象,并具有写入权限。
  • 依赖安装: 确保安装了 google-cloud-storage 库:pip install google-cloud-storage

总结

通过使用 csv 模块,可以方便地将字典列表数据以正确的 CSV 格式写入 GCS 桶。关键在于定义正确的字段名,并逐行构建 CSV 数据。 遵循上述步骤和注意事项,可以避免常见的格式化错误,确保数据以预期的 CSV 格式存储在 Google Cloud Storage 中。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
json数据格式
json数据格式

JSON是一种轻量级的数据交换格式。本专题为大家带来json数据格式相关文章,帮助大家解决问题。

420

2023.08.07

json是什么
json是什么

JSON是一种轻量级的数据交换格式,具有简洁、易读、跨平台和语言的特点,JSON数据是通过键值对的方式进行组织,其中键是字符串,值可以是字符串、数值、布尔值、数组、对象或者null,在Web开发、数据交换和配置文件等方面得到广泛应用。本专题为大家提供json相关的文章、下载、课程内容,供大家免费下载体验。

536

2023.08.23

jquery怎么操作json
jquery怎么操作json

操作的方法有:1、“$.parseJSON(jsonString)”2、“$.getJSON(url, data, success)”;3、“$.each(obj, callback)”;4、“$.ajax()”。更多jquery怎么操作json的详细内容,可以访问本专题下面的文章。

313

2023.10.13

go语言处理json数据方法
go语言处理json数据方法

本专题整合了go语言中处理json数据方法,阅读专题下面的文章了解更多详细内容。

77

2025.09.10

pip安装使用方法
pip安装使用方法

安装步骤:1、确保Python已经正确安装在您的计算机上;2、下载“get-pip.py”脚本;3、按下Win + R键,然后输入cmd并按下Enter键来打开命令行窗口;4、在命令行窗口中,使用cd命令切换到“get-pip.py”所在的目录;5、执行安装命令;6、验证安装结果即可。大家可以访问本专题下的文章,了解pip安装使用方法的更多内容。

340

2023.10.09

更新pip版本
更新pip版本

更新pip版本方法有使用pip自身更新、使用操作系统自带的包管理工具、使用python包管理工具、手动安装最新版本。想了解更多相关的内容,请阅读专题下面的文章。

416

2024.12.20

pip设置清华源
pip设置清华源

设置方法:1、打开终端或命令提示符窗口;2、运行“touch ~/.pip/pip.conf”命令创建一个名为pip的配置文件;3、打开pip.conf文件,然后添加“[global];index-url = https://pypi.tuna.tsinghua.edu.cn/simple”内容,这将把pip的镜像源设置为清华大学的镜像源;4、保存并关闭文件即可。

761

2024.12.23

python升级pip
python升级pip

本专题整合了python升级pip相关教程,阅读下面的文章了解更多详细内容。

351

2025.07.23

2026赚钱平台入口大全
2026赚钱平台入口大全

2026年最新赚钱平台入口汇总,涵盖任务众包、内容创作、电商运营、技能变现等多类正规渠道,助你轻松开启副业增收之路。阅读专题下面的文章了解更多详细内容。

54

2026.01.31

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
最新Python教程 从入门到精通
最新Python教程 从入门到精通

共4课时 | 22.4万人学习

Django 教程
Django 教程

共28课时 | 3.7万人学习

SciPy 教程
SciPy 教程

共10课时 | 1.3万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号