Athena/Glue - 将简单的JSON解析(但将其视为CSV)
创始人
2024-09-21 13:00:24
0

要将简单的JSON解析为CSV格式,您可以使用AWS的Athena和Glue服务。以下是解决方案的步骤和代码示例:

  1. 创建表和数据库:在Athena中创建一个数据库和表,用于存储解析后的JSON数据。
CREATE DATABASE IF NOT EXISTS mydatabase;
USE mydatabase;

CREATE EXTERNAL TABLE IF NOT EXISTS mytable (
  col1 string,
  col2 int,
  col3 string
)
ROW FORMAT SERDE 'org.openx.data.jsonserde.JsonSerDe'
WITH SERDEPROPERTIES (
  'serialization.format' = '1'
) LOCATION 's3://mybucket/myfolder/'
TBLPROPERTIES ('has_encrypted_data'='false');
  1. 创建ETL脚本:使用Glue创建一个ETL脚本,将JSON数据转换成CSV格式,并将其加载到Athena中。
import sys
from awsglue.transforms import *
from awsglue.utils import getResolvedOptions
from pyspark.context import SparkContext
from awsglue.context import GlueContext
from awsglue.job import Job

args = getResolvedOptions(sys.argv, ['JOB_NAME'])
sc = SparkContext()
glueContext = GlueContext(sc)
spark = glueContext.spark_session
job = Job(glueContext)
job.init(args['JOB_NAME'], args)

datasource0 = glueContext.create_dynamic_frame.from_catalog(database = "mydatabase", table_name = "mytable")
applymapping1 = ApplyMapping.apply(frame = datasource0, mappings = [("col1", "string", "col1", "string"), ("col2", "int", "col2", "int"), ("col3", "string", "col3", "string")], transformation_ctx = "applymapping1")
resolvechoice2 = ResolveChoice.apply(frame = applymapping1, choice = "make_cols", transformation_ctx = "resolvechoice2")
dropnullfields3 = DropNullFields.apply(frame = resolvechoice2, transformation_ctx = "dropnullfields3")
datasink4 = glueContext.write_dynamic_frame.from_catalog(frame = dropnullfields3, database = "mydatabase", table_name = "mytable_csv", transformation_ctx = "datasink4")

job.commit()
  1. 运行ETL脚本:将ETL脚本上传到AWS Glue,并运行它以将JSON数据转换为CSV格式并加载到Athena中。

  2. 查询数据:在Athena中查询转换后的CSV数据。

SELECT * FROM mydatabase.mytable_csv;

以上是使用Athena和Glue将简单的JSON解析为CSV格式的解决方案和代码示例。您可以根据您的具体需求和JSON结构进行适当的调整。

相关内容

热门资讯

黑科技科技(wepoke智能a... 黑科技科技(wepoke智能ai)wepower使用说明书(wepOkE)素来是真的有挂(确实有挂)...
黑科技模拟器(wepoke智能... WePoker透视辅助工具核心要点解析‌,黑科技模拟器(wepoke智能ai)wepoke是机器发牌...
黑科技脚本(wepokeai代... 您好,这款游戏可以开挂的,确实是有挂的,需要了解加微【136704302】很多玩家在这款游戏中打牌都...
黑科技辅助挂(wepoke真的... 黑科技辅助挂(wepoke真的有挂)wepoke 软件(wEPOKE)固有真的有挂(有挂猫腻)-哔哩...
黑科技辅助挂(wepoke黑科... 黑科技辅助挂(wepoke黑科技)wepoke软件透明挂演示(wEpOke)一直真的有挂(真的有挂)...
黑科技app(wepoke真的... 此外,数据分析德州()辅助神器app还具备辅助透视行为开挂功能,通过对客户透明挂的深入研究,你可以了...
黑科技智能ai(wepoke辅... 黑科技智能ai(wepoke辅助插件)wepoke软件透明(WEPOke)先前是有挂(果真有挂)-哔...
黑科技模拟器(wepoke透明... 黑科技模拟器(wepoke透明黑科技)wepoke德州扑克用ai代打(WEPOKE)最初存在有挂(有...
黑科技插件(wepoke辅助插... 黑科技插件(wepoke辅助插件)wepoke软件透明(WEPOke)从来是真的有挂(有挂解惑)-哔...
黑科技美元局(wepoke智能... 黑科技美元局(wepoke智能ai)wepoke辅助真的假的(wepoKE)原先真的有挂(竟然有挂)...