KumoCert
試験一覧
学習ガイド
料金
ログイン
無料登録
日本語
English
Google Cloud Professional Data Engineer 対策問題集 — 分野別演習
お試し(登録不要)
問題 1 / 5
データ ワークロードの保守と自動化(約18%)
batch pipelineが後段でfilterされるrecordのshuffleに大半時間を使います。 最も適切な対応はどれですか。
測定せずrepeated reshuffleを追加する
可能ならfusionを阻害するoperationを除き、早期にdataを削減して代表inputでbenchmarkする
全aggregationで1 global keyを使う
全full recordをinfo levelでlogする
解答する