Databricks Certified Data Engineer Associate Exam (Databricks-Certified-Data-Engineer-Associate日本語版) (Databricks-Certified-Data-Engineer-Associate日本語) Free Practice Test
Question 1
データ エンジニアは、バッチ取り込みパイプラインの一部として次のコード ブロックを使用して、コンポーザブル テーブルから読み取ります。

トランザクション テーブルがストリーム ソースである場合にこのコード ブロックが機能するには、次のどの変更を加える必要がありますか。

トランザクション テーブルがストリーム ソースである場合にこのコード ブロックが機能するには、次のどの変更を加える必要がありますか。
Correct Answer: D
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).
Question 2
データ エンジニアには複雑な実行スケジュールを持つジョブがあり、そのスケジュールを他のジョブに転送したいと考えています。
データ エンジニアは、Databricks のスケジュール フォームで各値を手動で選択するのではなく、次のどのツールを使用してプログラムでスケジュールを表し、送信できますか。
データ エンジニアは、Databricks のスケジュール フォームで各値を手動で選択するのではなく、次のどのツールを使用してプログラムでスケジュールを表し、送信できますか。
Correct Answer: B
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).
Question 3
次のSQLキーワードのうち、テーブルをロング形式からワイド形式に変換するために使用できるものはどれですか?
Correct Answer: C
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).
Question 4
データエンジニアが、2つの異なるパイプライン障害のトラブルシューティングを行っています。
パイプライン A は、100 GB のデータセットに対して display(df.collect()) が呼び出された直後に java.lang.OutOfMemoryError で失敗します。
パイプラインBは、2つの大きなテーブルを結合する大規模な変換処理中に失敗し、シャッフル中にエグゼキュータのメモリが枯渇したことを示すExecutorLostFailureメッセージが表示されました。データエンジニアは、これら2つの問題に対処するために、
どのような行動をとるべきでしょうか?
パイプライン A は、100 GB のデータセットに対して display(df.collect()) が呼び出された直後に java.lang.OutOfMemoryError で失敗します。
パイプラインBは、2つの大きなテーブルを結合する大規模な変換処理中に失敗し、シャッフル中にエグゼキュータのメモリが枯渇したことを示すExecutorLostFailureメッセージが表示されました。データエンジニアは、これら2つの問題に対処するために、
どのような行動をとるべきでしょうか?
Correct Answer: B
Question 5
ブロンズ テーブルと生データの関係を説明するのは次のどれですか。
Correct Answer: A
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).
Question 6
データエンジニアリングチームは、SQLデータベース、Amazon S3、Apache Kafkaストリームという3つの企業内ソースから顧客取引データを取り込みます。データはデータ系列を維持し、過去のスナップショットへのアクセスを必要とするコンプライアンス監査に対応する必要があります。
Lakeflow Connectのどの構成が、ガバナンス要件と監査要件の両方を満たしますか?
Lakeflow Connectのどの構成が、ガバナンス要件と監査要件の両方を満たしますか?
Correct Answer: B
Question 7
データエンジニアは、Delta Live Tables(DLT)パイプラインに3つのテーブルを配置しています。各テーブルで無効なレコードを削除するようにパイプラインを設定しています。DLTパイプラインのどこかの時点で、品質上の懸念から一部のデータが削除されていることに気付きました。パイプラインのどのテーブルでデータが削除されているのかを特定したいと考えています。
データ エンジニアがレコードを削除しているテーブルを識別するために実行できるアプローチは次のどれですか。
データ エンジニアがレコードを削除しているテーブルを識別するために実行できるアプローチは次のどれですか。
Correct Answer: A
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).
Question 8
データ エンジニアは、フランスに住む顧客の名前を含む新しいテーブルを作成したいと考えています。
彼らは次のコマンドを書きました:

上級データ エンジニアは、新しいテーブルに個人を特定できる情報 (PII) が含まれていることを示すテーブル プロパティを含めることが組織のポリシーであると述べています。
次のコード行のうち、上記の空白を埋めてタスクを正常に完了するものはどれですか?
彼らは次のコマンドを書きました:

上級データ エンジニアは、新しいテーブルに個人を特定できる情報 (PII) が含まれていることを示すテーブル プロパティを含めることが組織のポリシーであると述べています。
次のコード行のうち、上記の空白を埋めてタスクを正常に完了するものはどれですか?
Correct Answer: B
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).
Question 9
データエンジニアがDatabricksワークスペース内にPythonノートブックを作成し、日々の売上データを処理するスケジュールジョブとして実行するように設定しました。
Databricksアーキテクチャ内で、このノートブックの保存と実行はどのように管理されていますか?
Databricksアーキテクチャ内で、このノートブックの保存と実行はどのように管理されていますか?
Correct Answer: A
Question 10
データエンジニアが、データレイクから大量の生JSONログをデルタテーブルに処理してレポートを作成する、夜間バッチETLパイプラインを構築しています。データは1日に1回まとめて到着し、パイプラインの完了には数時間かかります。コスト効率も重要ですが、パフォーマンスとパイプラインの確実な完了が最優先事項です。
データエンジニアはどのタイプのDatabricksクラスターを構成すべきでしょうか?
データエンジニアはどのタイプのDatabricksクラスターを構成すべきでしょうか?
Correct Answer: D
Explanation: Only visible for TestSimulate members. You can sign-up / login (it's free).