Bảng BigLake là các bảng ngoại lai cho phép truy vấn trực tiếp dữ liệu dạng tệp (như Parquet, ORC, Avro) trên Cloud Storage. Do dữ liệu nằm ngoài BigQuery, mỗi truy vấn phải thực hiện quét danh sách tệp và đọc siêu dữ liệu tệp trên Cloud Storage, gây ra độ trễ cao.
- Để tối ưu hóa hiệu suất và giảm chi phí truy vấn, giải pháp tối ưu nhất là kích hoạt Metadata Caching (Lựa chọn A) trên bảng BigLake. Khi được kích hoạt, BigQuery sẽ lưu trữ tạm thời thông tin metadata của các tệp (như danh sách tệp, kích thước, số lượng dòng) để tránh phải quét trực tiếp trên Cloud Storage cho mỗi câu lệnh, giảm đáng kể thời gian phản hồi của truy vấn.
- Bắt buộc bộ lọc phân vùng (Lựa chọn B) giúp tránh quét toàn bộ bảng nhưng không tối ưu hóa quá trình đọc metadata tệp bên ngoài như cơ chế cache metadata.
(Đáp án được gợi ý bởi AI)