Quay lại bộ đề
Question #121 Topic 1
Your company needs to upload their historic data to Cloud Storage. The security rules don't allow access from external IPs to their on-premises resources. After an initial upload, they will add new data from existing on-premises applications every day. What should they do?
Công ty của bạn cần tải dữ liệu lịch sử của họ lên Cloud Storage. Các quy tắc bảo mật không cho phép truy cập từ các IP bên ngoài vào các tài nguyên tại chỗ (on-premises) của họ. Sau lần tải lên ban đầu, họ sẽ thêm dữ liệu mới từ các ứng dụng tại chỗ hiện có mỗi ngày. Họ nên làm gì?
A
Execute gsutil rsync from the on-premises servers.
Chạy lệnh gsutil rsync từ các máy chủ tại chỗ.
B
Use Dataflow and write the data to Cloud Storage.
Sử dụng Dataflow và ghi dữ liệu vào Cloud Storage.
C
Write a job template in Dataproc to perform the data transfer.
Viết một job template trong Dataproc để thực hiện việc truyền dữ liệu.
D
Install an FTP server on a Compute Engine VM to receive the files and move them to Cloud Storage.
Cài đặt một máy chủ FTP trên một máy ảo Compute Engine để nhận các tệp và chuyển chúng vào Cloud Storage.
Giải thích & Tài liệu tham khảo
Câu hỏi đặt ra yêu cầu tải dữ liệu lịch sử lên Cloud Storage từ các tài nguyên tại chỗ (on-premises) mà không cho phép truy cập từ IP bên ngoài, và sau đó thêm dữ liệu mới hàng ngày.
- A. Chạy lệnh gsutil rsync từ các máy chủ tại chỗ: Đây là lựa chọn phù hợp nhất.
gsutil rsynclà một công cụ mạnh mẽ để đồng bộ hóa dữ liệu giữa hệ thống tệp cục bộ và Cloud Storage. Quan trọng hơn,gsutilhỗ trợ truy cập riêng tư (Private Google Access) thông qua Cloud VPN hoặc Cloud Interconnect, cho phép các máy chủ tại chỗ kết nối trực tiếp với Cloud Storage mà không cần đi qua Internet công cộng. Điều này đáp ứng yêu cầu an ninh "không cho phép truy cập từ IP bên ngoài". Sau đó,gsutil rsynccó thể dễ dàng được lên lịch để chạy hàng ngày để đồng bộ hóa dữ liệu mới. - B. Sử dụng Dataflow và ghi dữ liệu vào Cloud Storage: Dataflow là một dịch vụ xử lý dữ liệu mạnh mẽ, nhưng nó thường được sử dụng để xử lý dữ liệu stream hoặc batch với các biến đổi phức tạp. Để chỉ đơn thuần chuyển dữ liệu từ tại chỗ lên Cloud Storage, việc thiết lập Dataflow là không cần thiết và quá phức tạp.
- C. Viết một job template trong Dataproc để thực hiện việc truyền dữ liệu: Sử dụng Dataproc chỉ để chuyển dữ liệu từ on-premises lên Cloud Storage là quá mức cần thiết và không phải là cách sử dụng hiệu quả nhất của dịch vụ này. Nó làm tăng thêm chi phí và sự phức tạp không cần thiết.
- D. Cài đặt một máy chủ FTP trên một máy ảo Compute Engine để nhận các tệp và chuyển chúng vào Cloud Storage: Mặc dù về mặt kỹ thuật có thể thực hiện được, nhưng đây là một giải pháp kém hiệu quả và không an toàn. Nó không giải quyết được yêu cầu "không cho phép truy cập từ IP bên ngoài" một cách trực tiếp nếu không có VPN hoặc Interconnect, và trong trường hợp đó thì
gsutil rsyncvẫn là lựa chọn tốt hơn.
(Đáp án được gợi ý bởi AI)