vi

Parquet sang CSV

Chuyển đổi tệp Apache Parquet (.parquet) thành bảng CSV cục bộ - dữ liệu cột trở nên dễ đọc, không tải lên, ngay trong trình duyệt của bạn.

Đang xử lý cục bộ trên thiết bị của bạn ...

Đang xử lý cục bộ trên thiết bị của bạn ...

0%

Tệp của tôi có bị tải lên không?

Không. Mọi thứ chạy trong trình duyệt của bạn - tệp của bạn không bao giờ rời khỏi thiết bị. Cách kiểm chứng điều này

Không tải lên100% cục bộ
Nội dung ở lại với bạnkhông ai khác chạm tới
Hosted in GermanyGlobal Content Delivery
Kiểm định độc lậpTLS A+ · HTTP header A+

Apache Parquet là định dạng nhị phân theo cột nhỏ gọn từ thế giới dữ liệu và phân tích (Spark, pandas, DuckDB, data lake). Tệp .parquet lưu trữ lược đồ nội tuyến, nén từng cột (thường là Snappy) và do đó rất tiết kiệm không gian - nhưng không thể đọc trong trình soạn thảo văn bản thông thường. Công cụ này đọc nội dung Parquet và xuất ra bảng CSV phẳng mà bạn có thể mở trong Excel, LibreOffice, Google Sheets hoặc bất kỳ trình soạn thảo văn bản nào.

Mọi quá trình xử lý đều diễn ra hoàn toàn cục bộ trong trình duyệt của bạn (JavaScript thuần túy, không tải lên, kể cả khi ngoại tuyến). Công cụ đánh giá phần chân trang và các trang cột Parquet, đồng thời hỗ trợ các codec trang phổ biến Snappy, Gzip, Zstd, Brotli và LZ4. Để dữ liệu không bị sai lệch, số nguyên 64-bit vượt quá phạm vi an toàn của JavaScript được xuất dưới dạng chuỗi, dấu thời gian dưới dạng văn bản ISO 8601 và giá trị nhị phân thô dưới dạng base64. Các trường lồng nhau (danh sách, struct) xuất hiện trong ô CSV dưới dạng JSON gọn.

Điều này hữu ích khi một đường ống dữ liệu, bản xuất hoặc công việc phân tích cung cấp cho bạn tệp .parquet và bạn chỉ muốn xem qua nội dung, kiểm tra trong bảng tính hoặc chuyển đến công cụ hỗ trợ CSV. CSV mang tính phổ quát và ngay lập tức có thể đọc được bởi con người. Lưu ý: chuyển đổi một chiều (Parquet sang CSV); không thể chuyển ngược lại thành Parquet, và nén cột Parquet bị mất trong CSV phẳng.

Thông số kỹ thuật

Thông số kỹ thuật
Định dạng đầu vàoPARQUET
Định dạng đầu raCSV
Xử lý hàng loạt
Xử lýCục bộ trong trình duyệt (WebAssembly)
Tải tệp lênKhông có

Trong 3 bước

  1. Kéo thả hoặc nhấn để chọn tệp Parquet (.parquet) của bạn.
  2. Công cụ đọc lược đồ và các cột cục bộ.
  3. Tải xuống CSV (nhiều tệp dưới dạng ZIP).

Giới hạn: Các tệp Parquet với codec Snappy, Gzip, Zstd, Brotli và LZ4 được hỗ trợ. Tệp Parquet được mã hóa không thể đọc. Các cột lồng nhau (danh sách/struct) hiển thị trong ô dưới dạng JSON. Số nguyên 64-bit lớn xuất hiện dưới dạng chuỗi (độ chính xác), dấu thời gian dưới dạng ISO 8601, giá trị nhị phân dưới dạng base64. Chuyển đổi một chiều (không có CSV ngược lại thành Parquet). Các tệp rất lớn cần bộ nhớ tương ứng.

Câu hỏi thường gặp

Tệp Parquet là gì?

Định dạng nhị phân theo cột nhỏ gọn từ thế giới phân tích (Spark, pandas, DuckDB). Lược đồ và nén được lưu trong tệp.

Tệp của tôi có bị tải lên không?

Không. Quá trình chuyển đổi diễn ra hoàn toàn cục bộ trong trình duyệt - kể cả khi ngoại tuyến.

Những nén nào được hỗ trợ?

Snappy (mặc định), Gzip, Zstd, Brotli và LZ4. Tệp Parquet được mã hóa không thể đọc.

Số lớn và dấu thời gian có được giữ nguyên không?

Số nguyên 64-bit vượt quá phạm vi an toàn của JS được xuất dưới dạng chuỗi, dấu thời gian dưới dạng ISO 8601, giá trị nhị phân dưới dạng base64.

Tôi có thể chuyển đổi CSV ngược lại thành Parquet không?

Không ở đây - công cụ này một chiều (Parquet sang CSV) để kiểm tra và tái sử dụng dữ liệu.

Công cụ liên quan

Parquet sang JSON · Arrow sang CSV · CSV sang JSON · TOML sang XML · Ảnh sang CBZ · Arrow sang JSON