Không có hoạt động xử lý nội dung tệp của bạn trên bất kỳ máy chủ nào. Bạn không cần ký thỏa thuận xử lý dữ liệu với gottrix để làm việc với tài liệu mật hay tài liệu công việc.
Hosted in GermanyGlobal Content Delivery
Máy chủ gốc đặt tại Hetzner ở Đức, phân phối trên toàn cầu qua mạng phân phối nội dung (CDN). Nội dung tệp của bạn không bao giờ được truyền đi trong quá trình này - tệp không bao giờ rời khỏi thiết bị của bạn.
Apache Parquet là định dạng nhị phân theo cột nhỏ gọn từ thế giới dữ liệu và phân tích (Spark, pandas, DuckDB, data lake). Tệp .parquet lưu trữ lược đồ nội tuyến, nén từng cột (thường là Snappy) và do đó rất tiết kiệm không gian - nhưng không thể đọc trong trình soạn thảo văn bản thông thường. Công cụ này đọc nội dung Parquet và xuất ra bảng CSV phẳng mà bạn có thể mở trong Excel, LibreOffice, Google Sheets hoặc bất kỳ trình soạn thảo văn bản nào.
Mọi quá trình xử lý đều diễn ra hoàn toàn cục bộ trong trình duyệt của bạn (JavaScript thuần túy, không tải lên, kể cả khi ngoại tuyến). Công cụ đánh giá phần chân trang và các trang cột Parquet, đồng thời hỗ trợ các codec trang phổ biến Snappy, Gzip, Zstd, Brotli và LZ4. Để dữ liệu không bị sai lệch, số nguyên 64-bit vượt quá phạm vi an toàn của JavaScript được xuất dưới dạng chuỗi, dấu thời gian dưới dạng văn bản ISO 8601 và giá trị nhị phân thô dưới dạng base64. Các trường lồng nhau (danh sách, struct) xuất hiện trong ô CSV dưới dạng JSON gọn.
Điều này hữu ích khi một đường ống dữ liệu, bản xuất hoặc công việc phân tích cung cấp cho bạn tệp .parquet và bạn chỉ muốn xem qua nội dung, kiểm tra trong bảng tính hoặc chuyển đến công cụ hỗ trợ CSV. CSV mang tính phổ quát và ngay lập tức có thể đọc được bởi con người. Lưu ý: chuyển đổi một chiều (Parquet sang CSV); không thể chuyển ngược lại thành Parquet, và nén cột Parquet bị mất trong CSV phẳng.
Thông số kỹ thuật
Thông số kỹ thuật
Định dạng đầu vào
PARQUET
Định dạng đầu ra
CSV
Xử lý hàng loạt
Có
Xử lý
Cục bộ trong trình duyệt (WebAssembly)
Tải tệp lên
Không có
Trong 3 bước
Kéo thả hoặc nhấn để chọn tệp Parquet (.parquet) của bạn.
Công cụ đọc lược đồ và các cột cục bộ.
Tải xuống CSV (nhiều tệp dưới dạng ZIP).
Giới hạn: Các tệp Parquet với codec Snappy, Gzip, Zstd, Brotli và LZ4 được hỗ trợ. Tệp Parquet được mã hóa không thể đọc. Các cột lồng nhau (danh sách/struct) hiển thị trong ô dưới dạng JSON. Số nguyên 64-bit lớn xuất hiện dưới dạng chuỗi (độ chính xác), dấu thời gian dưới dạng ISO 8601, giá trị nhị phân dưới dạng base64. Chuyển đổi một chiều (không có CSV ngược lại thành Parquet). Các tệp rất lớn cần bộ nhớ tương ứng.
Câu hỏi thường gặp
Tệp Parquet là gì?
Định dạng nhị phân theo cột nhỏ gọn từ thế giới phân tích (Spark, pandas, DuckDB). Lược đồ và nén được lưu trong tệp.
Tệp của tôi có bị tải lên không?
Không. Quá trình chuyển đổi diễn ra hoàn toàn cục bộ trong trình duyệt - kể cả khi ngoại tuyến.
Những nén nào được hỗ trợ?
Snappy (mặc định), Gzip, Zstd, Brotli và LZ4. Tệp Parquet được mã hóa không thể đọc.
Số lớn và dấu thời gian có được giữ nguyên không?
Số nguyên 64-bit vượt quá phạm vi an toàn của JS được xuất dưới dạng chuỗi, dấu thời gian dưới dạng ISO 8601, giá trị nhị phân dưới dạng base64.
Tôi có thể chuyển đổi CSV ngược lại thành Parquet không?
Không ở đây - công cụ này một chiều (Parquet sang CSV) để kiểm tra và tái sử dụng dữ liệu.
Chỉ khi có sự đồng ý của bạn, chúng tôi mới đo lường mức sử dụng ẩn danh qua cookie để cải thiện gottrix. Tệp của bạn luôn nằm cục bộ trên thiết bị của bạn. Quyền riêng tư