From 002531b199aaeb40d267b4ac50dbc7ae7689da1b Mon Sep 17 00:00:00 2001 From: Luke Date: Sat, 2 Feb 2019 17:38:02 -0500 Subject: [PATCH] Enable LZ4 compression in pyarrow build (#3931) Enable LZ4 compression in pyarrow build --- cmake/Modules/ArrowExternalProject.cmake | 2 +- test/runtest.py | 5 +++++ 2 files changed, 6 insertions(+), 1 deletion(-) diff --git a/cmake/Modules/ArrowExternalProject.cmake b/cmake/Modules/ArrowExternalProject.cmake index 9726d9324..f691d990b 100644 --- a/cmake/Modules/ArrowExternalProject.cmake +++ b/cmake/Modules/ArrowExternalProject.cmake @@ -58,7 +58,7 @@ set(ARROW_CMAKE_ARGS -DARROW_TENSORFLOW=on -DARROW_JEMALLOC=off -DARROW_WITH_BROTLI=off - -DARROW_WITH_LZ4=off + -DARROW_WITH_LZ4=on -DARROW_WITH_ZSTD=off -DFLATBUFFERS_HOME=${FLATBUFFERS_HOME} -DBOOST_ROOT=${BOOST_ROOT} diff --git a/test/runtest.py b/test/runtest.py index 4bf1f1b33..b280d7fc0 100644 --- a/test/runtest.py +++ b/test/runtest.py @@ -2601,10 +2601,15 @@ def test_pandas_parquet_serialization(): pytest.importorskip("pandas") import pandas as pd + import pyarrow as pa + import pyarrow.parquet as pq tempdir = tempfile.mkdtemp() filename = os.path.join(tempdir, "parquet-test") pd.DataFrame({"col1": [0, 1], "col2": [0, 1]}).to_parquet(filename) + with open(os.path.join(tempdir, "parquet-compression"), "wb") as f: + table = pa.Table.from_arrays([pa.array([1, 2, 3])], ["hello"]) + pq.write_table(table, f, compression="lz4") # Clean up shutil.rmtree(tempdir)