From 5d2e2532e76d84c5512d349fd25020018e9be51a Mon Sep 17 00:00:00 2001 From: Simon Mo Date: Wed, 29 Apr 2020 09:32:39 -0700 Subject: [PATCH] Fix Serve long running test (#8223) --- ci/long_running_tests/workloads/serve.py | 12 +++++------- 1 file changed, 5 insertions(+), 7 deletions(-) diff --git a/ci/long_running_tests/workloads/serve.py b/ci/long_running_tests/workloads/serve.py index 68ad274cc..6477fa8b4 100644 --- a/ci/long_running_tests/workloads/serve.py +++ b/ci/long_running_tests/workloads/serve.py @@ -36,7 +36,6 @@ ray.init(address=cluster.address, include_webui=True, webui_host="0.0.0.0") serve.init(blocking=True, kv_store_connector=lambda ns: RayInternalKVStore(ns)) -@serve.route("/echo") @serve.accept_batch def echo(_): time.sleep(0.01) # Sleep for 10ms @@ -44,15 +43,14 @@ def echo(_): return ["hi {}".format(i) for i in range(serve.context.batch_size)] -print("Scaling to 30 replicas") -config = serve.get_backend_config("echo:v0") -config.num_replicas = 30 -config.max_batch_size = 16 -serve.set_backend_config("echo:v0", config) +serve.create_endpoint("echo", "/echo") +config = serve.BackendConfig(num_replicas=30, max_batch_size=16) +serve.create_backend(echo, "echo:v1", backend_config=config) +serve.set_traffic("echo", {"echo:v1": 1}) print("Warming up") for _ in range(5): - resp = requests.get("http://127.0.0.1:8000/echo").json() + resp = requests.get("http://127.0.0.1:8000/echo").text print(resp) time.sleep(0.5)