Slackbot
11/22/2022, 7:20 PMYilun Zhang
11/22/2022, 7:33 PMAaron Pham
11/22/2022, 7:57 PMYilun Zhang
11/22/2022, 7:58 PMAaron Pham
11/22/2022, 7:58 PMYilun Zhang
11/22/2022, 8:07 PM2022-11-22T20:06:26+0000 [ERROR] [api_server:2] Exception on /generate-phrases-generic [POST] (trace=a4728477755439c7a2f2756980de6d9b,span=6228acb99fadafd4,sampled=0)
Traceback (most recent call last):
File "/disk1/projects/tzhang/cainet/venv/lib/python3.8/site-packages/bentoml/_internal/server/http_app.py", line 324, in api_func
output = await api.func(input_data)
File "/disk1/projects/tzhang/cainet/bentoml/bentos/cainet_model_server_prod/4ltywcdkowekscga/src/cainet_model_server_api.py", line 338, in generate_phrases_generic
outputs = await generic_translation_runner.generate_phrases.async_run(request_data)
File "/disk1/projects/tzhang/cainet/venv/lib/python3.8/site-packages/bentoml/_internal/runner/runner.py", line 53, in async_run
return await self.runner._runner_handle.async_run_method( # type: ignore
File "/disk1/projects/tzhang/cainet/venv/lib/python3.8/site-packages/bentoml/_internal/runner/runner_handle/remote.py", line 207, in async_run_method
raise ServiceUnavailable(body.decode()) from None
bentoml.exceptions.ServiceUnavailable: Service Busy
2022-11-22 20:06:26,383 - bentoml._internal.server.http_app - ERROR - Exception on /generate-phrases-generic [POST]
Traceback (most recent call last):
File "/disk1/projects/tzhang/cainet/venv/lib/python3.8/site-packages/bentoml/_internal/server/http_app.py", line 324, in api_func
output = await api.func(input_data)
File "/disk1/projects/tzhang/cainet/bentoml/bentos/cainet_model_server_prod/4ltywcdkowekscga/src/cainet_model_server_api.py", line 338, in generate_phrases_generic
outputs = await generic_translation_runner.generate_phrases.async_run(request_data)
File "/disk1/projects/tzhang/cainet/venv/lib/python3.8/site-packages/bentoml/_internal/runner/runner.py", line 53, in async_run
return await self.runner._runner_handle.async_run_method( # type: ignore
File "/disk1/projects/tzhang/cainet/venv/lib/python3.8/site-packages/bentoml/_internal/runner/runner_handle/remote.py", line 207, in async_run_method
raise ServiceUnavailable(body.decode()) from None
bentoml.exceptions.ServiceUnavailable: Service BusyAaron Pham
11/22/2022, 8:07 PMYilun Zhang
11/22/2022, 8:08 PMYilun Zhang
11/22/2022, 8:10 PMrunners:
model1:
resources:
cpu: 4
<http://nvidia.com/gpu|nvidia.com/gpu>: [0, 0, 0, 0]
batching:
enabled: true
max_batch_size: 64
max_latency_ms: 1000
model2:
resources:
cpu: 4
<http://nvidia.com/gpu|nvidia.com/gpu>: [1, 1, 1, 1]
batching:
enabled: true
max_batch_size: 64
max_latency_ms: 1000
model3:
resources:
cpu: 2
<http://nvidia.com/gpu|nvidia.com/gpu>: [2, 2]
batching:
enabled: true
max_batch_size: 32
max_latency_ms: 100
model4:
resources:
cpu: 2
<http://nvidia.com/gpu|nvidia.com/gpu>: [2, 2]
batching:
enabled: true
max_batch_size: 8
max_latency_ms: 100
model 1&2 are slower, model 3 and 4 are fasterRustem Salawat
11/26/2022, 2:45 PMRustem Salawat
11/26/2022, 2:50 PMYilun Zhang
11/26/2022, 3:13 PMYilun Zhang
12/06/2022, 4:37 PMsauyon
12/06/2022, 6:39 PMYilun Zhang
12/06/2022, 7:52 PMsauyon
12/06/2022, 7:56 PMYilun Zhang
12/06/2022, 8:06 PMsauyon
12/06/2022, 8:39 PMYilun Zhang
12/06/2022, 9:12 PMsauyon
12/06/2022, 9:19 PMAaron Pham
12/06/2022, 11:54 PMYilun Zhang
12/07/2022, 12:06 AM