INNER CODE UNIT · Python
query_id
huggingface/transformers-bloom-inference · inference_server/server.py:51
def query_id():
return query_ids.dict(), status.HTTP_200_OK
@app.route("/tokenize/", methods=["POST"])
def tokenize():
try:
x = request.get_json()
x = TokenizeRequest(**x)
response, total_time_taken = run_and_log_time(partial(model.tokenize, request=x))
response.query_id = query_ids.tokenize_query_id
query_ids.tokenize_query_id += 1
response.total_time_taken = "{:.2f} msecs".format(total_time_taken * 1000)
return response.dict(), status.HTTP_200_OK
except Exception: