INNER CODE UNIT · Python
x
huggingface/transformers-bloom-inference · inference_server/server.py:59
x = TokenizeRequest(**x)
response, total_time_taken = run_and_log_time(partial(model.tokenize, request=x))
response.query_id = query_ids.tokenize_query_id
query_ids.tokenize_query_id += 1
response.total_time_taken = "{:.2f} msecs".format(total_time_taken * 1000)
return response.dict(), status.HTTP_200_OK
except Exception:
response = get_exception_response(query_ids.tokenize_query_id, args.debug)
query_ids.tokenize_query_id += 1
return response, status.HTTP_500_INTERNAL_SERVER_ERROR
@app.route("/generate/", methods=["POST"])
def generate():
try: