INNER CODE UNIT · Python
generate
ai-infra-curriculum/ai-infra-engineer-learning · projects/project-103-llm-deployment/src/llm/server.py:134
async def generate(
self,
prompt: str,
max_tokens: int = 512,
temperature: float = 0.7,
top_p: float = 0.9,
top_k: int = 50,
stream: bool = False,
**kwargs
) -> Union[str, AsyncGenerator[str, None]]:
"""
Generate text from a prompt.
Args:
prompt: Input text prompt
max_tokens: Maximum tokens to generate
temperature: Sampling temperature (0.0-2.0)
top_p: Nucleus sampling parameter