Skip to main content

generation_init

Signature
Function
  • Initializes inference backend and sampling parameters.
  • Supports vllm, openai, hf backends.
  • extra_params can be used to pass chat_template_kwargs or other backend-specific parameters.

generate

Signature
Function
  • Plain text conversation generation.
  • Automatically handles Prompt in list, supports string or OpenAI format dictionary.
Output Format (JSON)

multimodal_generate

Signature
Function
  • Text-image multimodal conversation generation.
  • multimodal_path: List of image paths corresponding to each Prompt (supports local path or URL).
  • image_tag: If specified (e.g., <img>), inserts image at that tag’s position in Prompt; otherwise defaults to appending to end of Prompt.
Output Format (JSON)

multiturn_generate

Signature
Function
  • Multi-turn conversation generation.
  • Supports only single-call generation, does not handle batch Prompts.
Output Format (JSON)

vllm_shutdown

Signature
Function
  • Explicitly shuts down vLLM engine and releases VRAM resources.
  • Valid only when using vllm backend.

Configuration

servers/generation/parameter.yaml
Parameter Description: backend_configs Detailed Description: sampling_params Detailed Description: