docs/serving/online_serving/renderer.md
Our renderer API is designed to disaggregate the render phase(preprocessing) and enable a token-in / token-out API server.
/v1/completions/render)
/v1/chat/completions/render)
For the post processing counterpart that turns generated token IDs back into OpenAI compatible responses, see the Derenderer APIs.