GET Serves Cache, POST Runs Inference: Cost Safety for a Public LLM Endpoint

I built a site that gives deliberately wrong answers using an LLM. No login. No user API key. Anyone...

Read Original

Related