Google differenziert die Inference-Preise der Gemini API. Der neue Flex-Tarif senkt die Kosten für unkritische Hintergru...

Google differenziert die Inference-Preise der Gemini API. Der neue Flex-Tarif senkt die Kosten für unkritische Hintergrundaufgaben durch ein Best-Effort-Routing mit bis zu 15 Minuten Latenz um 50 Prozent. Zeitkritische Anwendungen erhalten per Priority-Tarif verbesserte Ressourcenkontingente. Die Steuerung erfolgt direkt per API-Parameter.#Gemini #API #LLM #Google #Newshttps://www.all-ai.de/news/news26/gemini-api-kosten-flex

Read Original

Related