6 Min. Lesezeit • Getestet von Florian Schröder
Google Gemini Flash 3.8: 4 Millionen Tokens Megakontext bei 140 ms Inferenz
Google DeepMind bricht alle Geschwindigkeits- und Kontext-Rekorde: Gemini Flash 3.8 verarbeitet 4 Millionen Tokens in Echtzeit bei Inferenzkosten von nur $0.15 pro Million Tokens.