G
Was ist Groq?
Groq betreibt offene Modelle auf eigenen, speziell entwickelten LPU-Chips statt Standard-GPUs und liefert damit Inferenzgeschwindigkeiten, die weit über typischen Cloud-APIs liegen. Eine beliebte Wahl, wenn die Nutzererfahrung einer Anwendung von nahezu sofortigen Modellantworten abhängt.
Wichtigste Funktionen
- Extrem schnelle Token-Generierung im Vergleich zu typischer GPU-Inferenz
- Gehosteter Zugriff auf beliebte offene Modelle wie Llama und Mixtral
- Einfache, OpenAI-kompatible API für leichte Migration
- Kostenloser Tarif, großzügig genug für die meisten Prototypen
- Konstant niedrige Latenz auch unter starker gleichzeitiger Last
Erste Schritte
- Auf groq.com registrieren und einen kostenlosen API-Schlüssel generieren
- Ein gehostetes offenes Modell wählen, das zur Aufgabe passt
- Die API über die OpenAI-kompatible Schnittstelle aufrufen
- Latenz gegen deinen aktuellen Anbieter benchmarken, bevor du wechselst
Groq Kosten
No seat fee. Official production list, September 2026: GPT-OSS 20B $0.075 / $0.30 per 1M; GPT-OSS 120B $0.15 / $0.60; Whisper v3 $0.111/hour, turbo $0.04/hour.
Free tier has org rate limits. Developer unlocks Batch/Flex and higher RPM.
Cache or Batch each cut 50%, not both. Llama 8B/70B: sales only.
| Tarif | Preis | Am besten für |
|---|---|---|
| Free | $0 + org rate limits | Latency tests and light prototypes |
| GPT-OSS 20B | $0.075 / $0.30 per 1M | Fast default text (~1000 t/s) |
| GPT-OSS 120B | $0.15 / $0.60 per 1M | Heavier open-weight quality (~500 t/s) |
| Whisper turbo | $0.04 / audio hour | Cheap transcription |
| Developer / Enterprise | Card or commit | Batch, Flex, leftover Llama SKUs |
Unsere Einschätzung: Groq is a speed and price play on open models, not a frontier-lab catalog. Start on GPT-OSS 20B. If your repo still says Llama 8B Instant, fix the model id before you debug 'the API is down'.
Preise ändern sich häufig. Prüfe die offizielle Seite oben auf aktuelle Konditionen, bevor du dich entscheidest.
Einsatzbereiche
- Echtzeit-Sprachagenten, die nahezu sofortige Antworten brauchen
- Interaktive Anwendungen, bei denen Latenz die UX direkt beeinflusst
- Kosteneffizientes Hosting offener Modelle im großen Maßstab
- Hochdurchsatz-Batch-Verarbeitung mit engen Zeitvorgaben
Groq im Vergleich
| Tool | Im Vergleich |
|---|---|
| Groq | Extrem niedrige Latenz bei Inferenz auf eigener LPU-Hardware. |
| Together AI | breitere Modellauswahl, andere Hardware |
| OpenRouter | routet über viele Anbieter statt nur einen |
Häufige Fragen
Ist Groq kostenlos nutzbar?
Groqs Tarife: Kostenloser Tarif, nutzungsbasierte API-Preise. Preise und Limits kostenloser Tarife ändern sich mit der Zeit, prüfe also die offizielle Website oben für die aktuellsten Details.
Wofür wird Groq genutzt?
Extrem niedrige Latenz bei Inferenz auf eigener LPU-Hardware.
Für wen ist Groq am besten geeignet?
Groq passt gut für Echtzeit-Sprachagenten, die nahezu sofortige Antworten brauchen.
Was sind die Alternativen zu Groq?
Häufig verglichene Alternativen sind Together AI und OpenRouter, siehe den Vergleich oben für die Unterschiede.
Was kostet Groq?
There is no monthly Groq subscription. Self-serve production text is GPT-OSS 20B at $0.075/$0.30 per million tokens or 120B at $0.15/$0.60. A free key exists with rate limits. Llama 3.1 8B and 3.3 70B are no longer on Free/Developer as of 16 August 2026.
Ähnliche Tools
Zuletzt geprüft: 2026-09 · Redaktionell geprüft von AIKetra · Wie wir Tools bewerten
T
O