Proponi uno strumento →
Groq logoG

Groq

di Groq

Inferenza a latenza ultra-bassa su hardware LPU proprietario.

API dei Modelli & Infrastruttura Piano gratuito, prezzi API a consumo

Cos'è Groq?

Groq esegue modelli open source sui propri chip LPU proprietari invece delle GPU standard, offrendo velocità di inferenza molto superiori alle tipiche API cloud. È una scelta diffusa quando l'esperienza utente di un'applicazione dipende da risposte del modello quasi istantanee.

Funzionalità principali

  • Generazione di token estremamente veloce rispetto alla tipica inferenza su GPU
  • Accesso hosted a modelli open source diffusi come Llama e Mixtral
  • API semplice, compatibile con OpenAI, per una migrazione facile
  • Piano gratuito abbastanza generoso per prototipare la maggior parte delle applicazioni
  • Latenza bassa e costante anche sotto carico concorrente elevato

Come iniziare

  1. Registrati su groq.com e genera una chiave API gratuita
  2. Scegli un modello open source hosted adatto alla tua attività
  3. Chiama l'API usando l'interfaccia compatibile con OpenAI
  4. Confronta la latenza con il tuo provider attuale prima di passare a Groq

Groq Prezzi

No seat fee. Official production list, September 2026: GPT-OSS 20B $0.075 / $0.30 per 1M; GPT-OSS 120B $0.15 / $0.60; Whisper v3 $0.111/hour, turbo $0.04/hour.

Free tier has org rate limits. Developer unlocks Batch/Flex and higher RPM.

Cache or Batch each cut 50%, not both. Llama 8B/70B: sales only.

PianoPrezzoIdeale per
Free$0 + org rate limitsLatency tests and light prototypes
GPT-OSS 20B$0.075 / $0.30 per 1MFast default text (~1000 t/s)
GPT-OSS 120B$0.15 / $0.60 per 1MHeavier open-weight quality (~500 t/s)
Whisper turbo$0.04 / audio hourCheap transcription
Developer / EnterpriseCard or commitBatch, Flex, leftover Llama SKUs

La nostra opinione: Groq is a speed and price play on open models, not a frontier-lab catalog. Start on GPT-OSS 20B. If your repo still says Llama 8B Instant, fix the model id before you debug 'the API is down'.

I prezzi cambiano spesso. Controlla il sito ufficiale sopra per le condizioni attuali prima di decidere.

Casi d'uso

  • Agenti vocali in tempo reale che richiedono risposte quasi istantanee
  • Applicazioni interattive dove la latenza influisce direttamente sulla UX
  • Hosting economicamente vantaggioso di modelli open-weight su larga scala
  • Elaborazione batch ad alto throughput con vincoli di tempo stretti

Groq a confronto

StrumentoConfronto
GroqInferenza a latenza ultra-bassa su hardware LPU proprietario.
Together AIselezione di modelli più ampia, hardware diverso
OpenRouterinstrada tra molti provider invece che uno solo

Domande frequenti

Groq è gratuito?

I piani di Groq: Piano gratuito, prezzi API a consumo. Prezzi e limiti del piano gratuito cambiano nel tempo, quindi controlla il sito ufficiale sopra per i dettagli più aggiornati.

A cosa serve Groq?

Inferenza a latenza ultra-bassa su hardware LPU proprietario.

Per chi è più indicato Groq?

Groq è indicato per Agenti vocali in tempo reale che richiedono risposte quasi istantanee.

Quali sono le alternative a Groq?

Le alternative più confrontate sono Together AI e OpenRouter, guarda il confronto sopra per le differenze.

Quanto costa Groq?

There is no monthly Groq subscription. Self-serve production text is GPT-OSS 20B at $0.075/$0.30 per million tokens or 120B at $0.15/$0.60. A free key exists with rate limits. Llama 3.1 8B and 3.3 70B are no longer on Free/Developer as of 16 August 2026.

Strumenti simili

Ultima verifica: 2026-09 · Verificato dalla redazione di AIKetra · Come valutiamo gli strumenti