Groq
O Groq é uma plataforma de inferência que roda modelos de IA abertos com latência muito baixa. Não tem relação com o Grok, da xAI.
O Groq é uma integração nativa do NicoChat, com tela própria em Integrações > Inteligência Artificial > Groq, ao lado de OpenAI, Google Gemini, Claude AI, X AI, DeepSeek e Coze. Você conecta sua chave da API do Groq e passa a ter mais um provedor de IA disponível nos fluxos, nos agentes e nas tarefas de IA.
q) é uma empresa de infraestrutura de inferência, fundada em 2016 — ela não tem um modelo próprio, ela executa modelos abertos muito rápido. O Grok (com k) é o modelo de linguagem da xAI, de Elon Musk, e no NicoChat ele está na integração X AI. Chave de um não funciona no outro.O Groq vende velocidade, não inteligência. Ele roda os modelos em um chip próprio, a LPU (Language Processing Unit), desenhada só para inferência — o resultado é uma resposta que chega em uma fração do tempo que o mesmo modelo levaria em GPU comum, na casa de centenas de tokens por segundo.
O catálogo é de modelos abertos (open-weight), como os das famílias Llama, Qwen, Kimi e GPT-OSS. Não há GPT-5, Claude ou Gemini no Groq: quem oferece esses é a integração de cada um deles.
Onde essa troca compensa no NicoChat:
- Atendimento por voz e por ligação, em que cada segundo de espera é silêncio no telefone.
- Fluxos com várias chamadas de IA em sequência — detectar intenção, classificar, extrair um dado e só então responder. O atraso de cada etapa se soma, e é aí que a latência aparece.
- Tarefas curtas e repetitivas: classificar uma mensagem, decidir para qual fila mandar o contato, resumir uma conversa, traduzir uma frase.
- Volume alto com orçamento apertado, já que modelos abertos custam bem menos por token que os modelos de ponta fechados.
E onde não compensa: raciocínio longo e difícil, texto de marketing com acabamento fino, contexto gigantesco. Para isso, prefira OpenAI, Claude AI ou Google Gemini.
https://api.groq.com/openai/v1. Só altere se você usa uma instância própria do Groq ou vai apontar para um endpoint compatível diferente.A API do Groq é compatível com o formato da OpenAI — é por isso que a URL base termina em /openai/v1. Isso não significa que você está falando com a OpenAI: a chamada vai para os servidores do Groq, apenas no mesmo formato de requisição.
- No bloco de Ação do construtor de fluxo: crie um nó de ação, abra a aba Integrações e role até Groq.
- Nos Agentes de IA, selecionando o Groq na aba de configurações. O modelo padrão é o
llama-3.1-8b-instant. - Nas Tarefas de IA e nos Prompts, escolhendo o Groq na lista de provedores.
O consumo aparece normalmente nos registros de uso de IA, junto com os demais provedores.
Dentro do bloco de Ação, o NicoChat oferece estas ações do Groq:
llama-3.1-8b-instant. Você pode trocar pelo que preferir; use a ação Listar modelos para ver o que está disponível na sua conta.
