Português — Parte do conteúdo desta página está disponível apenas em inglês. Início

Groq

Groq 快速、低成本 Inference。

Text Generationllmapiinference

📖 Visão Geral

Groq LPU(语言处理单元)以开发者所需的速度和成本提供 Inference。它提供基于云的 API,用于以高吞吐量和低延迟运行大型语言模型。

💰 Detalhes da Cota Gratuita

📝 Guia de Uso do Groq

O Groq é uma plataforma de inferência baseada em nuvem que utiliza a Unidade de Processamento de Linguagem (LPU) para executar modelos de linguagem grandes com alta velocidade e baixo custo. Para começar, acesse o site do Groq e crie uma conta gratuita. Após o login, você receberá uma chave de API (API key) que deve ser incluída no cabeçalho de suas requisições HTTP.

A API do Groq suporta endpoints RESTful. Para enviar uma consulta, faça uma requisição POST para o endpoint apropriado (por exemplo, /v1/chat/completions) com o modelo desejado (como 'mixtral-8x7b-32768' ou 'llama2-70b-4096'). Inclua sua chave de API no cabeçalho 'Authorization: Bearer SUA_CHAVE' e envie um JSON com os parâmetros, como 'messages', 'max_tokens', 'temperature', etc.

Exemplo de requisição com curl:

curl -X POST "https://api.groq.com/openai/v1/chat/completions" \

-H "Authorization: Bearer SUA_CHAVE" \

-H "Content-Type: application/json" \

-d '{

"model": "mixtral-8x7b-32768",

"messages": [{"role": "user", "content": "Explique o que é Groq"}],

"max_tokens": 100

}'

A resposta virá em formato JSON com o texto gerado. O Groq é ideal para aplicações que exigem baixa latência, como chatbots, assistentes virtuais e processamento em tempo real. Aproveite a alta taxa de transferência (throughput) para escalar suas aplicações sem custos elevados. Consulte a documentação oficial para mais detalhes sobre modelos disponíveis e limites de uso.

Gratuito
active

Health

At Risk
Free tier Active
Verified Never verified

Ratings

Ease of Use
Free Tier
Stability
Community

Esta ferramenta é útil?

Compare