Français — Certains contenus de cette page ne sont disponibles qu'en anglais. Accueil

Groq

Groq 速度快、成本低 Inference

Text GenerationCode Assistantapiinferencelow-latencylanguage-model

📖 Aperçu

Groq LPU以开发者所需的速度和成本提供Inference。Groq为AI模型提供基于云的Inference服务。

💰 Détails du Quota Gratuit

📝 Guide d'utilisation de Groq

Groq est une plateforme d'inférence basée sur le cloud, conçue pour les développeurs qui souhaitent exécuter des modèles d'IA avec une vitesse et un coût optimaux. Grâce à son LPU (Language Processing Unit) propriétaire, Groq offre des performances ultra-rapides pour l'inférence des modèles, notamment les grands modèles de langage comme Llama, Mixtral ou Gemma.

Pour commencer, créez un compte sur le site de Groq (console.groq.com). Une fois connecté, vous aurez accès à la console où vous pourrez choisir parmi plusieurs modèles préchargés. L'API Groq est compatible avec l'API OpenAI, ce qui facilite l'intégration dans vos projets existants.

Utilisation de base :
  1. Obtenez une clé API depuis votre tableau de bord.
  2. Envoyez des requêtes POST à l'endpoint https://api.groq.com/openai/v1/chat/completions avec votre clé dans l'en-tête Authorization: Bearer YOUR_API_KEY.
  3. Spécifiez le modèle souhaité (par exemple mixtral-8x7b-32768).
  4. Recevez la réponse en streaming ou en mode batch.
Astuces :
  • Utilisez le paramètre temperature pour contrôler la créativité des réponses.
  • Le contexte peut atteindre 32 768 tokens, idéal pour des conversations longues.
  • Surveillez votre quota de tokens dans la console pour éviter les dépassements.

Groq est idéal pour le prototypage rapide, les chatbots, et les applications nécessitant une faible latence. Commencez dès aujourd'hui et profitez de la vitesse de l'inférence Groq !

Gratuit
active

Health

At Risk
Free tier Active
Verified Never verified

Ratings

Ease of Use
Free Tier
Stability
Community

Cet outil est-il utile ?

Compare