Skip to main content
Ouvrir dans Colab
Vous voulez tester les modèles Groq sur Weave sans rien configurer ? Essayez le LLM Playground.
Groq est une entreprise d’infrastructure IA qui fournit une inférence IA rapide. Le LPU™ Inference Engine de Groq est une plateforme matérielle et logicielle offrant une vitesse de calcul, une qualité et une efficacité énergétique exceptionnelles. Weave suit et journalise automatiquement les appels de modèle effectués via la fonctionnalité Chat Completion de Groq.

Tracing

Il est important de stocker les traces des applications de modèles de langage dans un emplacement centralisé, aussi bien pendant le développement qu’en production. Ces traces peuvent être utiles pour le débogage et servir de jeu de données pour vous aider à améliorer votre application. Weave capturera automatiquement les traces pour Groq. Pour commencer le suivi, appelez weave.init(project_name="<YOUR-WANDB-PROJECT-NAME>") et utilisez la bibliothèque normalement.

Suivez vos propres ops

Le fait de décorer une fonction avec @weave.op commence à capturer les entrées, les sorties et la logique de l’application afin que vous puissiez déboguer la façon dont les données circulent dans votre application. Vous pouvez imbriquer des ops en profondeur et créer une arborescence de fonctions que vous souhaitez suivre. Cela lance également automatiquement la gestion des versions du code pendant que vous expérimentez, afin de capturer des détails ad hoc qui n’ont pas été commités dans git. Créez simplement une fonction décorée avec @weave.op. Dans l’exemple ci-dessous, la fonction recommend_places_to_visit, décorée avec @weave.op, recommande des lieux à visiter dans une ville.

Créez un Model pour faciliter l’expérimentation

Il est difficile d’organiser l’expérimentation lorsqu’il y a de nombreux éléments en jeu. En utilisant la classe Model, vous pouvez capturer et organiser les détails expérimentaux de votre application, comme le prompt système ou le modèle que vous utilisez. Cela facilite l’organisation et la comparaison des différentes itérations de votre application. En plus de la gestion des versions du code et de la capture des entrées/sorties, les Models capturent des paramètres structurés qui contrôlent le comportement de votre application, ce qui permet d’identifier facilement les paramètres les plus efficaces. Vous pouvez également utiliser des Weave Models avec serve et des Evaluations. Dans l’exemple ci-dessous, vous pouvez expérimenter avec GroqCityVisitRecommender. À chaque modification de l’un de ces éléments, vous obtenez une nouvelle version de GroqCityVisitRecommender.

Servir un Weave Model

À partir d’une référence Weave vers n’importe quel objet weave.Model, vous pouvez lancer un serveur FastAPI et le Serve. Vous pouvez servir votre modèle à l’aide de la commande suivante dans le terminal :