Aller au contenu

API LiteLLM - Documentation

L'API LiteLLM permet d'interagir avec des modèles de langage (LLM) depuis vos outils ou IDE. Elle simplifie l'intégration avec différents fournisseurs (OpenAI, Ollama, etc.).

URL de base : https://api.ia.limos.fr

Gestion des Clés API

Vous pouvez créer une clé API dans votre espace ia.limos.fr → onglet "Mes clés".

Pour vos stagiaires, générez une clé temporaire valable 30 jours (renouvelable). Cette clé est rattachée à votre compte et peut être supprimée à tout moment.


Configuration de base**

Pour les services utilisant un LLM (ex : Chatbots, assistants IA), précisez : - URL : https://api.ia.limos.fr/v1 - Clé API : celle générée sur ia.limos.fr


Commandes de base**

Lister les modèles disponibles

Bash

curl -X GET "https://api.ia.limos.fr/v1/models" -H "Authorization: Bearer API_KEY"

Python

import requests

headers = {
    "Authorization": "Bearer API_KEY"  # Remplacez par votre clé
}

response = requests.get("https://api.ia.limos.fr/v1/models", headers=headers)
print(response.json())


Requêtage pour une complétion de chat

Bash

curl -X POST "https://api.ia.limos.fr/v1/chat/completions" \
  -H "Authorization: Bearer API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
      "model": "general_nothink",
      "messages": [
          {"role": "system", "content": "Tu es un assistant clair et concis."},
          {"role": "user", "content": "Dis-moi la capitale de la France."}
      ],
      "max_tokens": 50,
      "temperature": 0.7
    }'

Python

import requests
import json

data = {
    "model": "general_nothink",
    "messages": [
        {"role": "system", "content": "Tu es un assistant clair et concis."},
        {"role": "user", "content": "Dis-moi la capitale de la France."}
    ],
    "max_tokens": 50,
    "temperature": 0.7
}

headers = {
    "Authorization": "Bearer API_KEY",  # Remplacez par votre clé
    "Content-Type": "application/json"
}

response = requests.post(
    "https://api.ia.limos.fr/v1/chat/completions",
    headers=headers,
    data=json.dumps(data)
)
print(response.json())

Requêtage pour un embedding (représentation vectorielle de texte)

Bash

curl -X POST "https://api.ia.limos.fr/v1/embeddings" \
  -H "Authorization: Bearer API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
      "model": "embedding",
      "input": "Bonjour, comment ça va ?"
  }'

Python

import requests
import json

data = {
    "model": "embedding-model",
    "input": "Bonjour, comment ça va ?"
}

headers = {
    "Authorization": "Bearer API_KEY",  # Remplacez par votre clé
    "Content-Type": "application/json"
}

response = requests.post(
    "https://api.ia.limos.fr/v1/embeddings",
    headers=headers,
    data=json.dumps(data)
)
print(response.json())


Notes supplémentaires

  • Headers obligatoires :
  • Authorization: Bearer <votre_clef>
  • Content-Type: application/json (pour les requêtes POST).
  • Paramètres ajustables :
  • temperature (0.0 à 1.0) : contrôle l'aléatoire des réponses.
  • max_tokens : limite la longueur de la réponse.