API-Dokumentation
Eine OpenAI-kompatible Chat-Completions-LLM-API, mit der du KI ganz einfach in deine Anwendungen integrieren kannst.
Schnellstart
Alle Mammouth-Abonnenten erhalten ein gewisses Guthaben inklusive.
| Plan | Starter | Standard | Expert |
|---|---|---|---|
| Monatliches Guthaben | 2$ | 4$ | 10$ |
Du kannst auch nutzungsabhängig direkt in den API-Einstellungen ein Guthaben erwerben.
➡️ API-Schlüssel und Guthaben abrufen.
Direkt mit der Mammouth-API
Erzeugt anhand deines Prompts eine Chat-Completions-Antwort.
import requests
url = "https://api.mammouth.ai/v1/chat/completions"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "gpt-4.1",
"messages": [
{
"role": "user",
"content": "Explain the basics of machine learning"
}
]
}
response = requests.post(url, headers=headers, json=data)
print(response.json())const fetch = require("node-fetch");
async function callMammouth() {
const url = "https://api.mammouth.ai/v1/chat/completions";
const headers = {
Authorization: "Bearer YOUR_API_KEY",
"Content-Type": "application/json",
};
const data = {
model: "gpt-4.1",
messages: [
{
role: "user",
content: "Create an example JavaScript function",
},
],
};
try {
const response = await fetch(url, {
method: "POST",
headers: headers,
body: JSON.stringify(data),
});
const result = await response.json();
console.log(result.choices[0].message.content);
} catch (error) {
console.error("Error:", error);
}
}
callMammouth();curl -X POST https://api.mammouth.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4.1",
"messages": [
{
"role": "user",
"content": "Hello, how are you doing?"
}
]
}'➡️ API-Schlüssel und Guthaben abrufen.
Mit der OpenAI-Bibliothek
import openai
# Configure the client to use Mammouth.ai
openai.api_base = "https://api.mammouth.ai/v1"
openai.api_key = "YOUR_API_KEY"
response = openai.ChatCompletion.create(
model="gpt-4.1",
messages=[
{"role": "user", "content": "What are the benefits of renewable energy?"}
]
)
print(response.choices[0].message.content)Antwortformat
Erfolgreiche Antwort
{
"id": "chatcmpl-123",
"object": "chat.completion",
"created": 1677652288,
"model": "gpt-4.1",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! I'm doing very well, thank you for asking. How can I help you today?"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 12,
"completion_tokens": 19,
"total_tokens": 31
}
}Streaming-Antwort
Wenn stream: true festgelegt ist, werden Antworten als Server-Sent Events zurückgegeben:
data: {"id":"chatcmpl-123","object":"chat.completion.chunk","created":1677652288,"model":"gpt-4.1","choices":[{"index":0,"delta":{"content":"Hello"},"finish_reason":null}]}
data: {"id":"chatcmpl-123","object":"chat.completion.chunk","created":1677652288,"model":"gpt-4.1","choices":[{"index":0,"delta":{"content":"!"},"finish_reason":null}]}
data: [DONE]{
"id": "gen-1767710235-3VtWd1SuI9ilIspBmeWG",
"created": 1767710235,
"model": "google/gemini-2.5-flash-image",
"object": "chat.completion",
"choices": [
{
"finish_reason": "stop",
"index": 0,
"message": {
"content": "Here's a beautiful sunset over mountains for you!",
"role": "assistant",
"images": [
{
"image_url": {
"url": "data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAABAAAAAQACAI..."
}
}
]
}
}
]
}Modelle und Preise
Mammouth Recommended
mammouth-recommended ist eine Abkürzung für das Modell, das Mammouth aktuell für das beste Preis-Leistungs-Verhältnis hält.
Richte deine Anfragen an dieses Modell und du erhältst immer unsere aktuelle Empfehlung, ohne selbst neue Veröffentlichungen verfolgen zu müssen.
- Aktuelle Empfehlung:
glm-5.3-flash, mitminimax-m3als Fallback. Das ändert sich im Laufe der Zeit, wenn neue Modelle erscheinen. - Verwendung: Rufe es genau wie jedes andere Modell auf. Setze
mammouth-recommendedals Modell oder verwende die Kurzformenmammouthoderrecommended. - Preis: Du zahlst denselben Preis wie für das zugrunde liegende Modell, ohne Aufschlag. Sieh dir dazu die entsprechende Tabellenzeile weiter unten an.
Alle Modelle
Die Preise können sich ändern und in dieser Tabelle möglicherweise nicht aktuell sein. Die vollständige Modellliste findest du im Model Explorer!
| Modell | Eingabe ($/M Tokens) | Ausgabe ($/M Tokens) |
|---|---|---|
claude-fable-5.1 | 10 | 50 |
claude-haiku-4-5 | 1 | 5 |
claude-opus-5 | 5 | 25 |
claude-sonnet-5 | 2 | 10 |
deepseek-v4-pro | 1.74 | 3.48 |
deepseek-v4.1-flash | 0.22 | 0.66 |
gemini-3.1-flash-image-preview | image | / |
gemini-3.1-pro-preview | 2 | 12 |
gemini-3.7-flash | 1.5 | 7.5 |
gemini-3.8-flash | 0.75 | 3.75 |
glm-5.3 | 1.4 | 4.4 |
glm-5.3-flash | 0.15 | 0.5 |
gpt-5.4 | 2.5 | 15 |
gpt-5.4-mini | 0.75 | 4.5 |
gpt-5.4-nano | 0.2 | 1.25 |
gpt-5.5 | 5 | 30 |
gpt-5.6-luna | 1 | 6 |
gpt-5.6-sol | 5 | 30 |
gpt-5.6-terra | 2.5 | 15 |
gpt-6-astra | 10 | 50 |
grok-4.6 | 2 | 6 |
kimi-k2.6 | 0.73 | 3.49 |
kimi-k3 | 3 | 15 |
llama-4-maverick | 0.15 | 0.6 |
minimax-m3 | 0.3 | 1.2 |
mistral-medium-3-5 | 1.5 | 7.5 |
mistral-small-3.2-24b-instruct | 0.1 | 0.3 |
qwen3.7-plus | 0.4 | 1.6 |
qwen3.8-27b | 0.4 | 2.55 |
qwen3.8-flash | 0.15 | 0.47 |
sonar-deep-research | 2 | 8 |
sonar-pro | 3 | 15 |
Hinweis zu den Preisen
Die hier aufgeführten Preise sind Höchstpreise.
Der tatsächlich berechnete Preis ist manchmal niedriger, da er von der Verfügbarkeit beim Anbieter abhängt.
Dir wird niemals mehr als der angezeigte Preis berechnet.
Embeddings
Erzeuge Vektor-Embeddings aus Text für semantische Suche, Clustering und andere NLP-Aufgaben.
Embedding-Modelle und Preise
| Modell | Eingabe ($/M Tokens) |
|---|---|
text-embedding-3-large | 0.13 |
text-embedding-3-small | 0.02 |
Beispiel für ein Embedding
import requests
url = "https://api.mammouth.ai/v1/embeddings"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "text-embedding-3-large",
"input": "Hello, world!"
}
response = requests.post(url, headers=headers, json=data)
print(response.json())Embedding-Antwort
{
"object": "list",
"data": [
{
"object": "embedding",
"index": 0,
"embedding": [0.0023, -0.0091, 0.0152, ...]
}
],
"model": "text-embedding-3-large",
"usage": {
"prompt_tokens": 4,
"total_tokens": 4
}
}📜 Nutzung und Kosten werden in deinen Einstellungen protokolliert.
💡 Wir haben an die Mammouth-App angelehnte Aliase hinzugefügt, um dir die Modellauswahl zu erleichtern: Wenn du mistral eingibst, wird mistral-medium-3.1 verwendet.
Fehlercodes
| Code | Beschreibung |
|---|---|
400 | Ungültige Anfrage – fehlende oder falsche Parameter |
401 | Nicht autorisiert – ungültiger API-Schlüssel |
429 | Zu viele Anfragen – Ratenlimit überschritten |
500 | Interner Serverfehler – Problem auf dem Server |
503 | Dienst nicht verfügbar – Server vorübergehend nicht erreichbar |
Kosten verfolgen
Wenn du wissen möchtest, wie viel Guthaben über einen Schlüssel verbraucht wurde, verwende diesen API-Endpunkt:
curl -X GET "https://api.mammouth.ai/key/info" -H "Authorization: Bearer $MAMMOUTH_API_KEY"Parameter
Erforderliche Parameter
| Parameter | Typ | Beschreibung |
|---|---|---|
messages | array | Liste der Nachrichten im Gespräch |
model | string | Zu verwendende Modellkennung |
Optionale Parameter
| Parameter | Typ | Standardwert | Beschreibung |
|---|---|---|---|
temperature | number | 0.7 | Steuert die Kreativität (0.0 bis 2.0) |
max_tokens | integer | 2048 | Maximale Anzahl der zu erzeugenden Tokens |
top_p | number | 1.0 | Steuert die Vielfalt der Antworten |
stream | boolean | false | Echtzeit-Streaming der Antwort |
Tipps zur Optimierung
Nachrichtenstruktur
{
"messages": [
{
"role": "system",
"content": "You are an AI assistant specialized in programming."
},
{
"role": "user",
"content": "How to optimize a for loop in Python?"
}
]
}Rollentypen
system: Legt Verhalten und Kontext für den Assistenten festuser: Steht für Nachrichten des Nutzersassistant: Steht für vorherige Antworten der KI
Von OpenAI migrieren
Wenn du bereits die API von OpenAI verwendest, ist die Migration zu Mammouth.ai einfach:
- Ändere die Basis-URL von
https://api.openai.com/v1zuhttps://api.mammouth.ai/v1 - Aktualisiere deinen API-Schlüssel
- Behalte alle anderen Parameter bei
OpenAI-Python-Bibliothek
import openai
# Before
openai.api_base = "https://api.openai.com/v1"
openai.api_key = "sk-openai-key"
# After
openai.api_base = "https://api.mammouth.ai/v1"
openai.api_key = "your-mammouth-key"n8n, VS Code, Cline, OpenClaw, Make, CLI usw.
Du kannst die Mammouth-API mit Tools wie n8n, VS Code, Cline, Make und weiteren verwenden.
Achte darauf, die richtige URL zu verwenden. Wenn du unsicher bist, probiere die verschiedenen URLs aus.
- Basis-URL: https://api.mammouth.ai/v1 oder https://api.mammouth.ai/
- Für HTTPS-Anfragen ist https://api.mammouth.ai/v1/chat/completions erforderlich.
Anleitungen zur Nutzung der Mammouth-API mit deinen bevorzugten Tools
Für Automatisierungen:
Für IDEs:
Für die CLI (als Alternative zu Claude Code):
Oder über Opencode
Sonstige