API Flux : Prompts et scripts via un seul endpoint
Intégrez notre LLM sans censure dans votre pipeline média avec un seul endpoint compatible OpenAI. Rédigez des scripts, extrayez des métadonnées ou effectuez un post-traitement de texte sans refus de contenu.
uncensoredhttps://api.fluxapikey.com/v1
Commencez avec le crédit d'essai
E-mail et mot de passe, la clé s'affiche tout de suite à l'écran.
Obtenir une clé APIURL de base et authentification
Notre API suit la structure standard des chat-completions OpenAI. Pour commencer, vous avez besoin d'une URL de base et d'une clé API. L'URL de base pour toutes les requêtes est https://api.fluxapikey.com/v1. Vous pouvez obtenir une clé API en vous inscrivant sur la page Obtenir la clé API avec simplement un e-mail et un mot de passe. Aucune carte bancaire n'est requise pour l'essai.
Indiquez votre clé dans l'en-tête Authorization en tant que token Bearer. Chaque compte est limité à une seule clé à la fois ; sa régénération invalide la précédente. Les prompts ne sont pas utilisés pour l'entraînement, et la seule limite stricte en contenu est l'interdiction du contenu sexuel impliquant des mineurs.
Votre première requête
Effectuez une requête POST vers /v1/chat/completions avec votre prompt. L'ID du modèle est toujours uncensored. Cet endpoint accepte des charges utiles JSON standard et renvoie des réponses textuelles. Il prend en charge le streaming via Server-Sent Events (SSE) et l'appel de fonctions.
Voici un exemple de base utilisant curl :
curl https://api.fluxapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Cette requête envoie votre texte à nos serveurs GPU. Le modèle est ajusté pour répondre sans refus sur des sujets adultes licites, fictifs ou controversés. Vous pouvez ajuster les paramètres max_tokens et temperature selon vos besoins.
Intégration SDK Python
Utilisez le SDK Python officiel OpenAI pour interagir avec notre API. Définissez l'URL de base sur notre endpoint et fournissez votre clé API. Cela vous permet d'utiliser des méthodes familières comme client.chat.completions.create.
from openai import OpenAI
client = OpenAI(base_url="https://api.fluxapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Cette configuration assure la compatibilité avec les bases de code existantes. L'objet de réponse contient le texte généré dans response.choices[0].message.content. Vous pouvez analyser ce texte pour des scripts, des légendes ou l'extraction de métadonnées dans vos workflows vidéo ou audio.
Utilisation du SDK Node.js
Pour les environnements JavaScript, utilisez le SDK Node.js OpenAI. Configurez les propriétés baseURL et apiKey pour pointer vers notre service. Cela permet une intégration transparente dans les applications Node.js pour la génération de texte en temps réel.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.fluxapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);La structure de réponse correspond au format OpenAI. Vous pouvez accéder au contenu généré et gérer les erreurs à l'aide de blocs try-catch standard. Cette approche est idéale pour le traitement côté serveur dans les applications web ou les outils CLI.
Réponses en streaming via SSE
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des Server-Sent Events (SSE) avec des fragments de texte incrémentaux. Cela est utile pour les applications en temps réel où vous souhaitez afficher le texte au fur et à mesure de sa génération.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Chaque fragment contient une réponse partielle. Vous pouvez accumuler ces fragments pour reconstituer le texte complet ou les afficher en temps réel. Le streaming réduit la latence perçue pour les utilisateurs attendant de longs scripts ou des descriptions.
Limites, erreurs et fenêtre de contexte
Notre API a des limites spécifiques pour garantir la fiabilité. Vous pouvez envoyer jusqu'à 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. La fenêtre de contexte prend en charge 100 000 tokens pour le prompt et la complétion combinés.
Les erreurs courantes incluent 401 pour les clés invalides, 402 pour un crédit insuffisant et 429 pour les limites de débit. Si vous dépassez la limite de débit, attendez et réessayez. Notre tarification est transparente : 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie. Le crédit prépayé n'expire jamais, et vous pouvez recharger à partir de 10 $.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.fluxapikey.com/v1 |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte prend en charge 100 000 tokens pour le prompt et la complétion combinés. Cela permet des conversations longues ou le traitement de gros documents dans une seule requête.
Comment gérer les erreurs ?
Les erreurs courantes incluent 401 pour les clés invalides, 402 pour un crédit insuffisant et 429 pour les limites de débit. Vous pouvez vérifier le code d'état et le message de réponse pour déterminer le problème et agir en conséquence.
Puis-je utiliser cette API pour la génération d'images ou de vidéos ?
Non, cette API est destinée aux complétions de chat textuel uniquement. Nous fournissons le cerveau sans censure pour l'ingénierie des prompts, l'écriture de scripts et le post-traitement. Pour la génération d'images ou de vidéos, vous devrez utiliser un modèle ou un service dédié.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.