El runtime de agentes IA
que ejecutas tú mismo.

Monta un equipo de empleados virtuales que gestiona tu correo, atiende a tus clientes, analiza los datos de tu sitio y lleva tus campañas en Google y Meta: prácticamente todo lo que harías tú mismo. Se ejecuta en tu propio servidor, con tus propias claves, bajo tu control.

# install (one line)
curl -fsSL https://pepe-agent.com/install.sh | sh

# scaffold, connect a model, add an agent
pepe setup
pepe model add openrouter --api-key '${OPENROUTER_API_KEY}' --model openai/gpt-5-chat
pepe agent add assistant --tools bash,web_search,send_file

# talk to it, or serve it to every surface
pepe run assistant "summarize this repo"
pepe serve --port 4000

Deja de dar órdenes. Define el resultado.

Un prompt te da un turno: el agente responde y tú decides si está bien. Así eres tú el cuello de botella, quien aprueba y quien revisa la calidad a la vez, y el trabajo solo avanza mientras estás frente al teclado. Dale un objetivo: di qué significa "terminado", y Pepe sigue trabajando hasta que un revisor independiente confirme que se cumplió.

# un prompt te da una respuesta, y tú la calificas
pepe run "limpiar la lista de clientes"

# un objetivo sigue hasta que un revisor confirma que está hecho
pepe goal "limpiar la lista de clientes" \
  --criteria "sin correos duplicados, cada fila con un teléfono válido"

Bucle de turno

Llama herramientas, lee los resultados, llama más. Para cuando tiene una respuesta real, no una suposición.

Bucle de objetivo

Defines el objetivo y qué cuenta como hecho. Quien juzga es un revisor independiente, no el agente. ¿Aún no? Recibe el comentario y reintenta.

Bucle de tiempo

Trabajo recurrente programado. Se ejecuta solo y recupera lo que quedó pendiente mientras estuvo apagado.


Un agente, todas las superficies

Define un agente una vez. Úsalo desde la superficie que encaje con la tarea, con las mismas herramientas y memoria.

CLI

Ejecuciones puntuales y un REPL interactivo.

API HTTP

Compatible con OpenAI: /chat/completions y /models, desde cualquier SDK.

WebSocket

Una conexión WebSocket para conversaciones en vivo por streaming.

Canales

Telegram, WhatsApp, Slack, Discord, Teams, Google Chat.

Qué construye la gente con Pepe

Trabajos habituales cuando conectas las herramientas adecuadas.

Gestión de redes sociales

Programa publicaciones, responde comentarios y sigue menciones en todas las plataformas.

Priorización de correo

Lee tu bandeja, redacta respuestas y archiva mensajes por tema.

Campañas publicitarias

Vigila el gasto y el rendimiento en Meta, Google y LinkedIn Ads, y reporta a diario.

Atención al cliente

Responde a la gente en WhatsApp, Slack o Telegram, con traspaso humano cuando importa.

Programación y avisos

Tareas recurrentes y avisos puntuales cuando algo cambia.

Informes y analítica

Extrae números de tus propias herramientas y envía un resumen de forma periódica.

Monitorización de errores

Vigila Sentry, AppSignal y otras herramientas de monitorización, y señala lo que necesita atención humana.

Análisis de datos

Consulta tu base de datos y convierte números en próximos pasos.

Notas y resúmenes de reuniones

Convierte una transcripción en un resumen con tareas y entrégalo donde tu equipo ya conversa.


Lo esencial para ejecutar agentes

Modelos, herramientas, automatización, plugins y control en un runtime pequeño y autoalojado.

Cualquier modelo, con failover

Conecta cualquier endpoint compatible con OpenAI. Define una cadena de fallback que avanza ante errores transitorios.

Bucle real de herramientas

Herramientas integradas para shell, archivos, web, scripts y envío de archivos. Añade las tuyas en minutos.

Objetivos, no solo prompts

Define un objetivo y qué cuenta como hecho. Un revisor independiente decide si se cumplió, y el agente reintenta con esos comentarios hasta pasar o agotar tu límite de intentos.

Enrutamiento por complejidad

Una llamada de clasificación barata evalúa cada conversación nueva. Las preguntas simples bajan de forma automática a un modelo más ligero; toda la potencia queda para lo que de verdad la necesita.

Tareas programadas

Cron con zona horaria dentro de Pepe. Los agentes pueden proponer tareas desde el chat, con tu aprobación.

Aprendizaje y memoria

El agente recuerda lo que aprende (hechos, preferencias, las personas con las que trata) y lo reutiliza en conversaciones posteriores. Lee y edita cualquier memoria desde el panel.

Plugins en tiempo de ejecución

Instala un plugin - una herramienta nueva, un hook de redacción, una policy de seguridad o un canal - y queda activo al instante, sin recompilar.

Límites de gasto y mensajes

Limita cada empresa por gasto y por mensajes: un presupuesto mensual en dólares y un límite mensual de mensajes. Ambos medidos en vivo, poniéndose en rojo en el panel a medida que se agotan.

Control y seguridad

Las herramientas arriesgadas piden aprobación primero. Cada ejecución queda trazada, con las protecciones de comandos siempre activas.


Conecta con las personas donde estén

Conecta un canal y el agente responde allí. Archivos, traspaso y alcance vienen incluidos.

Telegram WhatsApp Slack Discord Microsoft Teams Google Chat+ plugins
Conecta con las personas donde estén

O colócalo directo en tu sitio

Pega una sola etiqueta script en tu página y esta misma burbuja queda activa, sin backend que programar, sin paso de compilación. Unos pocos atributos opcionales definen el color, el saludo y el idioma, así cada visitante recibe respuesta en el idioma propio del sitio desde el primer mensaje.

Ver la documentación del widget →
O colócalo directo en tu sitio

Privacidad por diseño

Los datos sensibles nunca se envían en claro a un modelo externo, lo que te ayuda a cumplir normativas como el RGPD, la LGPD y la HIPAA.

Lo que envía el usuario

Mi DNI es 12345678A, ¿puedes ver mi pedido?

El mensaje tal como lo escribió.

Lo que llega al modelo

Mi DNI es [DNI_1], ¿puedes ver mi pedido?

Pepe cambia el dato sensible por un token antes de que la petición salga de tu servidor.

Lo que responde el modelo

Encontré el pedido de [DNI_1]: sale mañana.

Razona sobre el token. Nunca vio el valor real, ni lo guardó.

Lo que recibe el usuario

Encontré el pedido de 12345678A: sale mañana.

Pepe repone el valor real, solo de tu lado.

Privacidad por diseño

Dentro de un solo turno

Una ampliación del bucle de turno: Pepe llama al modelo, ejecuta las herramientas que pide, devuelve los resultados y se detiene cuando la respuesta está lista.

1

Llamar al modelo

Envía la conversación y las herramientas del agente al modelo (con failover).

2

Ejecutar herramientas

Ejecuta lo que pidió el modelo. Shell, archivos, web. Tras la aprobación.

3

Devolver resultados

Añade cada resultado a la conversación y vuelve a llamar al modelo.

4

Responder y entregar

Devuelve la respuesta final donde se pidió y registra la ejecución como traza.

De dónde viene Pepe

Pepe nació resolviendo problemas reales en una serie de empresas a las que prestaba servicios de desarrollo: algunas necesitaban una forma simple de llevar su marketing sin ampliar el equipo; otras buscaban conectar su ERP y su base de datos a un agente capaz de responder las preguntas de su equipo, sin comprometer la seguridad. El proyecto no nació abierto: era una herramienta interna, propietaria, desarrollada a medida para cada cliente. Pero los resultados fueron tan consistentes, en negocios tan distintos, que decidí darle un nombre, una identidad propia, y publicarlo como proyecto de código abierto, para que cualquier persona pueda usarlo y contribuir.

Pepe

¿Por qué "Pepe"?

El nombre es un guiño al universo de Chespirito, querido en toda América Latina. El chiste de Pepe era simple: hacía exactamente lo que le pedían. Sin discutir ni improvisar. Una buena descripción para un runtime de agentes.

Ejecuta tus propios agentes en minutos

Código abierto. Trae tu modelo. Mantén el runtime, las claves y los datos bajo tu control.