O runtime de agentes de IA
que você mesmo executa.

Monte uma equipe de funcionários virtuais que cuida do e-mail, atende clientes, analisa os dados do seu site e gerencia campanhas no Google e no Meta: praticamente tudo o que você faria. Roda no seu próprio servidor, com as suas chaves, sob o seu controle.

# install (one line)
curl -fsSL https://pepe-agent.com/install.sh | sh

# scaffold, connect a model, add an agent
pepe setup
pepe model add openrouter --api-key '${OPENROUTER_API_KEY}' --model openai/gpt-5-chat
pepe agent add assistant --tools bash,web_search,send_file

# talk to it, or serve it to every surface
pepe run assistant "summarize this repo"
pepe serve --port 4000

Pare de dar ordens. Defina o resultado.

Um prompt dá um turno: o agente responde e você decide se ficou bom. Assim, é você o gargalo, quem aprova e quem faz o controle de qualidade ao mesmo tempo, e o trabalho só avança enquanto você está no teclado. Dê um objetivo: diga o que significa "pronto", e o Pepe continua trabalhando até um revisor independente concordar que chegou lá.

# um prompt dá uma resposta, e quem julga é você
pepe run "limpar a lista de clientes"

# um objetivo insiste até um revisor dizer que está pronto
pepe goal "limpar a lista de clientes" \
  --criteria "sem e-mails duplicados, toda linha com telefone válido"

Loop de turno

Chama ferramentas, lê os resultados, chama mais. Para quando tem uma resposta de verdade, não um palpite.

Loop de objetivo

Você define o objetivo e o que conta como pronto. Quem julga é um revisor independente, não o agente. Não chegou? Ele recebe o retorno e tenta de novo.

Loop de tempo

Trabalho recorrente, no horário que você marcar. Roda sozinho e recupera o que ficou pendente enquanto esteve fora.


Um agente, todas as superfícies

Defina um agente uma vez. Use-o na superfície certa para cada tarefa, com as mesmas ferramentas e memória.

CLI

Execuções pontuais e um REPL interativo.

API HTTP

Compatível com a OpenAI: /chat/completions e /models, de qualquer SDK.

WebSocket

Uma conexão WebSocket para conversas ao vivo com streaming.

Canais

Telegram, WhatsApp, Slack, Discord, Teams, Google Chat.

O que as pessoas constroem com o Pepe

Trabalhos comuns quando você conecta as ferramentas certas.

Gestão de redes sociais

Agende posts, responda comentários e acompanhe menções em todas as plataformas.

Priorização de e-mail

Leia sua caixa de entrada, rascunhe respostas e organize mensagens por assunto.

Campanhas de anúncios

Acompanhe gasto e desempenho no Meta, Google e LinkedIn Ads, com relatório diário.

Atendimento ao cliente

Responda no WhatsApp, Slack ou Telegram, com handoff humano quando for necessário.

Agendamento e lembretes

Tarefas recorrentes e avisos pontuais quando algo muda.

Relatórios e análises

Puxe números das suas próprias ferramentas e envie um resumo periodicamente.

Monitoramento de erros

Acompanhe Sentry, AppSignal e outras ferramentas de monitoramento, e aponte o que precisa de atenção humana.

Insights de dados

Consulte seu banco de dados e transforme números em próximos passos.

Notas e resumos de reuniões

Transforme uma transcrição em resumo e itens de ação, entregues onde o time já conversa.


O essencial para rodar agentes

Modelos, ferramentas, automação, plugins e controle em um runtime pequeno e auto-hospedado.

Qualquer modelo, com failover

Conecte qualquer endpoint compatível com OpenAI. Defina uma cadeia de fallback que avança em erros transitórios.

Loop real de ferramentas

Ferramentas nativas para shell, arquivos, web, scripts e envio de arquivos. Adicione as suas em minutos.

Objetivos, não só prompts

Defina um objetivo e o que conta como pronto. Um revisor independente decide se foi atingido, e o agente tenta de novo com esse retorno até passar ou atingir o seu limite de tentativas.

Roteamento por complexidade

Uma chamada de classificação barata avalia cada conversa nova. Perguntas simples caem sozinhas para um modelo mais leve; a força total fica reservada para o que realmente precisa dela.

Tarefas agendadas

Cron com fuso horário dentro do Pepe. Agentes podem propor tarefas pelo chat, com a sua aprovação.

Aprendizado e memória

O agente lembra o que aprende (fatos, preferências, as pessoas com quem fala) e reaproveita nas próximas conversas. Leia e edite qualquer memória pelo painel.

Plugins em runtime

Instale um plugin - uma ferramenta nova, um hook de redação, uma policy de segurança ou um canal - e ele já entra em ação, sem recompilar.

Limites de gasto e mensagens

Limite cada empresa por gasto e por mensagens: um orçamento mensal em dólares e um limite mensal de mensagens. Ambos medidos ao vivo, ficando vermelhos no painel conforme se esgotam.

Controle e segurança

Ferramentas arriscadas pedem aprovação antes. Toda execução fica rastreada, com proteções de comando sempre ligadas.


Conecte-se com as pessoas onde elas estiverem

Conecte um canal e o agente responde por lá. Arquivos, handoff e escopo vêm prontos.

Telegram WhatsApp Slack Discord Microsoft Teams Google Chat+ plugins
Conecte-se com as pessoas onde elas estiverem

Ou coloque direto no seu site

Cole uma única tag script na sua página e essa mesma bolha já fica no ar, sem backend para escrever, sem passo de build. Alguns atributos opcionais definem a cor, a saudação e o idioma, então cada visitante é respondido no idioma do próprio site já na primeira mensagem.

Ver a documentação do widget →
Ou coloque direto no seu site

Privacidade desde o design

Dados sensíveis nunca são enviados em claro para um modelo externo, o que ajuda a atender exigências como LGPD, GDPR e HIPAA.

O que o usuário envia

Meu CPF é 123.456.789-00, pode ver meu pedido?

A mensagem exatamente como ele digitou.

O que chega ao modelo

Meu CPF é [CPF_1], pode ver meu pedido?

O Pepe troca o dado sensível por um token antes de a requisição sair do seu servidor.

O que o modelo responde

Achei o pedido do [CPF_1]: sai para entrega amanhã.

Ele raciocina sobre o token. Nunca viu o valor real, e nunca o guardou.

O que o usuário recebe

Achei o pedido do 123.456.789-00: sai para entrega amanhã.

O Pepe repõe o valor real, só do seu lado.

Privacidade desde o design

Por dentro de um turno

Um zoom no loop de turno: o Pepe chama o modelo, executa as ferramentas que ele pedir, devolve os resultados e para quando a resposta está pronta.

1

Chamar o modelo

Envia a conversa e as ferramentas do agente ao modelo (com failover).

2

Rodar ferramentas

Executa o que o modelo pediu. Shell, arquivos, web. Após a aprovação.

3

Devolver resultados

Anexa cada resultado à conversa e chama o modelo de novo.

4

Responder e entregar

Devolve a resposta final onde ela foi pedida e registra a execução como trace.

De onde o Pepe vem

Pepe nasceu resolvendo problemas reais em uma série de empresas às quais eu prestava serviços de desenvolvimento: algumas precisavam de uma forma simples de conduzir suas ações de marketing sem ampliar a equipe; outras buscavam conectar seu ERP e banco de dados a um agente capaz de responder às dúvidas do time, sem abrir mão de segurança. O projeto não nasceu aberto: era uma ferramenta interna, proprietária, desenvolvida sob medida para cada cliente. Mas os resultados foram tão consistentes, em negócios tão distintos, que decidi dar a ele um nome, uma identidade própria, e disponibilizá-lo como projeto open source, para que qualquer pessoa possa utilizá-lo e contribuir.

Pepe

Por que "Pepe"?

O nome é uma referência ao universo do Chespirito, querido em toda a América Latina. A piada do Pepe era simples: ele fazia exatamente o que mandavam. Sem discutir, sem improvisar. Um bom resumo para um runtime de agentes.

Execute seus próprios agentes em minutos

Código aberto. Traga seu modelo. Mantenha o runtime, as chaves e os dados sob seu controle.