sistema operacional de IA pessoal · em produção desde 2025

Um operador. Seis frentes de negócio. Um sistema operacional de IA que roda tudo e melhora a si mesmo.

Não é demo. É a infraestrutura diária de um negócio real, operada por um fundador que não escreve código: cada erro vira regra, cada regra vira proteção, cada proteção deixa recibo auditável.

a categoria

Modelos são motores. Agentes executam tarefas. Um sistema operacional roda a sua operação.

2026 transformou as duas primeiras camadas em commodity: todo mundo tem um motor brilhante e agentes excelentes ao redor dele. A camada que não vem em caixa nenhuma é a que torna o conjunto seu.

CAMADA 1 · MODELO O motor. Claude, Gemini, GPT, brilhantes, intercambiáveis, mais inteligentes a cada trimestre. Ninguém mais tem vantagem aqui. commodity
CAMADA 2 · AGENTE O trabalhador. Claude Code, Hermes, OpenClaw, loop, ferramentas, memória de fatos. Excelentes em executar tarefas. Cada vez mais gratuitos, cada vez mais iguais. virando commodity
CAMADA 3 · OS O sistema operacional. A camada que aprende você, governa a si mesma com lei auditável, coordena frotas de agentes e carrega o aprendizado através de cada troca de modelo e cada migração. Agentes executam tarefas, isto roda um negócio. ★ construído aqui

a camada OS

O que a camada OS adiciona, e nenhum motor ou agente traz de fábrica.

Todo agente do mercado mede o modelo. O OS mede a si mesmo, e o humano que ele amplifica.

AUTO-MEDIÇÃOO OS audita o próprio corpo

Proteções que nunca disparam são sinalizadas. Skills que ninguém usa são aposentadas. Regras que param de valer são podadas com atestado datado. Volume é o anti-padrão, massa governada é o produto.

MÉTRICA NO OPERADORMede o humano, não o modelo

Benchmarks correm atrás de modelos. Ninguém mede o que um sistema adiciona ao seu operador: menos comandos repetidos, menos re-explicações, menos erros evitáveis. Essa é a nossa régua, e a nossa categoria.

APRENDIZADO QUE SOBREVIVESessões morrem. O aprendizado atravessa.

Cada cicatriz vira uma vacina documentada. Em 02/07/2026 o sistema migrou o corpo inteiro de 331 GB para infraestrutura nova, e as regras, perfis e aprendizados atravessaram intactos. Continuidade, demonstrada.

AUTONOMIA GOVERNADAUma constituição, não um arquivo de config

Leis com cicatriz datada, trilha de auditoria append-only, kill-switches que o sistema respeita mesmo quando é inconveniente. "Texto é desejo, proteção é garantia."

Um agente executa tarefas. Um sistema operacional roda uma operação.

Hermes, OpenClaw e OpenHands são agentes excelentes, de verdade. Isto é a camada OS que roda aqui e as arquiteturas públicas deles não têm:

CapacidadeAgente classe-HermesSUPERMENTE OS
Telemetria de eficácia por componentecada proteção e skill loga: disparou / serviu / está vivaHooks existem; ninguém mede se valem o que custamProteções mortas sinalizadas em ≤24h; ledgers por componente; skills sem uso aparecem em auditoria
Auto-poda governadacomponentes se aposentam com atestado datadoO scaffolding só cresceRegras que param de valer são podadas com lápide datada; massa é orçamento, não troféu
Perfil do operador que evolui por evidênciaformato de entrega, ritmo e pontos cegos por humanoMemória de fatos, persona estáticaPerfil comportamental com scores por fraqueza atualizados de sessões reais; o OS adapta a entrega, não só a lembrança
Aprendizado que sobrevive à mortetestamento destilado → reinjeção no próximo bootLogs persistem; comportamento não transfereLições atravessam sessões, trocas de modelo, e uma migração completa de infraestrutura (demonstrado em 02/07/2026)
Governança constitucionalleis com cicatriz · vacinas · jurisprudência append-onlyModos de permissão; a crise de segurança do OpenClaw em 2026 é o contra-exemploToda regra carrega a falha datada que a criou; kill-switch por subsistema; auditoria por design
Coordenação viva de frota multi-sessãoreserva / handoff / anti-duplicação entre sessões rodandoSubagentes só dentro de um processoSessões independentes se descobrem, reservam trabalho e passam o bastão, sem esforço duplicado
Auto-verificação adversarialagentes falsificadores + júri multi-fornecedorUm modelo revisa o próprio dever de casaEntregas atacadas por falsificadores independentes; notas cruzadas em modelos rivais, o viés próprio é medido, não presumido
Domínios de produção fora de códigoo OS roda um negócio, não um repositórioEscopo de código ou assistente pessoalSeis frentes de receita operadas diariamente, gestão de casos em saúde, operações associativas e mais

→ deslize para ver a comparação completa

// comparação baseada nas arquiteturas públicas de Hermes, OpenClaw e OpenHands em jul/2026, correções bem-vindas, recibos disponíveis

Como você opera: sua conta, suas máquinas, seus arquivos.

O OS não é mais um lugar para onde você leva seu trabalho. Ele se instala onde o seu trabalho já vive.

SUA CONTA

Roda no seu plano do Claude

O OS opera sobre a sua própria conta do Claude Code, sem intermediário de API, sem custo oculto. O requisito para operar é um plano Claude ativo; o sistema faz o resto.

SEUS ARQUIVOS

Trabalha nos seus arquivos locais

Acessa e opera diretamente nos documentos, planilhas e projetos da sua máquina, lendo, criando e editando com permissões explícitas e trilha de auditoria de cada toque.

SEU SISTEMA

Instalação local, identidade sua

O OS se instala na sua máquina e constrói o SEU perfil de operador a partir do uso real. Nós implantamos e calibramos junto, você opera desde o primeiro dia.

prova, não promessa

Convergimos com a fronteira, datado em git, antes das publicações.

Convergência independente, documentada em nível de commit. Quando a fronteira publicou, o padrão já rodava aqui:

Δ 10–50 dias antes
Orquestração determinística de workflows multi-agente
em produção antes do tooling oficial equivalente
Δ ~10 dias antes
Mensageria entre agentes cross-sessão
agentes coordenando entre sessões antes de virar recurso de plataforma
Δ meses antes
Context engineering como disciplina
persistir · selecionar · comprimir · isolar, praticado antes do termo virar mainstream
Δ semanas antes
Auto-melhoria recursiva governada
humano dirige, sistema executa e se melhora, com kill-switch e trilha de auditoria

Convergência, não causação, cada registro é um documento com timestamp de git comparando nosso histórico de commits com a data de publicação pública. Verificável sob pedido.

E em junho de 2026, a literatura alcançou.

Três resultados acadêmicos independentes agora descrevem a classe de arquitetura que este sistema opera em produção:

arXiv:2606.09498 · jun 2026

Self-Harness: Harnesses That Improve Themselves

Um loop de 3 estágios, mineração de fraquezas nos próprios traces → proposta → adoção validada, rende +33–60% sem tocar no modelo.

nosso loop erro→vacina→proteção é essa classe de mecanismo, rodando desde 2025, com ratificação humana em cada regra adotada.

arXiv:2605.23950 · mai 2026

Stop Comparing LLM Agents Without Disclosing the Harness

Trocar a infraestrutura muda a performance mais do que trocar o modelo, rankings invertem. Claims sem instrumentação são declarados não-comparáveis.

todo número desta página vem com seu comando de verificação. Instrumentação não é overhead, é o que torna o claim admissível.

arXiv:2604.08224 · abr 2026

Externalization in LLM Agents

A capacidade dos agentes está migrando dos pesos do modelo para memória externa, skills reutilizáveis e protocolos, o progresso agora é engenharia de runtime.

o IP vive na camada de infraestrutura: 421 skills, perfis que evoluem, regras governadas, sobre o melhor modelo do mês.

o produto

SkillHub, a primeira porta de entrada do sistema. Agora em beta.

[ SkillHub ao vivo ]
descreva sua tarefa em linguagem natural → receba a skill certa, o porquê, e um plano pronto para rodar

Você não precisa saber o nome de 421 skills. Você descreve a tarefa que está fazendo, nas suas palavras, e o SkillHub responde com as ferramentas certas, por que elas ajudam, e um plano pronto para copiar.

  • Língua do problema entra, língua da ferramenta sai. Busca semântica sobre o catálogo completo, zero jargão exigido.
  • Anti-alucinação por design. O assistente só escolhe do que o índice determinístico retornou. Ele não inventa skills.
  • Aprende com o uso. O que é usado sobe; o que não é, decai. O catálogo é vivo.
  • Web + celular, hoje. Rodando 24/7, esta é a porta do beta.

o que ainda não provamos

Um sistema construído para não mentir ao operador também não deveria mentir para você.

  • A amplificação está provada em um operador ao longo de seis meses, mais cinco usuários externos em validação inicial. A coorte medida de N≥10 está em andamento.
  • Nosso único A/B pareado contra um agente vanilla deu empate naquela classe de tarefa. Superioridade situacional está provada; a geral, ainda não. E nós publicamos isso.
  • Auditoria formal de terceiros: pendente. Todo número acima regenera da fonte, e vamos trocar claims sob NDA por casos públicos conforme os consentimentos chegarem.

Por que mostrar isso? Porque a lacuna de avaliação é o gargalo real da indústria: mil agentes, nenhuma régua confiável. Um sistema que mede a si mesmo com honestidade é o produto.

arquitetura & artigos

Como isto é construído, para quem quer entender por dentro.

A biblioteca de arquitetura do sistema: os conceitos, as decisões e a literatura que sustentam cada camada.

whitepaper

SUPERMENTE.AI, o documento técnico

A visão completa: arquitetura, método de governança e a métrica de amplificação do operador.

baixar PDF →
para IAs

llms.txt, o site legível por máquinas

A descrição estruturada que assistentes de IA leem quando perguntam "o que é supermente.ai".

ler →
conceito

De harness a sistema operacional

Por que o valor migrou do modelo para a infraestrutura, e o que separa um agente excelente de um OS que roda um negócio: auto-medição, perfil do operador, governança e herança de aprendizado.

artigo em breve
pesquisa

A literatura de 2026, destilada

Self-Harness (+33–60% sem tocar no modelo), a inversão de rankings por infraestrutura, e a externalização da capacidade, o que a academia confirmou sobre a arquitetura que operamos.

artigo em breve

para empresas

OS CORPORATIVO · ON-PREMISE

O sistema operacional instalado nas suas máquinas.

Para operações onde o dado não pode sair de casa, saúde, jurídico, financeiro, o SUPERMENTE OS tem modelo corporativo: instalado localmente, governado por lei auditável, moldado aos operadores da sua equipe.

  • Dados dentro de casa. Instalação local nas suas máquinas, nada do seu negócio treina modelo de terceiros.
  • Governança de fábrica. Trilha de auditoria, kill-switches e permissões por subsistema, o que compliance exige, já embutido.
  • Moldado a cada operador. O sistema aprende o jeito de trabalhar de cada pessoa da equipe, não é um chatbot genérico por assento.
  • Entrega como serviço. Implantamos, calibramos e operamos junto, sua equipe recebe resultado desde a primeira semana.

o que vamos criar

O caminho à frente, público, como tudo aqui.

AGORA

Beta em ondas

SkillHub liberado por convite aos cadastrados, em grupos pequenos, cada onda medida antes da próxima.

EM SEGUIDA

Amplificação medida em público

Coorte N≥10 com delta do operador publicado, a régua que o mercado não tem.

DEPOIS

OS Corporativo on-premise

Pacote instalável para empresas: saúde e jurídico primeiro, onde auditoria não é opcional.

HORIZONTE

Casos por vertical

Judicialização em saúde, operações jurídicas e PMEs, cada caso com número verificável, sem NDA.

cadastro

Deixe seu contato. Nós chamamos você para dentro.

O acesso ao beta é liberado em ondas para quem se cadastra. Você recebe: acesso ao SkillHub na sua onda, o whitepaper técnico e o changelog do que o sistema melhorou.

O próximo motor será mais inteligente. É esse o ponto, este sistema operacional fica mais valioso a cada lançamento.

O OS cavalga o motor. O método sobrevive à migração. O aprendizado atravessa cada morte.