MODO DE IMPLANTAÇÃO · 2 DE 6
Zero Data Retention AI.
Mesmos modelos de fronteira. Contrato diferente. ZDR endpoints são a forma de usar Claude, GPT e Gemini em dados de clientes, cargas de trabalho regulamentadas e informações comerciais materiais sem que essas consultas sejam retidas, registradas para treinamento ou usadas para melhorar o serviço do provedor. A qualidade do modelo permanece. A exposição de dados desaparece.
Para cargas de trabalho onde nuvem pública é muito permissiva e self-hosted é muito lento para lançar - ZDR é a resposta. BrainPack roteia para isso automaticamente quando a classificação de dados exige.
ZDR É A Resposta Para Uma Pergunta Que A Maioria Dos Fornecedores Não Fará.
Leia seus termos de API padrão do OpenAI. Leia seus termos de API padrão do Anthropic. Leia seus termos de Azure OpenAI padrão. Eles não são os mesmos da página de marketing. Escondido na linguagem legal estão cláusulas sobre monitoramento de conteúdo, detecção de abuso, logging de prompt e - dependendo da configuração e nível de produto - possível uso de seus dados para treinamento de segurança, avaliação ou melhoria de serviço. Nada disso é malicioso. Tudo isso é real. E quase nada disso é apropriado para os dados que seu CFO envia para IA quando ninguém está revisando os headers da API.
Zero Data Retention é uma postura contratual diferente nos mesmos modelos. Mesmo Claude, mesmo GPT, mesmo Gemini, mesma latência, mesma qualidade - termos diferentes. O provedor se compromete por escrito que os dados não são retidos do seu lado além do momento da inferência, não registrados para treinamento, não revisados para melhoria de serviço e em muitas configurações nem mesmo usados para monitoramento de abuso. A postura de conformidade é significativamente melhor. O preço é um pouco mais alto. O desbloqueio é a capacidade de enviar dados sensíveis para modelos de fronteira sem o problema de trilha de auditoria que a nuvem pública cria.
ZDR é o modo de implantação mais mal explicado em 2026. Fornecedores mencionam, mas raramente explicam quando é a resposta certa, quando não é suficiente e como orquestra com os outros modos. Esta página cobre tudo isso. Honestamente.
O Que ZDR Realmente Significa. O Contrato.
Um Termo Contratual, Não Um Técnico.
Zero Data Retention significa rotear inferência através de endpoints onde o provedor se comprometeu contratualmente a não persistir suas entradas ou saídas. A consulta e resposta são processadas na memória e descartadas após a chamada de inferência ser concluída. Os dados não são adicionados a corpora de treinamento, não são usados para fine-tuning de qualquer modelo atual ou futuro e não são agregados ou amostrados para melhoria de serviço.
O caminho de ativação passa através de contratos corporativos diretos com o provedor ou através de gateways corporativos (Azure OpenAI, AWS Bedrock, Anthropic for Enterprise) que oferecem ZDR como opção de configuração. Monitoramento de abuso padrão - a revisão de conteúdo que a maioria das APIs de nuvem pública executa para injeção de prompt e violações de política - é removido inteiramente ou retido sob controles de acesso estritos, dependendo do contrato específico.
ZDR não é um recurso de produto é um nível de serviço. A falta de retenção do lado do provedor não elimina o logging; desloca o foco do log de auditoria para seu ambiente. O que foi enviado, quem o enviou e o que voltou ainda precisam ser registrados em algum lugar sob ZDR, esse local não é mais o provedor. A decisão de implantação é uma decisão de contrato e auditoria, não uma decisão de "o provedor o armazena".
BrainPack trata ZDR como uma superfície de execução entre cinco. As camadas Connect, Orchestrate e Govern não mudam. O que muda é os termos contratuais que governam a chamada de inferência e o fato de que o trilho de auditoria completo de cada entrada, saída e decisão de roteamento é mantido inteiramente do seu lado.
Como Funciona Realmente — Camada GovernQuando ZDR É O Modo Certo.
Cinco Cargas De Trabalho Onde Ganha.
Cinco categorias de carga de trabalho onde ZDR é a melhor escolha quando a qualidade do modelo de fronteira importa e os dados são sensíveis o suficiente para que os termos de retenção padrão não sejam aceitáveis.
Dados Internos Confidenciais Em Modelos De Fronteira
Documentos de estratégia interna, análise de M&A, materiais de conselho, financeiros não publicados. Os dados não são regulamentados de forma que mandem self-hosting, mas são sensíveis o suficiente para que você não queira que permaneçam no pipeline de treinamento de um fornecedor ou retidos para melhoria de serviço. ZDR permite manter a qualidade do modelo de fronteira sem a retenção.
Dados De Clientes Sob Restrições De NDA Ou MSA
Contratos com clientes corporativos frequentemente proíbem seus dados de serem usados para treinar modelos de terceiros ou retidos por subprocessadores. Endpoints ZDR satisfazem essas cláusulas enquanto mantêm a carga de trabalho nos mesmos provedores que sua equipe já constrói.
Aplicativos De Produção Voltados Para O Cliente Tratando PII
Agentes de suporte, assistentes de conta, qualquer coisa que toque registros de clientes, detalhes de contato ou histórico de transações. Termos de nuvem pública padrão criam complexidade de divulgação e auditoria. ZDR remove a questão de retenção da superfície contratual inteiramente.
Indústrias Reguladas Em Modelos De Nuvem
Serviços financeiros, administração de saúde, cargas de trabalho legais que precisam de qualidade de modelo de fronteira mas operam sob regimes regulatórios (SEC, HIPAA, GLBA, privilégio advogado-cliente) onde retenção de dados do fornecedor cria risco de conformidade. ZDR é frequentemente a ponte entre "podemos usar este modelo" e "não podemos".
Quando Você Precisa Da Trilha De Auditoria Do Seu Lado
Auditoria interna, hold legal, exames regulatórios. Logs do lado do provedor são uma responsabilidade que você não pode controlar totalmente - o que é retido, onde vive ou por quanto tempo. Sob ZDR, o provedor não retém nada e o trilho de auditoria completo de entradas, saídas e decisões de roteamento vive em seu ambiente, onde suas políticas de logging e retenção existentes já se aplicam.
Quando ZDR É O Modo Errado.
E Para Onde A Carga De Trabalho Deveria Ir Em Vez Disso
Cinco categorias de carga de trabalho onde ZDR é a resposta errada e para onde o BrainPack roteia o trabalho para self-hosted, on-premise, air-gapped ou de volta à nuvem pública padrão em vez disso.
Dados Que Não Podem Sair Da Sua Rede De Jeito Nenhum
Contratos de defesa com classificações controladas, cargas de trabalho de inteligência, qualquer coisa coberta por requisitos de air-gap. ZDR ainda envia a chamada de inferência pela internet pública para um provedor de terceiros. Se a classificação de dados proíbe esse trânsito, a carga de trabalho pertence on-premise ou air-gapped — nenhum termo de retenção contratual resolve um problema de egresso de rede.
Cargas De Trabalho Onde Soberania Supera Qualidade
Dados principais de banking em jurisdições com regras estritas de residência, cargas de trabalho governamentais com FedRAMP High ou obrigações equivalentes, dados de saúde em países que proíbem processamento transfronteiriço. A geografia do data center do provedor importa mais do que os termos do contrato. Self-hosted em sua região ou on-premise é a chamada certa.
IP Essencial Que Você Nunca Permitirá Off-Property
Código-fonte dos produtos que você vende, algoritmos proprietários, segredos comerciais, documentação de processo de fabricação. Mesmo com zero retenção, a inferência ainda é executada no compute de um fornecedor de terceiros. Para organizações cujo fosso competitivo é o próprio IP, self-hosted de código aberto em GPU dedicada é a escolha certa — nenhum fornecedor de IA de terceiros no caminho dos dados, nunca.
Trabalho Geral De Produtividade Que Não Precisa Disso
Rascunho de emails, resumo de documentos públicos, brainstorming, análise de informações já públicas. ZDR traz um prêmio de custo e uma seleção de modelo menor do que nuvem pública padrão. Gastá-lo em cargas de trabalho que não o exigem desperdiça orçamento e capacidade que deveriam ser reservados para dados que realmente precisam do contrato.
Quando Você Precisa De Capacidades Ainda Não Em Tiers ZDR
Lançamentos de modelos de fronteira pousam em nuvem pública padrão primeiro. Endpoints ZDR, self-hosted e on-premise todos atrasam por semanas ou meses nas capacidades de raciocínio, multimodal e codificação mais novas. Se uma carga de trabalho genuinamente exige acesso no dia um para um novo modelo e a classe de dados permite, nuvem pública padrão é a superfície correta não ZDR.
PARA ONDE ROTEAR EM VEZ DISSO
Como ZDR Orquestra.
Com Cada Outro Modo De Implantação.
ZDR é o modo de ponte. Nuvem pública é rápida mas termos padrão. Self-hosted é controlado mas model lags. ZDR se senta entre - qualidade de modelo de fronteira com proteção de dados contratual. A orquestração importa mais do que qualquer modo único.
Uma implantação real do BrainPack se parece com isto:
Mesma interface de usuário. Mesma biblioteca de agentes. Cinco decisões de roteamento diferentes feitas automaticamente pela camada Govern com base na classificação de dados. O usuário não escolhe o modo. O modo se escolhe com base no que os dados são. ZDR é um dos cinco - e para muitas empresas, o que a maioria das cargas de trabalho deveria pousar uma vez que saem da nuvem pública.
O usuário nunca escolhe o modo de implantação. O modo se escolhe.
ZDR Dentro da Camada BrainPack.
Rotear para um endpoint ZDR é tecnicamente simples. Fazer bem em escala corporativa exige várias coisas no topo da chamada de API.
Contratos corporativos ativos
BrainPack mantém contratos corporativos elegíveis para ZDR com Anthropic, OpenAI (via Azure ou direto), Google Vertex, AWS Bedrock e Mistral. Os contratos são negociados centralmente e aplicados por carga de trabalho. Você não adquire separadamente ZDR - é parte da camada operacional.
Roteamento automático por classificação de dados.
A camada Govern classifica consultas com base em conteúdo, função de usuário e política. Consultas que correspondem a categorias exigidas por ZDR são roteadas para endpoints ZDR - automaticamente, sem oportunidade para um desenvolvedor rotear acidentalmente para endpoints de termos padrão. A classificação ocorre antes dos dados saírem do seu ambiente.
ZDR Multi-região.
Diferentes frameworks regulatórios exigem diferentes regiões físicas para processamento de dados. BrainPack roteia consultas ZDR para a região correta por carga de trabalho - dados da UE para endpoints ZDR residentes na UE, dados de saúde dos EUA para endpoints residentes nos EUA e assim por diante.
Failover do provedor com mesma postura
Se o provedor ZDR primário sofrer uma interrupção, o orquestrador roteia para um provedor elegível para backup ZDR - nunca caindo para um endpoint de nuvem pública com termos padrão. A postura contratual é preservada através de interrupções.
Log de auditoria do seu lado
Mesmo que o provedor não retenha as consultas, a camada Govern do BrainPack mantém logs de auditoria completos em seu ambiente. O que foi enviado, quem o enviou, o que voltou, quando e por quê - o trilho completo da decisão de roteamento é registrado onde suas políticas de logging e retenção existentes se aplicam.
Transparência de custo
ZDR é tipicamente mais caro por token do que inferência com termos padrão. BrainPack rastreia o diferencial de custo, o atribui às cargas de trabalho usando ZDR e produz relatórios de chargeback que mostram por que o custo é o que é. Custos ZDR raramente são uma conversa de orçamento; exposição de dados é.
Custos E Velocidade.
O Que Você Realmente Obtém.
ZDR traz um prêmio contratual e uma seleção de modelo menor do que nuvem pública padrão. Em troca, a questão de retenção desaparece da chamada de inferência inteiramente.
Para primeira capacidade. Integração de nuvem pública padrão mais ativação de contrato corporativo ou configuração de gateway.
Por chamada. Ligeiramente maior do que gateways de nuvem pública padrão como Azure OpenAI e Bedrock adicionam um salto de roteamento. Ainda bem dentro dos limites de produção.
Sobre as taxas de nuvem pública padrão para o mesmo modelo. O prêmio é o contrato, não o compute. A cobrança por token permanece.
Atrás da nuvem pública padrão nos lançamentos de novos modelos. Tiers corporativos se acendem após o tier público. Planeje de acordo com cargas de trabalho que precisam de capacidade no dia um.
A despesa real de ZDR não é o prêmio é rotear cargas de trabalho aqui que não precisavam estar aqui. Nuvem pública padrão manipula trabalho de produtividade geral a um custo menor e em modelos mais novos. A camada Govern impede roteamento excessivo da mesma forma que impede subroteamento.
ZDR, Executando Agora.
Junto Com Cada Outro Modo, Por Classe De Dados.
ZDR é o modo que a maioria das cargas de trabalho corporativas reguladas acabam executando, ao lado da nuvem pública para trabalho não sensível e self-hosted para análise protegida por IP.
ZDR manipula dados de RH específicos dos funcionários - triagem de recrutamento, resumos de revisão de desempenho, análise de compensação. Nuvem pública manipula Q&A de política e conteúdo de onboarding. Uma interface de RH unificada; dois caminhos de roteamento.
ZDR manipula interações de atendimento ao cliente e análise individual de clientes. Nuvem pública manipula análise de merchandising em dados agregados e não pessoais. Mesma biblioteca de agentes, duas posturas de conformidade.
ZDR manipula casos de suporte individual ao cliente; nuvem pública manipula análise de cadeia de suprimentos; self-hosted manipula análise de contrato de fornecedor. Todos os três modos operando simultaneamente, governados centralmente.
ZDR É Onde Modelos De Fronteira Se Tornam Compliant.
A maioria das cargas de trabalho de IA corporativas acabam roteadas através de endpoints ZDR uma vez que passam na primeira revisão de conformidade. Fale com um arquiteto sobre quais cargas de trabalho em seu ambiente deveriam estar em nuvem pública, ZDR, self-hosted, on-premise ou air-gapped - e como a política de orquestração deveria ser configurada.