Bem-vindo ao DATTA
Sua organização tem dados demais e respostas de menos: documentos espalhados, sistemas que não conversam entre si e análises que dependem de especialistas e de semanas de espera. O DATTA reúne busca inteligente, análise assistida por IA, dashboards e automação de dados em uma única plataforma — dentro da sua própria infraestrutura — para que qualquer pessoa do time encontre, entenda e use a informação em minutos.
Esta é a porta de entrada da documentação. Aqui você tem um panorama do que a plataforma faz e os caminhos para se aprofundar em cada capacidade. Se quiser começar pelo "porquê", veja por que o DATTA existe e quais problemas ele resolve.
O que você pode fazer com o DATTA
Perguntar, em vez de procurar
Digite uma pergunta em português — no da página inicial — e receba uma resposta redigida pela IA junto com os documentos que a sustentam, com fontes citadas. A busca entende o significado da pergunta, não apenas as palavras exatas. Veja o guia da busca e como personalizar as respostas da IA com o seu próprio prompt.
Analisar o acervo inteiro, não uma amostra
A aplica suas regras de conformidade a todos os processos de um contexto, classifica cada um — CONFORME ou ANOMALIA — e justifica a decisão com trechos citados. Detalhes no guia da triagem em lote e no detalhe da auditoria de um processo.
Montar dashboards sem depender do time de BI
No você constrói dashboards interativos arrastando campos, cruza fontes diferentes no mesmo painel e publica para o time — com um copilot que sugere visuais e narra os resultados. Comece pelo guia completo do DATTABI.
Integrar e transformar dados sem escrever infraestrutura
O desenha pipelines de extração e carga de forma visual, e a linguagem DATTAX descreve transformações, grafos e materializações em poucas linhas. Veja o guia do Extract e a referência da linguagem DATTAX.
Explorar dados com código, quando o código é a ferramenta certa
O ambiente de Notebook () oferece um Jupyter integrado à plataforma, com acesso pronto a SQL (Trino), grafos (Neo4j, em Cypher), busca textual (OpenSearch) e PySpark — e um
Conectar suas fontes com governança
Toda conexão a banco de dados ou fonte externa é cadastrada em e catalogada automaticamente: minutos depois de conectar, as tabelas já aparecem no Knowledge Catalog, com amostras e métricas de qualidade. Veja o guia de conexões.
Automatizar fluxos de trabalho
O DATTA BPM modela e executa processos de negócio (triagem, revisão, aprovação) com monitoramento em tempo real. Comece pelo guia do motor de processos.
Primeiros passos
Um roteiro de dez minutos para sentir a plataforma funcionando:
- Entre na plataforma com o usuário fornecido pelo seu administrador. Você chega na página inicial, com o campo de busca ao centro.
- Faça uma pergunta real do seu dia a dia — por exemplo, "quais processos citam prescrição intercorrente?" — e tecle Enter.
- Observe a tela se montar: os cards de documentos aparecem primeiro, e a resposta da IA vai sendo redigida em tempo real logo acima.
- Abra o menu lateral e explore as seções — Descobrir, Investigação, Processar, . Cada tela mostra uma trilha de navegação no topo para você nunca se perder.
- Peça ao administrador um workspace para o seu time — ele agrupa contextos, funcionalidades e painéis em um só lugar no menu.
Como esta documentação está organizada
Esta documentação é servida pela própria plataforma, no Portal de Documentação: aberto, bilíngue pt-BR/EN, com busca instantânea e navegação anterior/próximo. A seção de plataforma e operações aparece apenas para quem tem permissão de plataforma — se ela não está no seu menu, é porque seu perfil não a alcança.
O menu lateral é o mapa: as seções agrupam os temas, a busca cobre o texto inteiro de todas as páginas visíveis para você, e o seletor de idioma troca entre português e inglês sem sair da página.
Mapa da documentação
Guias do usuário
Para analistas, editores de dashboards e operadores de pipeline:
- DATTABI — Guia do Usuário — DATTABI ponta a ponta (workspaces, dashboards, gráficos, Data Prep, Copilot, compartilhamento, exportação, atualização, painéis de stream).
- DATTAX — Guia da Linguagem — linguagem DATTAX (fontes, transformações, catálogo GDS completo, primitivas de IA, streaming, materialização, exemplos ponta a ponta).
- DATTA Extract — Guia do Usuário — Extract Pipeline + Quick Extract (designer, componentes, destinos).
- Gerenciamento de Conexões — Guia do Usuário — gerenciamento de conexões (tela de administração, cadastro inline, catalogação automática, visibilidade).
- Co-pilot de Recurso — Peça Recursal Real e Fundamentada — Co-pilot de Recurso (peça recursal real fundamentada em artigos + jurisprudência, download .docx, Continuar no Chat).
- Triagem em Lote — Triagem em Lote (janela de progresso ao vivo, tudo-ou-nada, laudo pesquisável, decisão + cabimento de recurso).
- Upload e Ingestão de Documentos — upload e ingestão (contexto de destino obrigatório, feed de entidades reconhecidas em tempo real, retomada pós-refresh).
- Detalhe da Auditoria do Processo — detalhe da auditoria (Anomalia Detectada, Resumo do Processo, regras sem contexto).
Guias de administração
Para administradores da plataforma:
- Drivers JDBC — Catálogo Oficial e Governança — drivers JDBC (catálogo oficial de 43 drivers, carga inicial, governança, download manual).
- Gerenciar Contextos — tela Sistema → Contextos (criar/editar/atualizar/limpar/excluir contexto, Matriz de Visibilidade por funcionalidade).
- Contexto multi-fonte — contexto multi-fonte (dataSources) + base de código processual (
codigoProcessualDatabase). - Histórico Completo de Execuções — histórico completo de execuções (armazenamento durável, filtro por período, reconciliação de tarefas órfãs).
Runbooks operacionais
- Runbook — dattabi-pool (node pool) — node pool
dattabi-pool(provisionamento na nuvem e local, cotas, escala automática, rede, troubleshooting). - Runbook — Streaming (F9) — Kafka (Strimzi), Debezium Connect, Pulsar, CDC do Neo4j, leitura periódica do OpenSearch e o pool dedicado de streaming.
- Runbook — Gestão de Conexões — operação do cadastro central de conexões (implantação, rotação da chave de criptografia, ajuste da catalogação automática, backup/restore, auditoria, conexões órfãs).
- Runbook — Resposta a Incidentes — playbooks para incidentes comuns (Kafka fora do ar, Neo4j sem memória, cache indisponível, motor DATTAX sobrecarregado, varredura de driver bloqueada, OpenSearch lenta, erros 5xx na porta de entrada).
- Runbook — Operações Spark — Spark (submissão, cancelamento, logs, UI nativa, escala, troubleshooting).
Administração do Spark
- Spark Admin Console (Fase 4.6) — visão geral da administração do Spark (quatro fontes agregadas: recursos do cluster, API do driver, History Server, métricas).
- Spark Admin — Arquitetura — arquitetura, cache em dois níveis, observador de recursos, proxy reverso.
- Spark History Server — implantação do Spark History Server e configuração dos logs de eventos.
Console de infraestrutura
- Console de Infraestrutura — console de infraestrutura do DATTA (aplicações, configurações, credenciais, volumes, tarefas e tarefas agendadas, eventos, nós, escala automática, operadores).
- Console de Infraestrutura — Arquitetura — coleta, métricas e cache; observador de eventos; fluxo de mutação destrutiva.
- Console de Infraestrutura — RBAC e auditoria — níveis PLATFORMVIEW / PLATFORMADMIN / PLATFORM_SENSITIVE, limites de taxa, formato dos eventos de auditoria.
- Runbook — Operações de Plataforma — equivalência entre os comandos de linha de comando e o console (referência de conformidade com a regra de operar tudo pela interface).
Cluster e node pools
- Cluster Management (Fase 4.9) — visão geral da gestão de cluster (node pools, entrada de hosts, plano de controle, certificados, etcd, manutenção, provisionamento declarativo).
- Node Pools — conceito de pool, padrões iniciais, operações em lote, cotas de recurso.
- Host Registration (Join) — fluxo de entrada de host por distribuição, assistido por SSH, pré-checagem e troubleshooting.
- Certificate Rotation — monitor automático + rotação por tarefa + procedimento de rollback.
- etcd Operations — snapshot, restauração, saúde e destino do armazenamento.
- CAPI Integration (opcional) — detecção em runtime, escala de máquinas, instalação local.
- SSH hardening — Fase 4.10 — cliente SSH embarcado, cofre AES-GCM para credenciais, known-hosts TOFU, rotação, revogação e listagem.
- Upgrade Automation — Fase 4.10 — máquina de estados de sete fases, verificações antes e depois, atualização em ondas, rollback honesto, portões de aprovação.
- Cluster Operations Runbook — equivalência de mais de 40 comandos de linha de comando no console.
- Runbook — Upgrade do cluster — passo a passo do upgrade (pré-requisitos, portões, rollback, verificação).
- Node Maintenance — fluxos de manutenção de nó (patch, atualização do agente, drenagem em ondas).
Instalação dia zero
- Instalador Day-0 (DATTA) — visão geral do dia zero.
- ClusterBlueprint — campos — campos do blueprint de instalação.
- Matriz de distros — Fase 4.11 — matriz distribuição × sistema operacional.
- Opções de CNI — Fase 4.11 — rede do cluster (Cilium padrão, Calico/Flannel como alternativas).
- Instalação air-gapped (sem internet) — proxy HTTP e registry offline para ambientes sem internet.
- Runbook — Day-zero install do DATTA — instalação do zero, do começo ao fim.
- Runbook — Habilitar ISO builder (Packer) — habilitar a geração de imagem de instalação.
Subconsoles da camada de dados
- Console da Camada de Dados — cinco subconsoles (Neo4j, OpenSearch, cache da plataforma, Kafka e IA) consolidados em um só lugar.
- Console da Camada de Dados — Arquitetura — organização interna, cache, RBAC em três níveis, eventos de auditoria e delegação ao console de infraestrutura.
- Runbook — Operações Neo4j — ciclo de vida dos bancos, cluster, índices, usuários, Cypher somente leitura, backup/restore.
- Runbook — Operações OpenSearch — saúde do cluster, índices, políticas de ciclo de vida, ferramentas de consulta, snapshots, dashboards.
- Runbook — Operações do cache da plataforma — cache da plataforma: cluster de seis nós, explorador de chaves (com segredos mascarados), failover, estatísticas de comandos.
- Runbook — Operações Kafka — tópicos, grupos de consumo e reset de offsets, prévia de mensagens, conectores Debezium, registro de schemas.
- Runbook — Operações LLM / vLLM — modelos de IA, provedores (local ou externo), uso e custos, catálogo.
Arquitetura
- Arquitetura — Visão geral — visão geral, componentes e fluxos principais.
- Arquitetura — Data Access — as três camadas de acesso a dados (drivers → cadastro de conexões → execução interativa e em lote), matriz JDBC vs. conector nativo e o fluxo da catalogação automática.
- Arquitetura — DATTABI Data Mesh — planejador de materialização, destinos (Iceberg/Neo4j/OpenSearch), políticas de atualização e linhagem.
- Arquitetura — Copilot e LLM — chat e gestão de modelos, Copilot em edição vs. visualização, narrativa, RAG e as primitivas de IA do DATTAX.
- Arquitetura — Streaming — viabilidade por fonte, enriquecimento, janelas, estado, WebSocket/SSE.
- Arquitetura — Segurança — matriz RBAC, cofre de credenciais, catálogo de eventos de auditoria, limites de taxa, circuit breakers e proteções contra acesso indevido.
- Consistência do nome de banco Neo4j ponta a ponta — nome de banco canônico ponta a ponta, banco de destino nunca adivinhado (ingestão) e resolução dinâmica do banco de contexto (Diretrizes do Projeto §9).
- Arquitetura — Busca Textual Semântica no Histórico de Chat — busca textual semântica (KNN+BM25 via RRF) no histórico de chat, escopada por usuário.
- Resiliência do NER/Gemini — 429, throttle e rotação de chave — resiliência do reconhecimento de entidades (novas tentativas com espera progressiva, limitação global, rotação de chave).
- Retrieval da Triagem — identificador genérico por contexto — retrieval da triagem por identificador genérico (KNN+BM25 por RRF), resolução via configuração do contexto, ligação processo↔trecho e o conserto durável da ingestão.
Validação da GA
- GA Checklist — Auditoria das Diretrizes do Projeto — auditoria das Diretrizes do Projeto item a item.
- Security Review — Pre-GA — revisão de segurança (injection, SSRF, acesso indevido, credenciais, limite de taxa, auditoria).
- Architecture Review — Pre-GA — revisão arquitetural (responsabilidade única, acoplamento, escalabilidade, observabilidade, recuperação de desastre).
- Known Issues — Pre-GA — itens pós-GA com severidade.
- Perguntas de Revisão — Validação Pré-GA — perguntas de revisão a submeter antes do GA.
Referência DATTAX
- DATTAX — Catálogo de Algoritmos de Grafo (Neo4j GDS) — catálogo completo dos algoritmos de grafo do Neo4j GDS (mais de 30).
- DATTAX Streaming — Sintaxe — sintaxe de streaming.
Infraestrutura (resumos)
- Node Pools DATTA — resumo dos node pools.
- Drivers JDBC — Catálogo Oficial e Governança — gestão de drivers JDBC.
- Arquitetura — Streaming — streaming e CDC.
Datta Intelligent Query Layer (ex-SIQL)
- Datta Intelligent Query Layer — Discovery e Fundações — Fase 0 (mapeamento do stack atual).
- datta-intelligent-query-layer — Arquitetura (Fase 1 MVP) — desenho técnico, contratos e knowledge graph.
- DATTA Intelligent Query Layer — Arquitetura Fase 2 — Fase 2 (telemetria + observados + inferidos iniciais).
- DATTA Intelligent Query Layer — Arquitetura da Fase 3 (Learning Layer) — Fase 3 (aprendizagem offline/nearline + GDS + feature store).
- SIQL — Fase 4 — Manutenção Física (Physical Maintenance) — Fase 4 (manutenção física de Iceberg).
- SIQL — Fase 5: Semantic + Ontology + vLLM Assistance — Fase 5: ontologia + assistência de IA + NL-to-SQL.
- SIQL — Fronteiras de Uso do LLM — crítico: fronteiras do uso da IA no SIQL.
- SIQL — NL-to-SQL — desenho e trilhos de segurança do NL-to-SQL.
- datta-intelligent-query-layer — Runbook operacional — implantação, rollback, métricas, alertas e troubleshooting.
- SIQL Fase 2 — Plano de Benchmark — critérios de GA por fase (inclui metas da Fase 5).
- datta-intelligent-query-layer — Integração com Apache Trino — como instalar o plugin no Trino existente.
- SIQL Trino Admin Console (Fase 4.5) — console de administração do Trino.
- Configurando políticas de manutenção por tabela — políticas de manutenção física.
- SIQL — Model Registry — registro dos modelos aprendidos.
Outros
- Configuração: Trino 480 (Substitui Impala) — configuração do Trino.
- Guia: DATTA Notebook Multi-Fonte e DATTA Notebook — documentação e exemplos — ambiente de Notebook.
- Arquitetura do Data Catalog + Ontologia -- Plataforma DATTA — catálogo e ontologia.
- Arquitetura ETL/Pipeline -- Plataforma DATTA — pipeline de ETL.
- Vendoring das bibliotecas de runtime do frontend (§6/§15/§17) — bibliotecas de frontend servidas pela própria plataforma.
- Guia: vLLM como Provedor Opcional (Air-gapped / Custo) — migração do motor de inferência local.
Para desenvolvedores e integrações
Praticamente tudo o que a interface faz também está disponível por API — consulte a visão geral da API do DATTA e a referência de endpoints.