PT EN
Voltar ao site

Bem-vindo ao DATTA

Sua organização tem dados demais e respostas de menos: documentos espalhados, sistemas que não conversam entre si e análises que dependem de especialistas e de semanas de espera. O DATTA reúne busca inteligente, análise assistida por IA, dashboards e automação de dados em uma única plataforma — dentro da sua própria infraestrutura — para que qualquer pessoa do time encontre, entenda e use a informação em minutos.

Esta é a porta de entrada da documentação. Aqui você tem um panorama do que a plataforma faz e os caminhos para se aprofundar em cada capacidade. Se quiser começar pelo "porquê", veja por que o DATTA existe e quais problemas ele resolve.


O que você pode fazer com o DATTA

Perguntar, em vez de procurar

Digite uma pergunta em português — no Chat da página inicial — e receba uma resposta redigida pela IA junto com os documentos que a sustentam, com fontes citadas. A busca entende o significado da pergunta, não apenas as palavras exatas. Veja o guia da busca e como personalizar as respostas da IA com o seu próprio prompt.

Analisar o acervo inteiro, não uma amostra

A Triagem em Lote aplica suas regras de conformidade a todos os processos de um contexto, classifica cada um — CONFORME ou ANOMALIA — e justifica a decisão com trechos citados. Detalhes no guia da triagem em lote e no detalhe da auditoria de um processo.

Montar dashboards sem depender do time de BI

No DATTA BI você constrói dashboards interativos arrastando campos, cruza fontes diferentes no mesmo painel e publica para o time — com um copilot que sugere visuais e narra os resultados. Comece pelo guia completo do DATTABI.

Integrar e transformar dados sem escrever infraestrutura

O DATTA Extract desenha pipelines de extração e carga de forma visual, e a linguagem DATTAX descreve transformações, grafos e materializações em poucas linhas. Veja o guia do Extract e a referência da linguagem DATTAX.

Explorar dados com código, quando o código é a ferramenta certa

O ambiente de Notebook (InvestigaçãoNotebook) oferece um Jupyter integrado à plataforma, com acesso pronto a SQL (Trino), grafos (Neo4j, em Cypher), busca textual (OpenSearch) e PySpark — e um

Conectar suas fontes com governança

Toda conexão a banco de dados ou fonte externa é cadastrada em SistemaConexões e catalogada automaticamente: minutos depois de conectar, as tabelas já aparecem no Knowledge Catalog, com amostras e métricas de qualidade. Veja o guia de conexões.

Automatizar fluxos de trabalho

O DATTA BPM modela e executa processos de negócio (triagem, revisão, aprovação) com monitoramento em tempo real. Comece pelo guia do motor de processos.


Primeiros passos

Um roteiro de dez minutos para sentir a plataforma funcionando:

  1. Entre na plataforma com o usuário fornecido pelo seu administrador. Você chega na página inicial, com o campo de busca ao centro.
  2. Faça uma pergunta real do seu dia a dia — por exemplo, "quais processos citam prescrição intercorrente?" — e tecle Enter.
  3. Observe a tela se montar: os cards de documentos aparecem primeiro, e a resposta da IA vai sendo redigida em tempo real logo acima.
  4. Abra o menu lateral e explore as seções — Descobrir, Investigação, Processar, Sistema. Cada tela mostra uma trilha de navegação no topo para você nunca se perder.
  5. Peça ao administrador um workspace para o seu time — ele agrupa contextos, funcionalidades e painéis em um só lugar no menu.

Como esta documentação está organizada

Esta documentação é servida pela própria plataforma, no Portal de Documentação: aberto, bilíngue pt-BR/EN, com busca instantânea e navegação anterior/próximo. A seção de plataforma e operações aparece apenas para quem tem permissão de plataforma — se ela não está no seu menu, é porque seu perfil não a alcança.

O menu lateral é o mapa: as seções agrupam os temas, a busca cobre o texto inteiro de todas as páginas visíveis para você, e o seletor de idioma troca entre português e inglês sem sair da página.


Mapa da documentação

Guias do usuário

Para analistas, editores de dashboards e operadores de pipeline:

  • DATTABI — Guia do Usuário — DATTABI ponta a ponta (workspaces, dashboards, gráficos, Data Prep, Copilot, compartilhamento, exportação, atualização, painéis de stream).
  • DATTAX — Guia da Linguagem — linguagem DATTAX (fontes, transformações, catálogo GDS completo, primitivas de IA, streaming, materialização, exemplos ponta a ponta).
  • DATTA Extract — Guia do Usuário — Extract Pipeline + Quick Extract (designer, componentes, destinos).
  • Gerenciamento de Conexões — Guia do Usuário — gerenciamento de conexões (tela de administração, cadastro inline, catalogação automática, visibilidade).
  • Co-pilot de Recurso — Peça Recursal Real e Fundamentada — Co-pilot de Recurso (peça recursal real fundamentada em artigos + jurisprudência, download .docx, Continuar no Chat).
  • Triagem em Lote — Triagem em Lote (janela de progresso ao vivo, tudo-ou-nada, laudo pesquisável, decisão + cabimento de recurso).
  • Upload e Ingestão de Documentos — upload e ingestão (contexto de destino obrigatório, feed de entidades reconhecidas em tempo real, retomada pós-refresh).
  • Detalhe da Auditoria do Processo — detalhe da auditoria (Anomalia Detectada, Resumo do Processo, regras sem contexto).

Guias de administração

Para administradores da plataforma:

  • Drivers JDBC — Catálogo Oficial e Governança — drivers JDBC (catálogo oficial de 43 drivers, carga inicial, governança, download manual).
  • Gerenciar Contextos — tela Sistema → Contextos (criar/editar/atualizar/limpar/excluir contexto, Matriz de Visibilidade por funcionalidade).
  • Contexto multi-fonte — contexto multi-fonte (dataSources) + base de código processual (codigoProcessualDatabase).
  • Histórico Completo de Execuções — histórico completo de execuções (armazenamento durável, filtro por período, reconciliação de tarefas órfãs).

Runbooks operacionais

  • Runbook — dattabi-pool (node pool) — node pool dattabi-pool (provisionamento na nuvem e local, cotas, escala automática, rede, troubleshooting).
  • Runbook — Streaming (F9) — Kafka (Strimzi), Debezium Connect, Pulsar, CDC do Neo4j, leitura periódica do OpenSearch e o pool dedicado de streaming.
  • Runbook — Gestão de Conexões — operação do cadastro central de conexões (implantação, rotação da chave de criptografia, ajuste da catalogação automática, backup/restore, auditoria, conexões órfãs).
  • Runbook — Resposta a Incidentes — playbooks para incidentes comuns (Kafka fora do ar, Neo4j sem memória, cache indisponível, motor DATTAX sobrecarregado, varredura de driver bloqueada, OpenSearch lenta, erros 5xx na porta de entrada).
  • Runbook — Operações Spark — Spark (submissão, cancelamento, logs, UI nativa, escala, troubleshooting).

Administração do Spark

  • Spark Admin Console (Fase 4.6) — visão geral da administração do Spark (quatro fontes agregadas: recursos do cluster, API do driver, History Server, métricas).
  • Spark Admin — Arquitetura — arquitetura, cache em dois níveis, observador de recursos, proxy reverso.
  • Spark History Server — implantação do Spark History Server e configuração dos logs de eventos.

Console de infraestrutura

  • Console de Infraestrutura — console de infraestrutura do DATTA (aplicações, configurações, credenciais, volumes, tarefas e tarefas agendadas, eventos, nós, escala automática, operadores).
  • Console de Infraestrutura — Arquitetura — coleta, métricas e cache; observador de eventos; fluxo de mutação destrutiva.
  • Console de Infraestrutura — RBAC e auditoria — níveis PLATFORMVIEW / PLATFORMADMIN / PLATFORM_SENSITIVE, limites de taxa, formato dos eventos de auditoria.
  • Runbook — Operações de Plataformaequivalência entre os comandos de linha de comando e o console (referência de conformidade com a regra de operar tudo pela interface).

Cluster e node pools

  • Cluster Management (Fase 4.9) — visão geral da gestão de cluster (node pools, entrada de hosts, plano de controle, certificados, etcd, manutenção, provisionamento declarativo).
  • Node Pools — conceito de pool, padrões iniciais, operações em lote, cotas de recurso.
  • Host Registration (Join) — fluxo de entrada de host por distribuição, assistido por SSH, pré-checagem e troubleshooting.
  • Certificate Rotation — monitor automático + rotação por tarefa + procedimento de rollback.
  • etcd Operations — snapshot, restauração, saúde e destino do armazenamento.
  • CAPI Integration (opcional) — detecção em runtime, escala de máquinas, instalação local.
  • SSH hardening — Fase 4.10 — cliente SSH embarcado, cofre AES-GCM para credenciais, known-hosts TOFU, rotação, revogação e listagem.
  • Upgrade Automation — Fase 4.10 — máquina de estados de sete fases, verificações antes e depois, atualização em ondas, rollback honesto, portões de aprovação.
  • Cluster Operations Runbookequivalência de mais de 40 comandos de linha de comando no console.
  • Runbook — Upgrade do cluster — passo a passo do upgrade (pré-requisitos, portões, rollback, verificação).
  • Node Maintenance — fluxos de manutenção de nó (patch, atualização do agente, drenagem em ondas).

Instalação dia zero

  • Instalador Day-0 (DATTA) — visão geral do dia zero.
  • ClusterBlueprint — campos — campos do blueprint de instalação.
  • Matriz de distros — Fase 4.11 — matriz distribuição × sistema operacional.
  • Opções de CNI — Fase 4.11 — rede do cluster (Cilium padrão, Calico/Flannel como alternativas).
  • Instalação air-gapped (sem internet) — proxy HTTP e registry offline para ambientes sem internet.
  • Runbook — Day-zero install do DATTA — instalação do zero, do começo ao fim.
  • Runbook — Habilitar ISO builder (Packer) — habilitar a geração de imagem de instalação.

Subconsoles da camada de dados

  • Console da Camada de Dados — cinco subconsoles (Neo4j, OpenSearch, cache da plataforma, Kafka e IA) consolidados em um só lugar.
  • Console da Camada de Dados — Arquitetura — organização interna, cache, RBAC em três níveis, eventos de auditoria e delegação ao console de infraestrutura.
  • Runbook — Operações Neo4j — ciclo de vida dos bancos, cluster, índices, usuários, Cypher somente leitura, backup/restore.
  • Runbook — Operações OpenSearch — saúde do cluster, índices, políticas de ciclo de vida, ferramentas de consulta, snapshots, dashboards.
  • Runbook — Operações do cache da plataforma — cache da plataforma: cluster de seis nós, explorador de chaves (com segredos mascarados), failover, estatísticas de comandos.
  • Runbook — Operações Kafka — tópicos, grupos de consumo e reset de offsets, prévia de mensagens, conectores Debezium, registro de schemas.
  • Runbook — Operações LLM / vLLM — modelos de IA, provedores (local ou externo), uso e custos, catálogo.

Arquitetura

  • Arquitetura — Visão geral — visão geral, componentes e fluxos principais.
  • Arquitetura — Data Access — as três camadas de acesso a dados (drivers → cadastro de conexões → execução interativa e em lote), matriz JDBC vs. conector nativo e o fluxo da catalogação automática.
  • Arquitetura — DATTABI Data Mesh — planejador de materialização, destinos (Iceberg/Neo4j/OpenSearch), políticas de atualização e linhagem.
  • Arquitetura — Copilot e LLM — chat e gestão de modelos, Copilot em edição vs. visualização, narrativa, RAG e as primitivas de IA do DATTAX.
  • Arquitetura — Streaming — viabilidade por fonte, enriquecimento, janelas, estado, WebSocket/SSE.
  • Arquitetura — Segurança — matriz RBAC, cofre de credenciais, catálogo de eventos de auditoria, limites de taxa, circuit breakers e proteções contra acesso indevido.
  • Consistência do nome de banco Neo4j ponta a ponta — nome de banco canônico ponta a ponta, banco de destino nunca adivinhado (ingestão) e resolução dinâmica do banco de contexto (Diretrizes do Projeto §9).
  • Arquitetura — Busca Textual Semântica no Histórico de Chat — busca textual semântica (KNN+BM25 via RRF) no histórico de chat, escopada por usuário.
  • Resiliência do NER/Gemini — 429, throttle e rotação de chave — resiliência do reconhecimento de entidades (novas tentativas com espera progressiva, limitação global, rotação de chave).
  • Retrieval da Triagem — identificador genérico por contexto — retrieval da triagem por identificador genérico (KNN+BM25 por RRF), resolução via configuração do contexto, ligação processo↔trecho e o conserto durável da ingestão.

Validação da GA

  • GA Checklist — Auditoria das Diretrizes do Projeto — auditoria das Diretrizes do Projeto item a item.
  • Security Review — Pre-GA — revisão de segurança (injection, SSRF, acesso indevido, credenciais, limite de taxa, auditoria).
  • Architecture Review — Pre-GA — revisão arquitetural (responsabilidade única, acoplamento, escalabilidade, observabilidade, recuperação de desastre).
  • Known Issues — Pre-GA — itens pós-GA com severidade.
  • Perguntas de Revisão — Validação Pré-GA — perguntas de revisão a submeter antes do GA.

Referência DATTAX

  • DATTAX — Catálogo de Algoritmos de Grafo (Neo4j GDS) — catálogo completo dos algoritmos de grafo do Neo4j GDS (mais de 30).
  • DATTAX Streaming — Sintaxe — sintaxe de streaming.

Infraestrutura (resumos)

  • Node Pools DATTA — resumo dos node pools.
  • Drivers JDBC — Catálogo Oficial e Governança — gestão de drivers JDBC.
  • Arquitetura — Streaming — streaming e CDC.

Datta Intelligent Query Layer (ex-SIQL)

  • Datta Intelligent Query Layer — Discovery e Fundações — Fase 0 (mapeamento do stack atual).
  • datta-intelligent-query-layer — Arquitetura (Fase 1 MVP) — desenho técnico, contratos e knowledge graph.
  • DATTA Intelligent Query Layer — Arquitetura Fase 2 — Fase 2 (telemetria + observados + inferidos iniciais).
  • DATTA Intelligent Query Layer — Arquitetura da Fase 3 (Learning Layer) — Fase 3 (aprendizagem offline/nearline + GDS + feature store).
  • SIQL — Fase 4 — Manutenção Física (Physical Maintenance) — Fase 4 (manutenção física de Iceberg).
  • SIQL — Fase 5: Semantic + Ontology + vLLM AssistanceFase 5: ontologia + assistência de IA + NL-to-SQL.
  • SIQL — Fronteiras de Uso do LLMcrítico: fronteiras do uso da IA no SIQL.
  • SIQL — NL-to-SQL — desenho e trilhos de segurança do NL-to-SQL.
  • datta-intelligent-query-layer — Runbook operacional — implantação, rollback, métricas, alertas e troubleshooting.
  • SIQL Fase 2 — Plano de Benchmark — critérios de GA por fase (inclui metas da Fase 5).
  • datta-intelligent-query-layer — Integração com Apache Trino — como instalar o plugin no Trino existente.
  • SIQL Trino Admin Console (Fase 4.5) — console de administração do Trino.
  • Configurando políticas de manutenção por tabela — políticas de manutenção física.
  • SIQL — Model Registry — registro dos modelos aprendidos.

Outros

  • Configuração: Trino 480 (Substitui Impala) — configuração do Trino.
  • Guia: DATTA Notebook Multi-Fonte e DATTA Notebook — documentação e exemplos — ambiente de Notebook.
  • Arquitetura do Data Catalog + Ontologia -- Plataforma DATTA — catálogo e ontologia.
  • Arquitetura ETL/Pipeline -- Plataforma DATTA — pipeline de ETL.
  • Vendoring das bibliotecas de runtime do frontend (§6/§15/§17) — bibliotecas de frontend servidas pela própria plataforma.
  • Guia: vLLM como Provedor Opcional (Air-gapped / Custo) — migração do motor de inferência local.

Para desenvolvedores e integrações

Praticamente tudo o que a interface faz também está disponível por API — consulte a visão geral da API do DATTA e a referência de endpoints.