
Se um sistema de IA precisa de uma plataforma documental específica antes de conseguir pesquisar uma pasta, tornei a primeira decisão do cliente desnecessariamente cara. Se depois ele precisa de uma conexão com a internet que ninguém informou, tornei a promessa de implantação pouco confiável. O trabalho desta semana no Valeska é eliminar essas duas suposições, não acrescentar mais uma resposta impressionante a uma demonstração.
ECM significa gestão de conteúdo empresarial: os sistemas que uma empresa usa para armazenar, organizar e controlar documentos e registros formais. Alfresco e OpenText Content Server são exemplos. Eles importam quando o trabalho inclui arquivar registros controlados. Não deveriam ser automaticamente o preço de entrada para um experimento delimitado de pesquisa com IA nos documentos da empresa.
Iniciar não é funcionar
O pacote de implantação anterior exigia a configuração do Alfresco. No entanto, a aplicação não precisava fundamentalmente do Alfresco para iniciar ou pesquisar. A dependência pertencia a funções específicas de gestão documental. Em 30 de agosto, separei essas responsabilidades com um pacote autônomo contendo um banco de dados, um mecanismo local de representações vetoriais e a aplicação. Esse mecanismo transforma texto em números que permitem à pesquisa comparar significados, em vez de apenas encontrar palavras iguais.
Essa distinção importa para uma empresa que está decidindo o que avaliar. Um piloto autônomo pode investigar se seus documentos produzem resultados de pesquisa úteis sem antes introduzir uma plataforma completa de gestão documental. Ele não ganha arquivamento formal de registros nem sincronização de permissões do Alfresco simplesmente porque desejamos eliminar essas dependências. Essas funções continuam fora deste pacote.
A identidade é um requisito separado. O trabalho de 25 de agosto adicionou chaves de API revogáveis, credenciais pelas quais os programas que fazem solicitações se identificam, e concentrou a integração de identidade no OpenText Content Server. Remover a exigência de um ECM não autoriza tornar a pesquisa anônima. Na execução posterior em uma máquina limpa, uma solicitação sem autenticação foi de fato recusada. Essa é uma observação útil, não uma avaliação completa de segurança.
O teste desconectado revelou a falsidade
Em 31 de agosto, uma instalação nova expôs um download oculto. Um componente de pesquisa ainda buscava seu modelo na internet durante a operação. Também mantinha esse modelo no armazenamento temporário do contêiner, então recriar a aplicação poderia provocar outro download. A afirmação do meu guia de que nada saía da máquina era ampla demais para o que eu havia entregue.
Executar a imagem da aplicação sem acesso à rede tornou a falha inequívoca. A correção coloca esse modelo na imagem durante a preparação e instrui as bibliotecas correspondentes a operar sem conexão. A verificação agora inclui um teste de carregamento do modelo sem rede. Uma estação de pesquisa isolada precisa de suprimentos antes que a estrada feche; uma entrega bem-sucedida não prova que os armários estejam abastecidos.
A mesma execução expôs uma segunda divergência. O caminho de indexação documentado representava documentos inteiros, enquanto o caminho separado de passagens indexava trechos menores. No conjunto registrado, 44 documentos produziram 931 passagens sem falhas. Uma pesquisa registrada retornou o documento esperado em primeiro lugar. Corrigi o guia para distinguir os caminhos, em vez de tratar um serviço em execução como prova de recuperação útil.
O que posso afirmar esta noite
O repositório registra onze verificações aprovadas na minha máquina. Registra indexação local, uma pesquisa bem-sucedida e a recusa de uma solicitação sem autenticação. O teste desconectado demonstra que o modelo empacotado pode ser carregado sem precisar baixá-lo. São resultados específicos, não uma prova de que todas as funções estejam livres de dependências externas ou de que o datacenter isolado de um cliente já esteja executando esse sistema.
A preparação ainda precisa de pacotes, imagens e arquivos de modelos obtidos antes da transferência para a máquina desconectada. O guia descreve uma avaliação com um conjunto limitado de documentos fora de produção, não uma implantação auditada de forma independente ou testada em escala empresarial. Meu próximo teste será uma segunda máquina limpa, operada por outra pessoa a partir das notas, seguida de um teste deliberado sem o modelo. Se esse operador precisar das conveniências invisíveis da minha máquina de desenvolvimento, o pacote não está pronto. Para quem compra, uma instalação repetível é uma evidência que vale exigir antes de ampliar o piloto.
Base histórica: commits do VALESKA 119537a (25 de agosto de 2026, autenticação), ea893b7 (30 de agosto, implantação autônoma) e bccd700 (31 de agosto, teste do modelo sem conexão e correções de indexação); guia de instalação autônoma em bccd700. Os resultados são testes locais registrados no repositório, não uma validação por clientes.