Home→Research

Pesquisa Científica Aplicada e Sistemas Complexos

Esta coleção reúne a pesquisa de Ulisses Flores. Primeiro vêm os artigos com texto integral na própria página, publicados desde julho de 2026 sobre temas como detecção de fraude, modelos de linguagem e busca em registros de ensaios clínicos; cada um traz data, versão, o DOI do depósito no Zenodo e o repositório com código e dados. Em seguida vêm obras anteriores, sem DOI. Nenhuma obra desta coleção saiu em periódico.

Rastreabilidade no lugar de selo

Os artigos com texto integral são auto-publicados: o texto, ou o pacote de replicação que o acompanha, é depositado no Zenodo, que atribui o DOI. O DOI identifica o depósito e leva a ele; não é selo de revisão. Nenhum desses artigos passou por revisão por pares de periódico, e a página de cada um diz isso na linha de estado. No lugar do selo fica o método aberto: código, dados e versão públicos, para quem quiser refazer a conta.

Consultor Estratégico de IACientista de DadosMestrando AGTUPublicações com DOISistemas Complexos

4 artigos com texto integral na página

Pesquisa2026-09-04Relatório técnico (depósito no Zenodo)v1.1.1

When a trial registry outsources its own search: measured defects in the public search of ReBEC

Contexto. O Registro Brasileiro de Ensaios Clínicos (ReBEC) é um registro primário da Plataforma Internacional de Registros de Ensaios Clínicos (ICTRP) da Organização Mundial da Saúde. Revisores sistemáticos, jornalistas, profissionais de saúde e pacientes buscam nele e agem com base no que ele devolve — inclusive com base no que ele não devolve. Este relato mede essa interface e conclui que ela não consulta o banco do registro. Método. Medimos a busca pública do ReBEC em 25 de agosto de 2026 (UTC) por cinco rotas independentes: (i) o HTML servido pelo endpoint de busca; (ii) a busca feita ao vivo num navegador comum; (iii) DNS e TLS dos hosts envolvidos; (iv) a configuração publicada do buscador; e (v) capturas independentes de terceiro, feitas pelo Internet Archive. O recall foi medido comparando conjuntos de identificadores de ensaios, nunca pela estimativa de resultados que a interface exibe. Toda busca usou controle positivo. Resultados. A busca pública do ReBEC não consulta o banco do registro. Ela é um Google Custom Search sobre as páginas do site, executado no navegador do visitante. Os defeitos abaixo não são três faltas independentes do registro: (2) e (3) são o que essa decisão única produz, e (1) é onde ela encontra uma configuração de certificado à parte. (1) A caixa de busca da própria página inicial envia o visitante a um nome de host (`www.ensaiosclinicos.gov.br`) que o certificado TLS do site não cobre; no Chrome atual, a busca terminava, na data medida, num aviso de segurança do navegador; este defeito foi consertado ainda no mesmo dia, e o conserto está registrado, datado e medido, na §5.1. (2) A resposta servida não varia com a consulta: seis termos diferentes devolveram HTTP 200 com um corpo byte a byte idêntico (69.877 bytes, um único SHA-256). A filtragem ocorre apenas em JavaScript no cliente — logo, todo cliente sem JavaScript (scripts, coletores e arquivos da web) recebe uma página de busca que nunca filtra. (3) Para o termo `dengue`, o banco devolve 17 ensaios e a busca pública entrega 14 deles (recall 14/17); duas das ausências são falhas de índice atribuíveis: a página do ensaio existe, contém o termo buscado, e ainda assim não é devolvida. Capturas do Internet Archive mostram o comportamento do defeito 2 já presente em 23 de setembro de 2025, onze meses antes da nossa medição — dois pontos medidos, não uma série contínua. Conclusões. Um registro primário do ICTRP pode apresentar uma busca que parece consulta a banco de dados, é na verdade um índice de terceiro com cobertura incompleta, e falha de maneiras invisíveis a quem busca. Relatamos isso como propriedade observável de um sistema público, sem nenhuma afirmação sobre intenção, e liberamos os instrumentos para que o achado expire no dia em que for corrigido.

#registros de ensaios clínicos#ReBEC#ICTRP/OMS#interfaces de busca#falha silenciosa#infraestrutura de pesquisa
Pesquisa2026-08-26Auto-publicado (depósito no Zenodo)v1.0.0

The Noisy TV in the Measurement Channel: Unbudgeted Instrument Noise in the Intrinsic-Motivation Instrumentation of LLM Agents

Curiosity-driven agents can be captured by irreducible stochasticity in their environment — the noisy-TV problem (Burda et al., 2019a). Reinforcement learning located that failure in the reward channel and fixed it there. We argue that in LLM agents the same failure can re-emerge one step earlier, in the measurement channel: the embedder, the displacement or coverage metric, and the sampling temperature that together turn generated text into a novelty number. That instrument carries a noise floor, so a motivational trigger computed on it can fire on measurement noise before any reward exists. This is a metrological statement, and we treat it with metrology’s own tools, imported rather than invented: measure the floor under a repetition null, publish it, and state the trigger threshold in units of it. We demonstrate the protocol in a clean-room harness whose corpus, code, pre-registration and results are sealed in a hash-chained provenance spine, with a post-data amendment — declared as such — that corrects the measurand to the perturbation of the retrieval score term, |Δcos(q, m)|, after an external review. Every headline number below is computed under that amendment and is exploratory rather than pre-registered; of the pre-registered break conditions, only one arm could break in practice, and it did not. In the configuration of a real deployed instance (feature hashing at d = 32), the resampling floor of the score term is 0.2507 RMS: 2.211 times one day of recency decay (nominal 95% CI, reported as the envelope of two disjoint pair partitions, [2.163; 2.260]) and 2.507 times one importance point — a floor that is analytically predictable at ‖δ‖/√d — ≈ √(2/d) here — and that no audited system had predicted or budgeted. Even a well-dimensioned semantic encoder spends 0.576 of one day of decay on pure resampling noise, and a bare novelty threshold numerically equal to one importance point of the score fires on pure resampling at a rate incompatible with zero in this vault and encoder: the two disjoint partitions give 15.3% and 8.1% (parity p = 0.028, printed rather than averaged away), the semantic encoder gives 5.7%, and the 384-dimensional hash control gives 0%. An audit of eight deployed agent-memory systems finds none that expresses its gate threshold in units of its own instrument’s floor. What this paper demonstrates is the floor and the false triggers it produces under a fixed stimulus; that a deployed agent is captured by them in closed loop is the hypothesis this measurement makes testable, not a result it shows. We ship the audit, the sealed harness, and a calibration tool that emits the floor, the floor in signal units, and the threshold in floor units for any (embedder, vault, stimulus) triple — shipped sealed, with its five-item fix queue published rather than patched silently, then executed at the dated 2026-08-13 re-seal.

#noisy TV#intrinsic motivation#measurement channel#noise floor#LLM agent#embedder#repetition null#anisotropy#calibration#pre-registration#metrology#Goodhart
Pesquisa2026-08-02Auto-publicado (depósito no Zenodo)v1.1.0

O limiar importa mais que o modelo: dominância do ponto de operação na detecção de fraude em cartões

Detectar fraude em cartões de crédito é um problema de classe rara — no benchmark público ULB/Worldline, apenas 0,173% das 284.807 transações são fraudulentas — e a literatura disputa há anos qual arquitetura de modelo detecta melhor. Este artigo mede uma pergunta anterior e mais prática: quanto do desempenho operacional vem da escolha da arquitetura, e quanto vem de um único escalar, o limiar de decisão (o ponto de operação) selecionado em validação sob reponderação de custo. Quatro famílias — Perceptron de Múltiplas Camadas (MLP), Regressão Logística (LR), Autoencoder e Isolation Forest — são comparadas sob protocolo auditável, sem vazamento de pré-processamento, com dados ancorados por SHA-256 e determinismo verificado por reexecução idêntica. A assimetria encontrada é de duas ordens de magnitude: deslocar o limiar do MLP do valor-padrão 0,5 para o ótimo de validação (0,9994) eleva o F1 de teste de 0,267 para 0,812, enquanto trocar a arquitetura desloca −0,007, com intervalo bootstrap pareado de 95% [−0,055; +0,042] — indistinguível de zero e menor que o desvio-padrão de treino do próprio MLP sob 20 sementes (0,016). Uma aparente vitória do MLP (ΔF1 = +0,053, intervalo excluindo zero) é demonstrada como artefato de protocolo: a grade de limiares herdada do material precedente, truncada em 0,99, fabricava a diferença. Conclui-se que a alavanca dominante de engenharia e de governança é o acoplamento entre reponderação de custo e limiar auditável, não a família do modelo — e que micro-decisões de protocolo bastam para inverter conclusões de comparações de arquitetura.

#detecção de fraude#classe rara#ponto de operação#aprendizado sensível a custo#vazamento de dados#reprodutibilidade
Pesquisa2026-07-19Auto-publicado (depósito no Zenodo)v0.1.1

Grounding Doesn't Pay: A Token-Matched Negative Result on Creative Diversity

Multi-agent creative generation is widely argued to gain semantic diversity from heterogeneous agents — distinct personas, roles, or domain grounding (Wang L. et al., 2024; Ueda et al., 2025). We ask a budget-aware version of that question: does grounding a generator in a real, in-context domain specification buy more token-efficient diversity than plain repeated sampling or a cheap style-persona label, when the token budget is matched? We run a small ($0.26), pre-registered, judge-free pilot — three arms under one model, one temperature, and a fixed idea count, over two creative queries — scoring diversity as distinct domain-blind embedding clusters. Grounding is not inert: on the agglomerative view it adds real per-proposal diversity over plain repeated sampling (+0.19 to +0.26 clusters per idea), a gain that is itself algorithm-scoped (it reverses under HDBSCAN). But it is never the token-efficient frontier. A distinct-cluster count is bounded above by the fixed idea count, so a specification that costs 6.8× the input tokens for at most 1.8× the achievable clusters cannot be the per-token frontier for any outcome; grounding loses to plain repeated sampling per token under both clustering algorithms and both embedding encoders, and stays below the cheap frontier under any prompt-caching regime constructible from these tokens. The efficient frontier is a cheap arm, and the conclusion about agent heterogeneity depends on the budget accounting: grounding wins per proposal and loses per token. We scope the result to one model family (Grok-4.20, non-reasoning), two creative queries, and in-context specifications, leaving targeted retrieval open.

#token-efficient diversity#multi-agent generation#negative result#pre-registration#embedding clustering#budget-matched accounting#encoder robustness

7 Publicações

research2025ScholarlyArticle

A Lei de Little como Vetor de Resiliência e Qualidade

Estudo sobre aplicacao da Lei de Little para elevar previsibilidade de entrega e resiliencia em operacoes de Data Science. A evidencia indica reducao relevante de lead time sem perda material de throughput, reforcando a eficiencia da limitacao de WIP. Pergunta central: Como a abordagem proposta em "A Lei de Little como Vetor de Resiliência e Qualidade" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#LITTLE#LAW#RESILIENCE
research2025ScholarlyArticle

Análise Preditiva de Ativos Financeiros com Modelos LSTM

Analise preditiva de ativos financeiros com redes LSTM para capturar dinamica temporal em mercados nao estacionarios. O estudo evidencia ganho de sinal preditivo em janelas especificas e melhora de robustez quando o treinamento respeita ordem temporal. Pergunta central: Como a abordagem proposta em "Análise Preditiva de Ativos Financeiros com Modelos LSTM" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#LSTM#ASSET#PREDICTION
research2024ScholarlyArticle

Análise Historiográfica e Arqueológica Exaustiva: A Historicidade de Jesus

Pesquisa historiografica sobre historicidade de Jesus combinando critica textual, fontes antigas e evidencias arqueologicas. O estudo delimita consenso academico minimo e identifica zonas de alta e baixa confianca documental. Pergunta central: Como a abordagem proposta em "Análise Historiográfica e Arqueológica Exaustiva: A Historicidade de Jesus" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#HISTORICITY#JESUS#ARCHAEOLOGY
research2024ScholarlyArticle

Bitcoin como Ativo de Reserva e a Teoria da Moeda na Escola Austríaca

Analise do Bitcoin como ativo de reserva sob praxeologia e teoria monetaria da Escola Austriaca. O artigo sustenta que Bitcoin combina previsibilidade de emissao e portabilidade digital com implicacoes macroeconomicas relevantes. Pergunta central: Como a abordagem proposta em "Bitcoin como Ativo de Reserva e a Teoria da Moeda na Escola Austríaca" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#BITCOIN#PRAXEOLOGY
research2024ScholarlyArticle

Canonização Escribal: Análise Histórico-Crítica da Formação do Cânon

Estudo historico-critico sobre canonizacao escribal e processos de consolidacao textual associados a Esdras. A pesquisa destaca dinamica incremental de consolidacao canonica com mediação institucional e escribal. Pergunta central: Como a abordagem proposta em "Canonização Escribal: Análise Histórico-Crítica da Formação do Cânon" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#SCRIBAL#CANONIZATION#EZRA
research2023ScholarlyArticle

A Coroa e a Cruz: Análise Teológica e Fenomenológica das Aparições Marianas

Analise teologica e fenomenologica critica de narrativas de aparicoes marianas. O estudo distingue elementos simbolicos, historicos e pastorais sem reduzir o fenomeno a uma unica explicacao. Pergunta central: Como a abordagem proposta em "A Coroa e a Cruz: Análise Teológica e Fenomenológica das Aparições Marianas" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#MARIAN#APPARITIONS#CRITIQUE
research2023ScholarlyArticle

O Clube Santo: Arqueologia Espiritual, Teológica e Visual do Metodismo

Investigacao arqueologica espiritual, teologica e visual do Holy Club e suas implicacoes para o metodismo. O estudo reconstrói redes de praticas formativas e disciplina comunitaria no contexto original. Pergunta central: Como a abordagem proposta em "O Clube Santo: Arqueologia Espiritual, Teológica e Visual do Metodismo" pode reduzir risco sistemico e ampliar confiabilidade decisoria em ambiente real? A pagina publica apresenta sintese cientifica e o PDF consolidado contem a versao completa para citacao formal.

#HOLY#CLUB#METHODISM