Trabalhos selecionados

Trabalhos selecionados em infraestrutura de IA, PLN e pesquisa aplicada.

Em produção

Molcajete

Pipeline de transcrição e análise com IA para pesquisa política qualitativa.

Pipeline completo, do áudio bruto ao insight final, no lugar de transcrição cheia de erros e horas de anotação por projeto. Diarização de falantes, transcrição, classificação de temas e relatórios integrados — tudo numa camada de ferramentas que pesquisadores realmente usam.

2,000+
horas de áudio processadas
<60 min
tempo de entrega por projeto

Adapta

Infraestrutura de fine-tuning de LLMs e pipeline de pré-processamento de dados para análise política em espanhol mexicano.

Modelos LLM especializados, fruto de um pipeline reprodutível de fine-tuning e avaliação. Permite a comparação empírica de modelos base e prompts.

40+
métricas de avaliação
100+
execuções de treino

Nopalero

Sistema automatizado de triagem de participantes para recrutamento qualitativo.

Pipeline automatizado de triagem que substitui horas de digitação manual por projeto. Combina OCR, detecção de fraude e classificação socioeconômica — para que os analistas foquem nas decisões, não no trabalho burocrático.

48
verificações de validação
0
entrada manual de dados

Azulejo

Transforma anotações soltas em um PowerPoint editável e com a identidade da marca, ao toque de um botão.

O template da marca é codificado uma vez, e cada slide sai em conformidade por construção. O conteúdo vive em texto simples e os slides são regenerados a partir dele, versionáveis e reproduzíveis como código. O resultado é um .pptx padrão que qualquer um pode editar, sem plataforma no meio.

94
templates de layout
<5 s
para reconstruir 50 slides

Código aberto

Scraper de processos do Supremo Tribunal Federal (STF).

CLI em Python baseada em Typer, com três etapas cache-first — coleta, download e extração. Suporta execuções massivamente paralelas com rotação de proxy e alimenta um warehouse DuckDB. Vários backends de OCR, incluindo Tesseract auto-hospedado no fly.io para inferência de baixo custo.

R$ 52
varredura anual de HC
0.93/s
vazão de PDFs
0.28/s
vazão de processos
4
backends de OCR

CLI para um agente de IA organizar uma biblioteca Zotero.

Verifica etiquetas, metadados e pastas; enriquece metadados com Crossref e arXiv; comprime PDFs. Implementa um ciclo de validação com backups e write-ahead logs — o que torna seguro deixar um agente de IA mexer no banco de dados.

Tem um problema que não entra numa caixinha?

Os projetos acima começaram com alguém dizendo isso.

Conte mais