O que a gente testou,com os números que deram.
Toda técnica de IA chega com uma promessa. A gente reproduz, mede e mostra o que sobra dela na prática: onde funciona, onde quebra e o que custa.
bm253 papers52 chunks
mar2026
Chunking recursivo vs. semântico: 6 estratégias no mesmo corpus
Rodamos seis estratégias de divisão de documento contra 300 perguntas anotadas à mão. O splitter semântico custou 40x mais e perdeu para o recursivo com overlap.
fev2026
O teto real de 16GB: onde LoRA para de caber no M5
Tentamos treinar LoRA em modelos de 1B a 7B num MacBook M5 de 16GB até o sistema começar a swapar. O teto prático é 3B quantizado — e o motivo não é o modelo.
jan2026
Avaliar RAG quando não existe gabarito
Ninguém tem 500 perguntas anotadas no começo do projeto. Testamos três métricas sem referência contra um gabarito real pra ver quais delas mereciam confiança.