MIA Platform — QA Reports

Benchmark + métricas de retrieval da Wiki MIA.

🔍 Wiki Benchmark v2 — HTML Navegável (20/05)

NOVO+9.9% Wiki Lift 12 modelos · 5 perguntas adversárias · 3 condições · 180 respostas

Filtros por modelo/pergunta/condição. Side-by-side por modelo (Leve / Média / Sem Wiki). Score do judge (4 dimensões) em cada resposta.

📊 Wiki Benchmark v2 — Report Markdown (20/05)

29KB · tabelas + análise + KPIs

Ranking modelos · Wiki ON vs OFF · custo × benefício · agregados por modo.

📊 Wiki Benchmark v1 — Report Markdown (18/05)

HISTÓRICO 26KB · primeiro teste com 9 modelos top

Teste anterior com modelos top (GPT-5.4, Claude 4.6 etc) e perguntas genéricas — Wiki PIOROU (-4.4%). Mantido pra comparação.

💬 Wiki Benchmark — Respostas raw (20/05)

440KB · 180 respostas formatadas markdown

Texto completo de cada resposta dos modelos por pergunta × condição. Útil pra leitura sequencial.

🧭 Orchestrator Trace (18/05)

11KB · plan + chunks por pergunta

Plan completo (skills, subagentes, tools) e chunks recuperados pra cada query do bench anterior.

VPS srv1493385 · mia-platform · Easypanel Traefik