Arquitetura da plataforma · Windrose Institute
Arquitetura da plataforma · Windrose Engine

Um instrumento, três motores, uma espinha de arquivos auditável.

Você descreve uma ideia (opcionalmente com dados). Uma população simulada responde e, então, é calibrada contra a realidade. A plataforma devolve uma direção, um ranking e hipóteses para testar - nunca porcentagens inventadas. Todo número carrega um degrau de evidência: SIM-RANK · REAL · CALIBRATED.

NO AR - em funcionamento hoje PLANEJADO - esta rodada financia
§0 · Três motores, um espaço
Claude
ORQUESTRADOR

Desenho de cenários, narrador ao vivo, consultor e o segundo oráculo no ensemble.

Centaur / Minitaur-8B
ORÁCULO COMPORTAMENTAL

Simula a propensão de uma população a responder - uma distribuição, não uma média.

Engine_v4
PREDITOR REAL

sklearn / lightgbm: F1 / AUC e a calibração sim→real.

§1 · Arquitetura em camadas

O sistema inteiro, de cima a baixo

CLIENTES
Humano · navegador
Agente de IA externo
software de outra empresa
PLANEJADO
ACESSO · server/
Criador em 6 passos + Resultados
flow · simulator · ui · i18n
NO AR
Servidor MCP / A2A
saída epistêmica tipada + assinatura
PLANEJADO
Painel de administração
processes · logs · Engine · kill
NO AR
Status + /science
status · science
NO AR
ORQUESTRAÇÃO
Fila de tarefas + run-lock
PLANEJADO
bloop.runner
a espinha, só stdlib
NO AR
ESPINHA · 8 estágios
s1 ingest → s2 personas → s3 design → s4 simulate → s5 ground → s6 calibrate → s7 model → s8 explain
os estágios conversam via arquivos - retomável, auditável · NO AR
ADAPTADORES · venvs externos
centaur
scenario_spec · centaur_worker · sim_validate
engine
engine_worker
DADOS & MEMÓRIA
Artefatos runs/<case>/
FONTE DE VERDADE
NO AR
Memória vetorial
cosseno TF-IDF + recência/confiança
NO AR
Camada de dados de referência
Hofstede · WVS · benchmarks · corpus de calibração
EM PARTE NO AR
↑ os artefatos alimentam a UI, a saída MCP e a memória vetorial ↺ os dados de referência enquadram o s4 e calibram o s6 - real → sim, nunca o contrário
§3.2 · O ciclo do instrumento

Oito estágios, do arquivo bruto à evidência

S1 · INGEST
Normaliza o arquivo.
→ canonical.csv · profile.json
S2 · PERSONAS
Agrupa em uma população.
→ personas.json · KMeans
S3 · DESIGN
Monta o experimento.
→ experiment.json · factorial
S4 · SIMULATE
O Minitaur responde.
→ trials.jsonl · effects.json
S5 · GROUND
Validação cega.
→ grounding · sim_validation
S6 · CALIBRATE
Real → sim, nunca o contrário.
→ calibration.json · Engine
S7 · MODEL
Ajusta o preditor real.
→ evaluation · betas · model_card
S8 · EXPLAIN
Monta o dashboard.
→ dashboard.html · manifest

Os dados de referência ancoram o S4 (enquadramento) e o S6 (calibração). Os artefatos são o contrato - os módulos os leem defensivamente, então uma mudança de formato é um "-" honesto, nunca uma queda.

§5 · Escada de evidência

O degrau é sempre explícito

NONE - sem cobertura, degradamos para "-"
REAL - em uma dimensão que tem um selo
CALIBRATED - WVS / benchmark / flywheel

Toda execução devolvida traz este selo. O ciclo de retroalimentação - resultados A/B reais realimentados pelos usuários e, com o tempo, pelos agentes - é o que sobe a escada para a próxima execução.

§6 · Contrato agente-a-agente PLANEJADO

Uma saída epistêmica tipada - um número nu não pode existir

{
  "rank": 1, "variant": "…", "tier": "strong", "value": null,
  "evidence": {
    "rung": "SIM-RANK", "calibration": "NONE", "scope": "directional",
    "ranking_stability": { "n": 277, "N": 300, "confidence": "HIGH" },
    "scenario_robustness": "N/A", "backtest_rho": 1.0
  },
  "claim_allowed":   ["ranking", "direction", "hypotheses"],
  "claim_forbidden": ["absolute_percentage", "guarantee"]
}

Chamador não confiável, seguro por construção: uma vez no ar, a saída é assinada em manifest.hash; o texto de entrada é dado, não instruções; identidade + orçamento por agente; apenas rankings agregados saem do prédio, nunca personas individuais. O modelo externo recebe apenas agregados.

§7 · Constituição - invariantes vinculantes

As regras que a plataforma não pode quebrar

1Os artefatos em arquivo são a fonte de verdade; o banco de dados é apenas um índice.
2A calibração é real → sim apenas, nunca o contrário.
3"Validação" significa apenas o protocolo cego com segmentos anonimizados.
4Dados simulados nunca estão no conjunto de avaliação e nunca no armazenamento vetorial.
5Todo número carrega um selo REAL / SIM-RANK / CALIBRATED.
6Versionamento: hash(model + prompt + config) no manifesto.
7Apenas agregados chegam aos prompts do LLM - nunca registros individuais.
8Crescer significa camadas em torno do núcleo; a espinha e os adaptadores permanecem intocados.

Um novo caso é um novo config JSON - zero lógica específica de caso. O config é a abstração da plataforma: dataset, decisão, condições, personas, metodologia.