Versão 2.0 · modelo hedônico. Além do bairro e da metragem, ponderamos os atributos que fazem dois imóveis semelhantes valerem diferente — suítes, vagas, tipo. Método aberto e auditável. É uma estimativa estatística, não um laudo oficial.
Um modelo puramente por R$/m² × bairro é simplório: não distingue um apartamento com 1 vaga e sem suíte de outro, de mesma área e bairro, com 2 vagas e 2 suítes. O modelo hedônico corrige isso — decompõe o preço em uma base de localização/área mais o impacto de cada característica, no espírito da norma de avaliação (ABNT NBR 14653).
valor = exp( β₀ + β₁·ln(área) + β₂·ln(R$/m² do bairro)
+ β₃·suítes + β₄·vagas + … )
faixa = [ valor × 0,85 , valor × 1,20 ] (dispersão típica do modelo)
É uma regressão log-linear ajustada sobre anúncios reais. Cada coeficiente é um fator multiplicativo: o efeito de uma característica é lido como “+X%” no valor. Modelos separados para residencial (apê/cobertura/kitnet/flat) e casa, que têm dinâmicas diferentes.
Estimado sobre a amostra atual de Curitiba — atualiza a cada recoleta:
| Atributo | Efeito no valor |
|---|---|
| Cada suíte a mais | ≈ +22% |
| Cada vaga de garagem a mais | ≈ +12% |
| Ser cobertura | ≈ +7% |
| Ser kitnet/studio (R$/m² mais alto) | ≈ +21% |
| Área | elasticidade 0,67 (imóvel maior tem R$/m² marginal menor) |
| Dormitórios / banheiros (dada a área) | ≈ 0 — para a mesma metragem, subdividir não agrega |
Estes números batem com a literatura de avaliação (vagas ~8–15%; suítes um prêmio claro). São correlações no mercado de anúncios, não uma lei causal.
Por bairro — usamos a mediana de R$/m² do bairro (por grupo residencial/casa) como âncora de localização; se o bairro tem poucos anúncios, cai para a mediana da cidade.
Por endereço (CEP) — resolvemos a coordenada real do imóvel e tomamos a mediana de R$/m² dos comparáveis por proximidade, num raio que cresce (1 → 2 → 3,5 → 6 km) até reunir ≥ 8, ranqueados por distância (haversine). A partir da v2 usamos a coordenada de cada anúncio (rooftop), não mais o centroide do bairro.
| Comparáveis no bairro/raio | Confiança |
|---|---|
| ≥ 30 | alta |
| 12 – 29 | média |
| < 12 | baixa |
Em teste fora da amostra (validação cruzada 5-fold), o modelo residencial tem erro absoluto mediano de ~22% e médio de ~29% sobre o preço de anúncio — melhor que o modelo ingênuo (mediano 27%, médio 39%), com o maior ganho na cauda (imóveis com muitas suítes/vagas, que o modelo simples subavalia). Ainda é uma estimativa de faixa: use-a como referência, não como número exato.