Cada preço é lido no próprio painel (no endpoint de catálogo da API dele, quando temos uma chave, ou na tabela de preços que ele publica no próprio site, quando não temos), recebe data e é gravado num registro que só aceita acréscimos. Cada item informa de qual das duas fontes veio. Quando pelo menos dois painéis independentes vendem o mesmo serviço padronizado, uma linha diária do índice registra o mínimo, os quartis, a mediana e o máximo de todos os itens que eles publicam para esse serviço, junto com o número de vendedores distintos por trás desses itens.
Essas duas contagens são diferentes, e a diferença importa. Um único painel costuma listar centenas de variações de um mesmo serviço (países diferentes, prazos de reposição diferentes, bases de contas diferentes); por isso, a mediana é calculada sobre os itens, porque essa é a distribuição em que o comprador de fato escolhe, enquanto o tamanho da amostra conta painéis, porque um vendedor não é um mercado, por mais linhas que publique. As duas contagens aparecem. Uma página que mostrasse a primeira e a chamasse de segunda teria inventado centenas de empresas.
Nada nestas páginas é estimativa. Quando um serviço não tem preço observado, a célula mostra um traço. Quando a amostra fica abaixo de 5 vendedores independentes, a página avisa, fica fora do índice dos buscadores e do sitemap e mostra os preços mesmo assim, porque os dados são reais mesmo quando a palavra “mercado” ainda não foi conquistada.