In this Article
Os marketplaces de segunda mão são um conjunto de dados atraente: preços reais de transações de produtos que não têm preço de tabela. Também são um dos conjuntos de dados mais desorganizados do ecommerce, porque o item cujo preço está sendo definido não é padronizado.
Este guia aborda para que os dados realmente servem, os campos que determinam se um modelo funciona e onde estão os limites.
Fatos principais
- Anúncios são preços pedidos; itens vendidos são preços. Um modelo treinado com anúncios ativos aprende o que os vendedores esperam, não o que os compradores pagam.
- A condição é a variável que quebra os modelos de precificação, e ela é um texto livre autodeclarado, não um campo limpo.
- Cada plataforma tem seu próprio público, portanto o mesmo item tem preços típicos diferentes no Poshmark, Depop e Vinted.
- Perfis de vendedores são dados pessoais, e um conjunto de dados de revenda não precisa deles.
- O acesso automatizado é restringido pelos termos nas três plataformas, o que torna uma coleta pequena, lenta e bem delimitada o único formato defensável.
Para que estes dados realmente servem?
Três perguntas às quais eles respondem bem, e uma à qual respondem mal.
Valor de revenda de um item específico. Por quanto um determinado modelo ou estilo realmente foi vendido recentemente, que é a questão central tanto para vendedores quanto para marcas que acompanham mercados secundários.
Sinais de demanda. Com que rapidez os itens são vendidos e o quanto ficam abaixo do preço pedido, algo que se movimenta antes da maioria dos indicadores do varejo.
Presença da marca na revenda. Quais produtos de uma marca retêm valor, útil para equipes de produto e precificação.
Quem desenvolve um scraper para Poshmark deve saber ao que ele não consegue responder: o tamanho total do mercado. A cobertura varia enormemente conforme a categoria e a geografia, as plataformas não expõem tudo e as vendas privadas são invisíveis. Estimar o tamanho a partir de anúncios de revenda produz números confiantes sem fundamento.
Por que os anúncios enganam?
A maioria dos anúncios nunca é vendida. Chamamos isso de modelo de dados de revenda de 4 pontos.
| Campo | O que ele informa | Armadilha |
|---|---|---|
| 1. Preço pedido | Otimismo do vendedor | Calcular a média dos anúncios infla o valor percebido |
| 2. Preço de venda | O que alguém realmente pagou | Nem sempre é exposto, e as ofertas ocorrem de forma privada |
| 3. Condição | A maior parte da variação de preço | Texto livre e autodeclarado; não é comparável entre vendedores |
| 4. Tempo até a venda | Força da demanda | Republicar reinicia o relógio e esconde itens lentos |
A terceira linha é onde os modelos de precificação falham silenciosamente. Dois itens idênticos em condições declaradas diferentes são produtos diferentes, e o texto sobre a condição é escrito por pessoas com padrões diferentes. Todo modelo sério precisa de normalização da condição, e qualquer modelo sem ela está se ajustando ao ruído.
Como a coleta deve ser delimitada?
| Objetivo | Use isto quando | Evite quando |
|---|---|---|
| Definir o preço de um item específico | Uma consulta estreita e direcionada para comparáveis recentes | Varreduras amplas por categoria, que acrescentam ruído |
| Acompanhar uma marca na revenda | Uma lista de produtos definida, amostrada em uma programação | Rastrear toda a plataforma |
| Comparar entre plataformas | Mesmos itens, mesma janela, por plataforma | Unir plataformas em uma única média |
| Estimativa do tamanho do mercado | Não faça: a cobertura é impossível de saber | Sempre |
A geografia importa mais do que parece: o Vinted é mais forte em partes da Europa, o Depop tem um perfil diferente novamente, e os preços refletem o público local. Uma saída fixada em um país mantém essa comparação honesta, e os proxies residenciais da DataImpulse cobrem 195 países por $1 por GB.
Quais são os limites?
Estes dados não podem ser tratados como um feed limpo, e quatro limites determinam até onde eles vão.
Os termos restringem o acesso automatizado nessas plataformas, e elas se defendem ativamente contra ele. Uma coleta restrita para pesquisa de preços é uma proposta diferente da extração contínua, e a decisão sobre o escopo é onde está a responsabilidade.
Dados de vendedores são dados pessoais. Nomes de usuário, perfis, localizações e histórico de mensagens identificam indivíduos. Um conjunto de dados de preços de revenda não precisa de nada disso, portanto não os colete.
Falsificações distorcem o cenário. Comparáveis suspeitamente baratos de marcas premium muitas vezes nem são o produto em questão, e incluí-los puxa um modelo de precificação para baixo.
Seja cuidadoso. Consultas lentas e direcionadas em uma lista de produtos definida são mais defensáveis e mais precisas do que rastreamentos amplos. Informações gerais, não aconselhamento jurídico: veja web scraping é legal.
Perguntas frequentes
Quais dados você pode obter de marketplaces de revenda?
Preços pedidos, preços de venda quando expostos, condição autodeclarada e tempo até a venda. Os preços de venda e o tempo até a venda são os úteis; os preços pedidos medem o otimismo do vendedor porque a maioria dos anúncios nunca se converte.
Por que modelos de precificação com dados de revenda falham?
Geralmente, por causa da condição. Ela concentra a maior parte da variação de preço, é escrita como texto livre por vendedores com padrões diferentes e não é comparável entre anúncios sem normalização. Um modelo sem essa etapa se ajusta ao ruído.
Os preços diferem entre Poshmark, Depop e Vinted?
Sim, substancialmente, porque cada um tem um público diferente e um centro geográfico de gravidade diferente. O mesmo item tem preços típicos diferentes, portanto unir plataformas em uma única média esconde aquilo que você está medindo.
Posso usar dados de revenda para estimar o tamanho do mercado?
Não. A cobertura varia por categoria e geografia, as plataformas não expõem tudo e as vendas privadas são invisíveis. Estimar o tamanho com base nos anúncios produz números confiantes sem nada que os sustente.
É permitido fazer scraping de plataformas de revenda?
Os termos delas restringem o acesso automatizado e elas se defendem contra ele, portanto o escopo e a taxa são a decisão de projeto. Uma coleta restrita e lenta em uma lista de produtos definida é o formato defensável. Informações gerais, não aconselhamento jurídico.
Mantenha o mercado fixo enquanto compara
Os preços de revenda refletem públicos locais, portanto uma comparação que mistura países mede a geografia. Os proxies residenciais da DataImpulse fixam a coleta em um país por $1 por GB em 195 países. Crie uma conta.
Relacionado: caso de uso de comparação de preços · web scraping é legal · proxies para web scraping.
Última atualização: 18 de setembro de 2026.
