In this Article
중고 마켓플레이스는 정가가 없는 상품의 실제 거래 가격을 담은 매력적인 데이터셋입니다. 그러나 가격이 매겨지는 대상이 표준화되어 있지 않기 때문에 전자상거래에서 가장 복잡한 데이터셋 중 하나이기도 합니다.
이 가이드에서는 이 데이터가 실제로 유용한 분야, 모델의 성패를 가르는 필드, 그리고 한계가 어디에 있는지를 다룹니다.
핵심 정보
- 등록 가격은 희망가이고, 판매 완료 상품은 실제 가격입니다. 활성 등록 상품으로 학습한 모델은 구매자가 지불하는 금액이 아니라 판매자가 기대하는 금액을 학습합니다.
- 상태는 가격 모델을 무너뜨리는 변수입니다. 또한 깔끔한 필드가 아니라 사용자가 직접 작성하는 자유 텍스트입니다.
- 플랫폼마다 자체 고객층이 있습니다. 따라서 같은 상품도 Poshmark, Depop, Vinted에서 일반적인 가격이 서로 다릅니다.
- 판매자 프로필은 개인 데이터입니다. 리세일 데이터셋에는 이러한 정보가 필요하지 않습니다.
- 세 플랫폼 모두 이용약관으로 자동화된 접근을 제한합니다. 따라서 작고, 느리며, 범위가 명확한 수집만이 정당화할 수 있는 형태입니다.
이 데이터는 실제로 어디에 유용합니까?
잘 답할 수 있는 질문 세 가지와 잘 답하지 못하는 질문 한 가지가 있습니다.
특정 상품의 리세일 가치. 특정 모델 또는 스타일이 최근에 실제로 얼마에 팔렸는지 알 수 있으며, 이는 판매자와 중고 시장을 관찰하는 브랜드 모두에게 핵심적인 질문입니다.
수요 신호. 상품이 얼마나 빨리 팔리는지와 희망가보다 얼마나 낮게 팔리는지를 보여 줍니다. 이는 대부분의 소매 지표보다 먼저 움직입니다.
리세일 시장에서의 브랜드 존재감. 브랜드 제품 중 어떤 제품이 가치를 유지하는지 파악할 수 있어 제품팀과 가격 책정팀에 유용합니다.
Poshmark 스크래퍼를 구축하는 사람이라면 이 데이터가 답할 수 없는 질문도 알아야 합니다. 바로 전체 시장 규모입니다. 카테고리와 지역에 따라 데이터 범위가 크게 다르고, 플랫폼은 모든 정보를 공개하지 않으며, 비공개 거래는 보이지 않습니다. 리세일 등록 상품으로 시장 규모를 산정하면 근거 없는 확신에 찬 수치가 나옵니다.
등록 상품 데이터가 오해를 일으키는 이유는 무엇입니까?
대부분의 등록 상품은 판매되지 않습니다. 이를 4가지 요소로 보는 리세일 데이터 모델이라고 부릅니다.
| 필드 | 알 수 있는 내용 | 함정 |
|---|---|---|
| 1. 희망가 | 판매자의 기대 | 등록 상품의 평균은 인식되는 가치를 부풀립니다 |
| 2. 판매 완료 가격 | 누군가 실제로 지불한 금액 | 항상 공개되는 것은 아니며, 제안은 비공개로 이루어집니다 |
| 3. 상태 | 가격 변동의 대부분 | 자유 텍스트이자 자기 신고 정보이므로 판매자 간 비교할 수 없습니다 |
| 4. 판매까지 걸린 시간 | 수요 강도 | 재등록하면 시간이 초기화되어 판매가 느린 상품이 숨겨집니다 |
세 번째 행은 가격 모델이 조용히 실패하는 지점입니다. 서로 다른 상태로 기재된 동일한 두 상품은 서로 다른 상품이며, 상태 텍스트는 서로 다른 기준을 가진 사람이 작성합니다. 진지한 모델이라면 상태 정규화가 필요하고, 이것이 없는 모델은 잡음에 맞춰집니다.
수집 범위는 어떻게 정해야 합니까?
| 목표 | 이 경우 사용 | 피해야 할 경우 |
|---|---|---|
| 특정 상품 가격 책정 | 최근 비교 사례를 위한 좁고 대상이 명확한 쿼리 | 잡음을 더하는 광범위한 카테고리 탐색 |
| 리세일 시장에서 브랜드 추적 | 일정에 따라 표본을 수집하는 정의된 제품 목록 | 플랫폼 전체 크롤링 |
| 플랫폼 간 비교 | 플랫폼별로 동일 상품, 동일 기간 | 플랫폼을 하나의 평균으로 합치기 |
| 시장 규모 산정 | 하지 마십시오: 데이터 범위를 알 수 없습니다 | 항상 |
지역은 보기보다 더 중요합니다. Vinted는 유럽 일부 지역에서 가장 강하고, Depop은 또 다른 방식으로 고객층이 치우쳐 있으며, 가격은 현지 고객층을 반영합니다. 국가에 고정된 출구를 사용하면 이 비교의 정직성을 유지할 수 있으며, DataImpulse 레지덴셜 프록시(residential proxy)는 195개국을 GB당 $1에 지원합니다.
한계는 무엇입니까?
이 데이터는 깔끔한 피드처럼 취급할 수 없으며, 네 가지 한계가 활용 범위를 결정합니다.
이용약관은 자동화된 접근을 제한합니다. 이들 플랫폼은 이에 적극적으로 대응합니다. 가격 조사를 위한 좁은 범위의 수집은 지속적인 추출과는 다른 성격이며, 범위 결정에 책임이 따릅니다.
판매자 데이터는 개인 데이터입니다. 사용자 이름, 프로필, 위치, 메시지 기록은 개인을 식별합니다. 리세일 가격 데이터셋에는 이 정보가 전혀 필요 없으므로 수집하지 마십시오.
위조품은 판단을 왜곡합니다. 프리미엄 브랜드의 수상할 정도로 저렴한 비교 사례는 실제 상품이 아닌 경우가 많으며, 이를 포함하면 가격 모델이 아래로 끌려 내려갑니다.
신중하게 접근하십시오. 정의된 제품 목록에 대한 느리고 대상이 명확한 쿼리는 광범위한 크롤링보다 더 정당화할 수 있을 뿐 아니라 더 정확합니다. 일반 정보이며 법률 자문이 아닙니다. 웹 스크래핑은 정당한가요를 참조하십시오.
자주 묻는 질문
리세일 마켓플레이스에서 어떤 데이터를 얻을 수 있습니까?
희망가, 공개된 경우의 판매 완료 가격, 판매자가 직접 신고한 상태, 판매까지 걸린 시간을 얻을 수 있습니다. 판매 완료 가격과 판매까지 걸린 시간이 유용하며, 희망가는 대부분의 등록 상품이 거래로 이어지지 않기 때문에 판매자의 기대를 측정합니다.
리세일 데이터 기반 가격 모델이 실패하는 이유는 무엇입니까?
대개 상태 때문입니다. 상태는 가격 변동의 대부분을 차지하고, 서로 다른 기준을 가진 판매자가 자유 텍스트로 작성하며, 정규화 없이는 등록 상품 간 비교할 수 없습니다. 이 단계가 없는 모델은 잡음에 맞춰집니다.
Poshmark, Depop, Vinted의 가격은 서로 다릅니까?
그렇습니다. 각 플랫폼의 고객층과 지리적 중심이 다르기 때문에 상당히 다릅니다. 같은 상품도 일반적인 가격이 서로 다르므로, 플랫폼을 하나의 평균으로 합치면 측정하려는 대상이 가려집니다.
리세일 데이터를 시장 규모 산정에 사용할 수 있습니까?
아니요. 카테고리와 지역에 따라 데이터 범위가 다르고, 플랫폼은 모든 정보를 공개하지 않으며, 비공개 거래는 보이지 않습니다. 등록 상품으로 규모를 산정하면 아무 근거도 없는 확신에 찬 수치가 나옵니다.
리세일 플랫폼을 스크래핑해도 됩니까?
이용약관이 자동화된 접근을 제한하고 플랫폼도 이에 대응하므로, 범위와 속도는 설계상 결정해야 할 사항입니다. 정의된 제품 목록에 대한 좁고 느린 수집이 정당화할 수 있는 형태입니다. 일반 정보이며 법률 자문이 아닙니다.
비교하는 동안 시장을 동일하게 유지하십시오
리세일 가격은 현지 고객층을 반영하므로 여러 국가를 섞은 비교는 지역을 측정하게 됩니다. DataImpulse 레지덴셜 프록시는 195개국에서 GB당 $1로 수집 국가를 고정합니다. 계정 만들기.
관련: 가격 비교 활용 사례 · 웹 스크래핑은 정당한가요 · 웹 스크래핑용 프록시.
최종 업데이트: 2026년 9월 18일.
