
它到底是甚麼
海關數據不是網頁數據。它的原始形態是報關和艙單記錄:一批貨進出某國國境時,申報方填寫的收發貨人、商品描述、HS 編碼、數量、重量、金額、日期和港口。
這批記錄的公開程度完全取決於國別政策。美國的海運進口艙單長期對外開放,市面上絕大多數「全球海關數據」產品的底座就是它;歐盟多數成員國不公開企業級明細;中國海關總署發布的是匯總統計,不含企業名。所以所謂「全球海關數據」通常是把國別來源拼起來的,各段的欄位、粒度和更新節奏都不一樣。
**買之前先問清楚覆蓋哪些國家、哪些運輸方式。**這一條比問價格重要。
它唯一不可替代的地方

公開網頁數據能告訴你一家公司是誰、做甚麼、在哪裡。它給不了採購意向——這一點我們在海外客戶怎樣找裡說過,任何聲稱能提供「有採購需求的精準名單」的說法,要麼在猜,要麼在賣別的東西。
海關數據是這條規則少有的例外,但要說準確:它證明的不是「現在想買」,而是「過去買過」。
這個差別聽起來小,實際很大。買過意味著這家公司有這條採購線、有對應的資格和渠道、知道這個品類怎麼用——這些都是從任何官網上看不出來的。對一個剛進某個市場的供應商來說,「這家公司去年從越南進過十二個貨櫃的同類產品」是比任何行業標籤都硬的篩選條件。
所以它的正確定位是篩選器,不是名單本身。
五個它回答不了的問題
一、這家公司現在還在買嗎。 數據通常滯後一到三個月,按來源不同。你看到的是已經發生過的事,中間可能已經換了供應商、砍了產品線,或者倒閉了。
二、收貨人是不是真買家。 提單上的 consignee 經常是貨代、報關行或集團採購中心。同一個名字下掛著幾十個不相干的品類,基本可以判斷是中間商。
三、這批貨具體是甚麼。 品名是報關時填的自由文字,同一樣東西能寫出十幾種版本,縮寫、拼錯、籠統帶過都很常見。HS 編碼只有前六位是國際統一的,往後各國自己擴展,跨國比對時對不齊。想按精確規格篩選,往往篩不出來。
四、空運和陸運的情況。 公開的艙單絕大部分是海運。走空運的高值小件、走陸運的區域貿易,在海關數據裡基本是盲區。
五、怎麼聯絡。 記錄裡通常只有公司名和一個報關地址,沒有官網、沒有電郵、沒有電話。這一段得另外補。
我們不做的兩件事

不採集需要訂閱才看得到的海關數據平台。 那類平台的數據在登入牆後面,採集它屬於繞過存取控制,不在承接範圍內,寫進合約也不行。這條沒有例外。
不從報關記錄裡挖個人。 小企業主用個人名義報關的情況不少,報關聯絡人也可能是具體某個人。姓名、個人電郵、手機號屬於個人資料,我們不做識別、不做補全、不做跨來源關聯。企業層面的公開資料是邊界。
這兩條不是客套。搜「海關數據」進來的需求裡,這兩類佔了相當一部分,說在前面能省掉雙方的時間。
兩類數據各管一段

把海關數據和公開網頁數據當成競品去二選一,是這件事上最常見的誤判。它們回答的根本不是同一個問題:
| 海關數據 | 公開網頁數據 | |
|---|---|---|
| 回答 | 誰買過、買了多少、甚麼時候 | 這家公司是誰、現在甚麼樣、怎麼聯絡 |
| 覆蓋 | 少數國家、以海運為主 | 有網頁的都能覆蓋 |
| 時效 | 滯後一到三個月 | 採集當天的狀態 |
| 欄位 | 薄,通常只有公司名和地址 | 按需求定,可到幾十個欄位 |
| 成本 | 多數按年訂閱 | 按項目一次性 |
實際可用的流程是串起來的:海關數據出線索 → 公開網頁補全 → 人工判斷該不該聯絡。
第二步是我們的常規工作。給一份公司名單,補出官網、公司地址、公司電郵與總機、主營產品線、還在不在正常營運,每條帶來源連結和採集時間。名單從哪來不重要,只要是你合法取得的。
買之前的三個自檢

一、你的目標市場在不在覆蓋範圍裡。 如果你主攻歐盟,企業級明細基本拿不到,那這筆訂閱費大概率白花。先按國別核實,再談別的。
二、你的產品在 HS 編碼裡分得開嗎。 有些品類在六位編碼下就是一大鍋,篩出來幾萬條全是不相干的東西。拿你自己的產品去試一下編碼粒度,比聽銷售講有用。
三、拿到線索之後誰去跟。 海關數據出的是線索不是客戶,後面必然還有一輪人工核實和聯絡。如果這段產能沒有,買再多線索也只是躺在表裡。

一句話
海關數據值得買的前提是:你的目標市場在它的覆蓋裡,你的品類在編碼裡分得開,而且你有人跟進。三條缺一條,它就只是一筆訂閱費。
至於「這家公司叫甚麼、官網在哪、怎麼聯絡、現在還在不在做」——這些不需要買海關數據,它們本來就在公開網頁上。
