
它到底是什么
海关数据不是网页数据。它的原始形态是报关和舱单记录:一批货进出某国国境时,申报方填写的收发货人、商品描述、HS 编码、数量、重量、金额、日期和港口。
这批记录的公开程度完全取决于国别政策。美国的海运进口舱单长期对外开放,市面上绝大多数「全球海关数据」产品的底座就是它;欧盟多数成员国不公开企业级明细;中国海关总署发布的是汇总统计,不含企业名。所以所谓「全球海关数据」通常是把国别来源拼起来的,各段的字段、粒度和更新节奏都不一样。
**买之前先问清楚覆盖哪些国家、哪些运输方式。**这一条比问价格重要。
它唯一不可替代的地方

公开网页数据能告诉你一家公司是谁、做什么、在哪里。它给不了采购意向——这一点我们在外贸客户怎么找里说过,任何声称能提供「有采购需求的精准名单」的说法,要么在猜,要么在卖别的东西。
海关数据是这条规则少有的例外,但要说准确:它证明的不是「现在想买」,而是「过去买过」。
这个差别听起来小,实际很大。买过意味着这家公司有这条采购线、有对应的资质和渠道、知道这个品类怎么用——这些都是从任何官网上看不出来的。对一个刚进某个市场的供应商来说,「这家公司去年从越南进过十二个柜的同类产品」是比任何行业标签都硬的筛选条件。
所以它的正确定位是筛选器,不是名单本身。
五个它回答不了的问题
一、这家公司现在还在买吗。 数据通常滞后一到三个月,按来源不同。你看到的是已经发生过的事,中间可能已经换了供应商、砍了产品线,或者倒闭了。
二、收货人是不是真买家。 提单上的 consignee 经常是货代、报关行或集团采购中心。同一个名字下挂着几十个不相干的品类,基本可以判断是中间商。
三、这批货具体是什么。 品名是报关时填的自由文本,同一样东西能写出十几种版本,缩写、拼错、笼统带过都很常见。HS 编码只有前六位是国际统一的,往后各国自己扩展,跨国比对时对不齐。想按精确规格筛选,往往筛不出来。
四、空运和陆运的情况。 公开的舱单绝大部分是海运。走空运的高值小件、走陆运的区域贸易,在海关数据里基本是盲区。
五、怎么联系。 记录里通常只有公司名和一个报关地址,没有官网、没有邮箱、没有电话。这一段得另外补。
我们不做的两件事

不抓需要订阅才能看的海关数据平台。 那类平台的数据在登录墙后面,抓它属于绕过访问控制,不在承接范围内,写进合同也不行。这条没有例外。
不从报关记录里挖个人。 小企业主用个人名义报关的情况不少,报关联系人也可能是具体某个人。姓名、个人邮箱、手机号属于个人数据,我们不做识别、不做补全、不做跨源关联。企业层面的公开信息是边界。
这两条不是客套。搜「海关数据」进来的需求里,这两类占了相当一部分,说在前面能省掉双方的时间。
两类数据各管一段

把海关数据和公开网页数据当成竞品去二选一,是这件事上最常见的误判。它们回答的根本不是同一个问题:
| 海关数据 | 公开网页数据 | |
|---|---|---|
| 回答 | 谁买过、买了多少、什么时候 | 这家公司是谁、现在什么样、怎么联系 |
| 覆盖 | 少数国家、以海运为主 | 有网页的都能覆盖 |
| 时效 | 滞后一到三个月 | 采集当天的状态 |
| 字段 | 薄,通常只有公司名和地址 | 按需求定,可到几十个字段 |
| 成本 | 多数按年订阅 | 按项目一次性 |
实际可用的流程是串起来的:海关数据出线索 → 公开网页补全 → 人工判断该不该联系。
第二步是我们的常规工作。给一份公司名单,补出官网、公司地址、公司邮箱与总机、主营产品线、还在不在正常经营,每条带来源链接和采集时间。名单从哪来不重要,只要是你合法拿到的。
买之前的三个自检

一、你的目标市场在不在覆盖范围里。 如果你主攻欧盟,企业级明细基本拿不到,那这笔订阅费大概率白花。先按国别核实,再谈别的。
二、你的产品在 HS 编码里分得开吗。 有些品类在六位编码下就是一大锅,筛出来几万条全是不相干的东西。拿你自己的产品去试一下编码粒度,比听销售讲有用。
三、拿到线索之后谁去跟。 海关数据出的是线索不是客户,后面必然还有一轮人工核实和联系。如果这段产能没有,买再多线索也只是躺在表里。

一句话
海关数据值得买的前提是:你的目标市场在它的覆盖里,你的品类在编码里分得开,而且你有人跟进。三条缺一条,它就只是一笔订阅费。
至于「这家公司叫什么、官网在哪、怎么联系、现在还在不在做」——这些不需要买海关数据,它们本来就在公开网页上。
