港口堆场上层层叠放的集装箱的照片

它到底是什么

海关数据不是网页数据。它的原始形态是报关和舱单记录:一批货进出某国国境时,申报方填写的收发货人、商品描述、HS 编码、数量、重量、金额、日期和港口。

这批记录的公开程度完全取决于国别政策。美国的海运进口舱单长期对外开放,市面上绝大多数「全球海关数据」产品的底座就是它;欧盟多数成员国不公开企业级明细;中国海关总署发布的是汇总统计,不含企业名。所以所谓「全球海关数据」通常是把国别来源拼起来的,各段的字段、粒度和更新节奏都不一样。

**买之前先问清楚覆盖哪些国家、哪些运输方式。**这一条比问价格重要。

它唯一不可替代的地方

传送带上少数几个箱子被分流到另一条轨道的照片

公开网页数据能告诉你一家公司是谁、做什么、在哪里。它给不了采购意向——这一点我们在外贸客户怎么找里说过,任何声称能提供「有采购需求的精准名单」的说法,要么在猜,要么在卖别的东西。

海关数据是这条规则少有的例外,但要说准确:它证明的不是「现在想买」,而是「过去买过」。

这个差别听起来小,实际很大。买过意味着这家公司有这条采购线、有对应的资质和渠道、知道这个品类怎么用——这些都是从任何官网上看不出来的。对一个刚进某个市场的供应商来说,「这家公司去年从越南进过十二个柜的同类产品」是比任何行业标签都硬的筛选条件。

所以它的正确定位是筛选器,不是名单本身。

五个它回答不了的问题

一、这家公司现在还在买吗。 数据通常滞后一到三个月,按来源不同。你看到的是已经发生过的事,中间可能已经换了供应商、砍了产品线,或者倒闭了。

二、收货人是不是真买家。 提单上的 consignee 经常是货代、报关行或集团采购中心。同一个名字下挂着几十个不相干的品类,基本可以判断是中间商。

三、这批货具体是什么。 品名是报关时填的自由文本,同一样东西能写出十几种版本,缩写、拼错、笼统带过都很常见。HS 编码只有前六位是国际统一的,往后各国自己扩展,跨国比对时对不齐。想按精确规格筛选,往往筛不出来。

四、空运和陆运的情况。 公开的舱单绝大部分是海运。走空运的高值小件、走陆运的区域贸易,在海关数据里基本是盲区。

五、怎么联系。 记录里通常只有公司名和一个报关地址,没有官网、没有邮箱、没有电话。这一段得另外补。

我们不做的两件事

一扇关闭的金属卷帘门的照片

不抓需要订阅才能看的海关数据平台。 那类平台的数据在登录墙后面,抓它属于绕过访问控制,不在承接范围内,写进合同也不行。这条没有例外。

不从报关记录里挖个人。 小企业主用个人名义报关的情况不少,报关联系人也可能是具体某个人。姓名、个人邮箱、手机号属于个人数据,我们不做识别、不做补全、不做跨源关联。企业层面的公开信息是边界。

这两条不是客套。搜「海关数据」进来的需求里,这两类占了相当一部分,说在前面能省掉双方的时间。

两类数据各管一段

两条并排的铁轨在远处汇合的照片

把海关数据和公开网页数据当成竞品去二选一,是这件事上最常见的误判。它们回答的根本不是同一个问题:

海关数据 公开网页数据
回答 谁买过、买了多少、什么时候 这家公司是谁、现在什么样、怎么联系
覆盖 少数国家、以海运为主 有网页的都能覆盖
时效 滞后一到三个月 采集当天的状态
字段 薄,通常只有公司名和地址 按需求定,可到几十个字段
成本 多数按年订阅 按项目一次性

实际可用的流程是串起来的:海关数据出线索 → 公开网页补全 → 人工判断该不该联系。

第二步是我们的常规工作。给一份公司名单,补出官网、公司地址、公司邮箱与总机、主营产品线、还在不在正常经营,每条带来源链接和采集时间。名单从哪来不重要,只要是你合法拿到的。

买之前的三个自检

三张孔径不同的金属筛网叠放在一起的照片

一、你的目标市场在不在覆盖范围里。 如果你主攻欧盟,企业级明细基本拿不到,那这笔订阅费大概率白花。先按国别核实,再谈别的。

二、你的产品在 HS 编码里分得开吗。 有些品类在六位编码下就是一大锅,筛出来几万条全是不相干的东西。拿你自己的产品去试一下编码粒度,比听销售讲有用。

三、拿到线索之后谁去跟。 海关数据出的是线索不是客户,后面必然还有一轮人工核实和联系。如果这段产能没有,买再多线索也只是躺在表里。

空旷仓库里一条通向远处的走道的照片

一句话

海关数据值得买的前提是:你的目标市场在它的覆盖里,你的品类在编码里分得开,而且你有人跟进。三条缺一条,它就只是一笔订阅费。

至于「这家公司叫什么、官网在哪、怎么联系、现在还在不在做」——这些不需要买海关数据,它们本来就在公开网页上。