KK-DATA avatar KK-DATA

社交数据导出规范:KK-DATA 多平台筛号结果字段、格式与最佳实践

社交数据 导出 kkdata 数据规范

社交数据导出规范:KK-DATA 多平台筛号结果字段、格式与最佳实践

在 B2B 出海获客中,社交数据导出是连接筛号与营销实操的关键环节。当你通过 KT-DATA 平台完成 Telegram、WhatsApp、Line 等号码的批量检测后,得到的不仅是一串标记—0/1 的清单,更是一份包含tgid、wsid、活跃度、性别、年龄等丰富字段的结构化文件。如何理解这些字段的含义?怎样正确导出并二次加工,让每条号码发挥最大价值?本文为你拆解社交数据导出的全流程规范。

什么是社交数据导出?为什么需要统一规范?

社交数据导出,指的是将筛号平台检测后的号码及其属性(如是否开通、是否活跃、性别、平台唯一 ID 等)输出为标准格式的文件(CSV 或 TXT),以便后续导入 CRM、群发工具或执行数据分层。

统一导出的规范至关重要,原因有三:

  • 避免重复检测浪费余额:若每次导出都手工清洗,极易重复检测同一批号码,徒增成本。
  • 提升 CRM 导入成功率:不同系统对号码格式要求各异(国际格式、去空格、去 + 号前缀),规范导出能减少二次格式化工作量。
  • 支撑营销归因:带上年龄段、活跃窗口等字段,可精确锁定目标人群(如“30 岁,Telegram 近 7 天活跃”),而不是盲目群发。

简而言之:筛号结果导出越规范,后续营销效率越高,成本控制越精准。

KK-DATA 支持哪些平台的社交数据导出?

KK-DATA 目前已覆盖 11+ 社交/通讯平台(持续更新中),每个平台的检测能力不同,导出的字段也有所差异。下表列出核心平台及可导出的属性类型:

平台检测类型(部分)导出关键字段
Telegram开通/有效、活跃(可指定窗口)、性别识别、tgid 导出tgid、开通状态、活跃天数、性别、年龄
WhatsApp开通/有效、活跃、性别wsid、开通状态、活跃度、性别
Line开通、有效、性别uid、开通状态、性别
Zalo开通、活跃、性别(越南主要市场)开通状态、活跃度、性别
iOS / iMessageiMessage 有效号码、iOS 设备检测iMessage 有效性、设备类型
RCS (Android)RCS 开通检测RCS 状态
Viber开通检测Viber 状态
Facebook / Instagram账号是否存在、活跃度状态、名称(部分)
币安 / 领英账号有效性有效/无效标记

注意:具体字段名称和类型以控制台导出时的文件头为准,不同版本可能微调。

各平台导出字段详解——你的社交数据长什么样?

理解每个列的含义,才能正确筛选和使用。

Telegram 导出字段(tgid、注册状态、活跃窗口、性别/年龄)

Telegram 是目前出海获客最热门的平台之一,KK-DATA 对其检测深度较高。一个典型的 CSV 导出文件(使用 Excel 打开)会包含以下列(示例):

phonetgidtg开通tg活跃天数性别年龄
861380013800012345678901732
861380013800112345678910-1未知0
  • tgid:Telegram 内部的唯一用户 ID,可直接用于 Telegram bot API 发送消息(需遵守平台使用政策)。
  • tg开通1 表示已注册 Telegram,0 表示未注册。
  • tg活跃天数:距离最近一次活跃的天数,-1 表示长期未活跃或无法获取。你可以通过设置活跃窗口(如“近 7 天”)来只筛选近期活跃的号码。
  • 性别:基于头像昵称等公开信息识别的性别(男/女/未知)。
  • 年龄:同样是估算值,可用于筛选约 30 岁 人群,但非精确身份证级别。

WhatsApp 导出字段(wsid、开通/活跃、性别)

WhatsApp 检测的重点是开通状态、活跃度及 wsid。导出文件通常包含:

phonewsid开通活跃性别
8613800138000987654321011
  • wsid:WhatsApp 内部的用户标识,同样可用于 API 交互。
  • 开通1 = 注册 WhatsApp,0 = 未注册。
  • 活跃1 = 近期在线或可触达,0 = 长期离线。
  • 性别:部分号码可识别,非所有情景都支持。

Line / Zalo / iOS 导出字段

平台关键字段说明
Lineuid、开通、性别uid 是 Line 内部 ID,性别可帮助区分男性/女性用户
Zalo开通、活跃、性别主要面向越南市场,活跃度对当地营销很重要
iOS (iMessage)iMessage 有效、蓝号检测检测能否通过 iMessage 触达,以及是否处于 iMessage 活跃状态

字段说明以控制台实时结果为准

各平台检测后导出的列名可能随版本调整,实际字段请以任务完成后下载的 CSV/TXT 文件头为准。年龄字段仅表示性别检测模型估算的年龄段,非精确身份证级别。

导出格式有哪些?如何正确使用?

KK-DATA 支持 CSVTXT 两种导出格式,不同场景选不同格式:

格式特点适用场景
CSV含列头,逗号分隔,UTF‑8 with BOM 编码导入 Excel、数据库、CRM 系统,保留完整属性
TXT纯号码列表,每行一个号码,无列头直接复制粘贴到群发工具、简单号码列表

使用建议:

  • 导入 CRM 或分析平台:选 CSV。注意列头可能包含中文,建议先用 Excel 打开确认字段顺序。
  • 批量群发:选 TXT,去除多余符号,减少格式错误。
  • 编码问题:CSV 文件已内嵌 BOM,Windows 下双击可直接显示中文。若在 macOS / Linux 下用 Excel 打开乱码,请选择“从文本/CSV 导入”,指定编码为 UTF‑8。

导出后的社交数据如何清洗与去重?

拿到文件后的几个标准化步骤:

  1. 去重:移除同一号码在多个任务中的重复。人工去重费时费力,KK-DATA 内置数据去重仓库可自动完成。
  2. 字段筛选:只保留你需要的列(如只留 tgid 和活跃天数),减小文件体积。
  3. 数值转换:将“0/1”标记转为可读状态(如“已注册”),或补充层级标签(如“高活跃”“中活跃”)。
  4. 格式规范化:统一为国际格式(+86…),去除空格、横杠等。

利用数据去重仓库避免重复检测

这是 KK-DATA 比较实用的功能。提交新号码任务前,勾选 “启用去重仓库”,系统会自动比对这批号码是否已在历史任务中检测过。已检测的号码不再扣费,只对新增号码计费。

  • 操作位置:控制台 → 提交筛号任务 → 勾选“启用去重仓库”。
  • 适合场景:定期增量补充客户名单,避免反复检测老号码。

导出后的号码导入 CRM / 营销工具

大多数 CRM 要求号码格式为 E.164(如 +8613800138000)。导出后请做几步简单格式化:

  • 移除所有空格、短横、括号。
  • 确认国家代码正确(中国为 +86)。
  • 如果 CRM 要求不带 + 号,用文本替换去掉即可。

如何确保社交数据导出的安全与合规?

社交数据涉及用户隐私,使用时需注意以下几点:

  • 不存储过度敏感信息:平台限制导出身份证、银行卡等敏感内容,KK-DATA 也不采集此类数据。
  • 仅用于合法营销:禁止利用导出数据进行骚扰、诈骗等违法活动。遵守各国反垃圾邮件法及平台使用政策。
  • 谨防仿冒客服:KK-DATA 的官方支持渠道只有官网联系页、官方 Telegram 机器人 以及客服号 @kkdata_cc。任何“充值返利”“代理升级”均为诈骗。

谨防伪造客服诈骗

KK-DATA 仅通过官网联系页、官方 Telegram 机器人(https://t.me/kkdata_robot)及客服号 @kkdata_cc 提供支持。切勿相信任何非官方渠道的「充值优惠」或「代理返现」。

社交数据导出常见问题(FAQ)

问:导出的 CSV/TXT 文件可以在 Excel 中正常显示吗?
答: 可以。CSV 文件默认用逗号分隔,使用 UTF‑8 with BOM 编码,直接双击或导入 Excel 即可。若出现乱码,请将 Excel 编码设为 UTF‑8。

问:导出数据中的年龄字段准确吗?
答: 年龄字段由性别检测模型基于头像/昵称等公开信息估算得出,仅用作人群趋势判断(如筛选约 30 岁用户),无法达到身份证精度。

问:一个任务最多能导出多少条号码?
答: 单次任务最多可提交约 100 万条号码进行筛号,导出文件会按行数拆分(通常每文件不超过 10 万行),可连续下载。

问:导出后如何避免下次重复检测同一批号码?
答: 提交新任务时启用数据去重仓库(余额记录处可见),系统会自动比对该批次号码是否已在历史任务中检测过,已检测的号码不再扣费。

问:导出的 tgid 或 wsid 可以直接用于私信吗?
答: tgid 和 wsid 是各平台内部用户标识,可用于通过 Telegram/WhatsApp API 发送消息,但需遵守平台使用政策和反垃圾规则。

数据导出是筛号流程的最后一公里,也是营销变现的起点。掌握规范,就能更高效地利用每一条号码。

👉 登录控制台开始筛号
如需一对一的导入指导或遇到任何格式问题,欢迎双向联系客服:https://t.me/kkdata_robot
更多详细字段说明与格式示例,可查阅 使用文档