A股公开数据采集指南:龙虎榜、北向资金与上市公司公告
关注 A股的人多少都做过这样的事:每天收盘后打开交易所网站查龙虎榜,去东财或交易所页面翻北向资金,再到巨潮之类的平台逐条看上市公司公告。数据本身都是公开的,但要把它们持续、结构化地收集起来,手动操作既费时又容易漏。
这篇指南介绍如何用 NexGenData 的几个 Actor,把 A股常用的公开数据采集流程自动化。所有 Actor 都运行在 Apify 平台上,输出标准化 JSON,可以设定计划任务定时运行。
手动采集的痛点
- 龙虎榜、资金流、公告分散在不同网站,格式各不相同。
- 每天都要重复相同的筛选和翻页动作。
- 把网页数据整理进表格或数据库需要反复复制粘贴。
- 想接入自己的程序时,还得自己处理页面结构变化和分页。
一、龙虎榜数据
china-dragon-tiger-list 按市场和交易日期采集龙虎榜。它接受的输入字段包括:
market—— 指定市场。tradeDate—— 交易日期。maxResults—— 返回记录的上限。fetchSeats—— 是否一并抓取营业部席位信息。
一个采集某个交易日龙虎榜的输入示例如下:
{
"market": "SH",
"tradeDate": "2026-06-30",
"maxResults": 100,
"fetchSeats": true
}运行后,该交易日的龙虎榜记录会以数据集形式返回。Actor 只负责把公开数据整理出来,不对上榜情况做任何解读,具体判断仍需你结合原始信息自行完成。
二、北向资金 / 陆股通
china-stock-connect-flow 用于采集陆股通北向资金流向,输入非常简洁:
direction—— 资金流向。maxResults—— 返回记录上限。
{
"direction": "north",
"maxResults": 50
}这样就能把北向资金的公开数据拉取下来,方便与龙虎榜、公告等其他数据放在一起观察。
三、上市公司公告
china-listed-company-announcements 按条件检索上市公司公告,输入字段包括:
market—— 市场。daysBack—— 回溯的天数,例如只看最近一天。searchKey—— 关键词,可用公司名或主题过滤。category—— 公告类别。maxResults—— 返回上限。useApifyProxy—— 是否启用 Apify 代理。
例如,采集最近一天与某公司相关的公告:
{
"market": "SZ",
"daysBack": 1,
"searchKey": "比亚迪",
"maxResults": 50,
"useApifyProxy": true
}返回的公告列表通常包含标题、日期和原文链接,你可以据此跳转到官方公告原文核对内容。Actor 采集的是公开披露信息,不替代对原文的阅读。
用计划任务实现每日自动采集
这些 Actor 与 Apify 的计划任务功能配合,才能真正省下重复劳动:
- 先用理想的输入手动运行一次,确认结果符合预期。
- 在 Apify 控制台新建一个计划任务,关联该 Actor 及其输入。
- 用 Cron 表达式设定运行时间,例如每个交易日 16:00 收盘后运行。
- 把
daysBack设为 1、或把tradeDate设为当日,让每次运行只采集最新数据。
这样每天收盘后,龙虎榜、北向资金和最新公告就会自动整理好。结果可导出为 JSON、CSV、Excel,也可以通过数据集 API 直接接入你的看板或数据库。
把多个数据源串成一条流水线
上面三个 Actor 覆盖了 A股日常最常看的几类公开数据。你还可以加入大宗交易、CNIPA 专利检索等其他 Actor,用同一套计划任务把它们组织成一条完整的数据采集流水线。更多中国数据 Actor 可参见 中国数据套件。
开始使用
建议从单一数据源、单个交易日开始,先跑通一次,确认字段和输出符合需求,再逐步扩大范围并设定计划任务。打开对应的 Actor 页面填写输入表单,即可完成第一次运行。
仅供参考,不构成投资建议。本文所涉 Actor 仅采集并整理公开数据源,请在做出任何决策前自行核对交易所与公司官方原始信息。