多源采集台
- 类别 : 数据采集
- 客户 : 银河出海
- 交付 : 2026
项目说明
Scrapy / Crawlee / Firecrawl:竞品页、评价与素材回流,给 Listing 和广告素材可追溯输入。
界面里实际在做的事
采集台管理任务与源站,结果进仓,而不是散落在下载文件夹。
为什么要单独做这一层
上品文案如果全靠拍脑袋,A+ 和详情页会互相打架。采集提供证据链。
这个项目解决什么
标题、卖点、异议处理进独立站详情和 Amazon Listing。
-
01
竞品页
结构字段可复用。
-
02
评价
异议处理有来源。
-
03
任务
失败能重跑。
-
04
入仓
SKU 对得上。
和全链路怎么接
视频嗅探台负责素材文件,采集台负责结构化字段。
关于本项目
常见问题
-
采集台是主题演示吗?不是。这是本机 Docker 已跑通的系统,入口 127.0.0.1:18630,详情图来自真实功能页。
-
和招聘/协作有什么关系?可以对着界面讲流程:输入从哪来、人审在哪、结果写到哪,而不是只贴架构图。
-
会不会动正式广告或订单?采集对象是公开页与授权源,不在这里改店铺后台。
-
手机上能看吗?这些是运营后台,设计给桌面演示;独立站店面另有 Electro 验证转化路径。
-
数据怎么隔离?每个栈独立 compose 与端口,互不共用网络,方便单独拉起或关掉。