我在3周内抓取了59.4亿个TikTok视频和32.3亿个用户资料。将完整数据集免费上传至Hugging Face。下方提供逐步教程和代码。[P]

Reddit r/MachineLearning 工具

摘要

作者使用逆向工程方法抓取了59.4亿个TikTok视频和32.3亿个用户资料,并将完整数据集上传至Hugging Face,提供教程和代码但需付费。

刚刚将完整的59.4亿个TikTok视频数据集上传至Hugging Face。它是完全开源的:https://huggingface.co/datasets/kuben-developer/tiktok-videos-4b 该数据集是使用我几年前开发的TikTok移动应用逆向工程方法收集的。该方法使我能够提取数十亿的视频、用户资料、评论和回复、标签、音频等。完整文档和代码在此:https://tiktok-api.seeksocial.io 免责声明:TikTok应用暴露了24个无需TikTok账户即可访问的端点,因此数据本身是公开可访问的。但以这种方式访问可能仍然违反TikTok的服务条款。此外,完整代码并非免费,我收取少量费用以提供访问权限。
查看原文

相似文章

@Honcia13: 老外直接把AI全自动批量做TikTok爆款的完整教程甩出来了! 你还在手动发帖?太落后了! 五步零成本流程: -TikTok找爆款下载 -扔进Claude Opus 4.7分析钩子+文案 -Pinterest白嫖顶级图片 -Node.js…

X AI KOLs Timeline

一个完整的AI全自动批量制作TikTok爆款教程,五步零成本流程:从TikTok下载爆款视频、使用Claude Opus 4.7分析钩子和文案、从Pinterest获取图片、用Node.js自动合成图文视频,最后通过Postiz自托管定时群发。每周仅需2小时即可稳定产出30条内容。

@sairahul1: https://x.com/sairahul1/status/2066809666592718879

X AI KOLs Timeline

一份关于构建AI驱动内容机器的详细指南,该机器从TikTok和Instagram等平台抓取热门内容,使用AI生成平台原生帖子,并利用ScrapeCreators、Kie.ai和Postiz等工具自动安排发布计划。