抖音"图文视频"无水印轻松下载本地,可批量自动化处理
今年早些时候我写了影刀RPA | 小红书笔记"图片/视频"无水印轻松下载本地的分享,后台曾收到几位铁铁的留言:“能不能也做一个抖音版的?”“我想把抖音图集素材整理下来做内容复盘"。 于是,有了今天的这篇分享。
一、开发思路
这个应用采用的是解析html的方案,而不是网页监听,相比起来要简单一些,大致步骤是:获取抖音分享链接 → 解析作品页面 → 判断视频或图集 → 下载无水印内容至桌面 → 任务完成并关闭页面。
但是有一些细节仍需要注意,下面来看具体指令流程????

二、流程步骤
1. URL输入与初始化
应用启动后弹出自定义对话框,用户可以输入一个或多个抖音链接。
紧接着,” 文本分割成列表”指令会把这些链接拆分为一个列表,为后续的 ForEach 循环做准备。

2. 网页访问和html解析
进入循环后,会运行Microsoft Edge浏览器打开抖音作品网页,并根据页面结构来判断该作品是单个视频还是多张图片的图集。
关于作品类型的判断流程是:先通过xpath表达式定位主内容区的HTML片段代码,再从代码中进一步正则匹配到"能标识其类型的属性值"。

通过”开发者工具-元素面板”的代码,我们发现可以通过data-e2e的值来判断作品类型,如果值为“video-detail”,则说明是视频,如果值为“note-detail”,则为图文。


#补充:关于作品类型,也可以通过”获取网页信息-获取网址”来判定,当你输入https://www.douyin.com/video/*********,如果该作品为“图文”,则网址会自动变为“https://www.douyin.com/note/*********,这样你就能用if条件是否包含note来判定。
3. 作品类型判断分支及下载
1)当上一步判断作品类型为”视频”时,提取真实视频URL并下载。

解析网页源代码,找到


同时执行字符串替换,去除 &

#补充:获取元素源代码时,我们会发现实际获取的代码中会多出,多出的 是因为& 在 HTML 中有特殊含义,其规范要求在属性中使用& 时,必须写成&所以这里需要去掉。

HTTP下载执行

2)如果判断是图集内容,则提取所有图片URL列表,然后进入ForEach 图集列表循环处理下载。


4. 关闭网页(继续下一循环)
三、如何配置&使用?
1. 启动参数说明
启动应用后,只需填入抖音作品链接就行,多个链接换行输入
2. 环境/工具配置
需要影刀RPA账号:https://www.yingdao.com
使用Edge浏览器,并安装影刀自动化插件,软件右上角头像点击[工具-自动化插件]
抖音网页版提前登录账号
3. 注意事项
在运行过程中,请不要切换或关闭浏览器页面
下载视频或图集时,可能会受网络或权限的影响,请耐心等待完成提示
请勿短期内频繁操作以防触发风控,建议使用小号
-END-
爱练字的96年ISTJ型互联网人/信息整合怪/工具人/影刀高级认证工程师。
专注分享:RPA&AI自动化场景提效方案、效率软件安利、实用技能。“所有的生产要素都可以被构建,只有认知是壁垒”,欢迎関注 @掌心向暖
推荐阅读:
影刀RPA | 小红书笔记“图片/视频“无水印轻松下载本地
那些拥有上千浏览器书签/收藏夹的电脑用户,是怎么管理书签的?
不会编程的我开发了一款近900行指令的自动化RPA应用,完美解决98%以上复制受限的飞书文档!!
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
