基于ByteDance agentkit-samples多媒体用例的小省导购员数字人带货视频生成技能,整合多模态内容生成能力(图像、视频、音频),支持AI绘画、语音合成、视频生成,与小省导购员人设融合,9:16竖屏适配,直接对接带货视频生成流程
54
62%
Does it follow best practices?
Run evals on this skill
Adds up to 20 points to the overall score
View guide
Passed
No findings from the security scan
Fix and improve this skill with Tessl
tessl review fix ./skills/agentkit-multimedia-shopping/agentkit-multimedia-shopping/SKILL.md本技能依赖以下Python包:
Pillow>=10.0.0
requests>=2.28.0
numpy>=1.24.0使用AI绘画生成小省导购员角色形象:
输入信息:
生成流程:
输出:角色参考图(9:16竖屏)
使用AI绘画生成场景背景:
输入信息:
生成流程:
输出:场景参考图(9:16竖屏)
使用TTS生成导购员语音:
输入信息:
生成流程:
输出:语音文件(16kHz单声道wav)
使用音乐生成工具生成背景音乐:
输入信息:
生成流程:
输出:音乐文件(16kHz单声道wav)
使用多模态组合生成视频:
输入信息:
生成流程:
输出:完整视频(25秒,9:16竖屏)
功能说明:生成小省导购员数字人带货视频的完整流程
执行方式:
关键参数:
输出:完整带货视频(25秒,9:16竖屏)
功能说明:仅生成小省导购员角色参考图
执行方式:调用generate_character.py
关键参数:
输出:角色参考图(9:16竖屏)
角色固定特征描述
↓
AI绘画生成(角色形象+场景背景)
↓
语音合成(导购员语音+背景音乐)
↓
InfiniteTalk提示词生成(使用infinitetalk-shopping-avatar Skill)
↓
多模态视频生成(图像+音频+提示词)
↓
完整带货视频(25秒,9:16竖屏)本技能与infinitetalk-shopping-avatar Skill协同工作:
协同流程:
本技能生成角色参考图 → infinitetalk-shopping-avatar生成提示词 → InfiniteTalk生成视频
本技能生成语音文件 → chinese-wav2vec2-base编码 → InfiniteTalk使用
本技能生成音乐文件 → chinese-wav2vec2-base编码 → InfiniteTalk使用f595e96
If you maintain this skill, you can claim it as your own. Once claimed, you can manage eval scenarios, bundle related skills, attach documentation or rules, and ensure cross-agent compatibility.