Higgsfield–AI视频生成平台,提供专业电影节级相机控制能力
AI工具百科:
Higgsfield是什么
Higgsfield是AI视频生成平台,通过先进的 AI 技术,将简单的创意和文本提示转化为高质量的视频内容,适合电影制作、广告和社交媒体视频创作。
包括...
LTXV13B–Lightricks开源的最新视频生成模型
AI工具百科:
LTXV13B是什么
LTXV13B 是Lightricks推出的开源 AI 视频生成模型,拥有 130 亿参数。具备极高的生成速度,比同类产品快 30 倍,能在普通消费级显卡(如 4090/5090)上运...
Animon–免费AI动画生成平台,融合日式动漫美学
AI工具百科:
Animon是什么
Animon 是日本 Animon Dream Factory 推出的全球首个专注于动漫制作的 AI 视频生成平台。通过深度学习模型将日本传统动漫美学与尖端 AI 技术相结合,用户只...
MagicColor–香港科技大学推出的多实例线稿图着色框架
AI工具百科:
MagicColor是什么
MagicColor 是香港科技大学推出的多实例线稿图着色框架,支持高效地为线稿图添加色彩。MagicColor基于自监督训练策略和实例引导模块,解决多实例数据不...
OpenUtau–开源的AI歌声合成工具,自动适配系统语言
AI工具百科:
OpenUtau是什么
OpenUtau 是开源的歌声合成工具,兼容 UTAU 音源库和重采样器,支持 VSQX 导入、多语言界面及预渲染功能,帮助创作者快速预览作品节省时间。OpenUtau现代...
Lipsync2–SyncLabs推出的首个零shot嘴型同步模型
AI工具百科:
Lipsync2是什么
Lipsync2 是 Sync Labs 推出的全球首个零shot 嘴型同步模型。无需针对特定演讲者进行预训练,能即时学习并生成符合独特说话风格的嘴型同步效果。
模型...
Narakeet–AI文本转语音平台,支持100种语言和800种声音
AI工具百科:
Narakeet是什么
Narakeet 是功能强大的在线平台,基于自然语音合成技术快速创建配音和旁白视频。Narakeet支持 100 种语言和 800 种声音,将文本、Word 文档、PPT 演示文...
九歌–清华大学推出的AI诗歌写作工具
工具百科:
九歌是什么
九歌是清华大学自然语言处理与社会人文计算实验室推出的AI诗歌写作系统。九歌基于深度学习技术,用超过80万首人类诗人创作的诗歌进行训练,辅助用户生成符合古...
VeoGoAI–AI短视频预测工具,提供流量预测和优化建议
AI工具百科:
VeoGo AI是什么
VeoGo AI 是面向短视频创作者的智能预测工具,通过深度学习算法提前预测视频流量表现,提供秒级优化建议,帮助创作者提升视频曝光率和点击率。基于深度神...
AudioSDS–NVIDIA推出的扩展文本条件音频扩散模型
AI工具百科:
AudioSDS是什么
AudioSDS是NVIDIA AI研究团队推出的创新技术,将Score Distillation Sampling(SDS)技术扩展至文本条件音频扩散模型,为音频处理领域带来了重大突破。无...
EasyControlGhibli–免费生成吉卜力风格图像的AI模型
AI工具百科:
EasyControl Ghibli是什么
EasyControl Ghibli 是基于 EasyControl 框架开发的 AI 模型,已上线 Hugging Face 平台,专注于将普通图像转换为吉卜力风格的图像。
仅用1...
HRAvatar–清华联合IDEA推出的单目视频生成3D头像技术
AI工具百科:
HRAvatar是什么
HRAvatar是清华大学联合IDEA团队推出的单目视频重建技术,支持从普通单目视频中生成高质量、可重光照的3D头像。HRAvatar用可学习的形变基和线性蒙皮技术...

