Vid2World–清华联合重庆大学推出视频模型转为世界模型的框架
AI工具百科:
Vid2World是什么
Vid2World是清华大学联合重庆大学推出的创新框架,支持将全序列、非因果的被动视频扩散模型(VDM)转换为自回归、交互式、动作条件化的世界模型。模型基...
OpenMathNemotron–英伟达开源的数学推理系列模型
AI工具百科:
OpenMathNemotron是什么
OpenMathNemotron是英伟达推出的系列开源数学推理模型,专门用在解决复杂数学问题,包括奥林匹克级别的难题。模型基于大规模数据集OpenMathReaso...
响指HaiSnap–AI零代码应用开发平台,可视化搭建应用
Ai工具百科:
响指HaiSnap是什么
响指HaiSnap是AI零代码应用开发平台,通过可视化操作和拖拽式界面,用户无需编写代码可快速搭建应用,简化了开发流程。响指HaiSnap支持调用多种预训练...
YuLanOneSim–人大高瓴AI团队推出的社会模拟器
AI工具百科:
YuLanOneSim是什么
YuLanOneSim(玉兰万象)是中国人民大学高瓴 AI 学院RUCGSAI团队推出的新型社会模拟器。基于大型语言模型(LLM)Agents 模拟人类社会行为,无需编程构...
WisprFlow–AI语音转文本工具,自动纠正拼写和语法错误
AI工具百科:
Wispr Flow是什么
Wispr Flow 是AI语音转文本工具,基于先进的AI技术,帮助用户在任何应用程序中实现快速语音转文字。Wispr Flow支持100多种语言,具备自动编辑、上下文...
DreamFit–字节联合清华和中山大学推出的虚拟试衣框架
AI工具百科:
DreamFit是什么
DreamFit是字节跳动团队联合清华大学深圳国际研究生院、中山大学深圳校区推出的虚拟试衣框架,专门用在轻量级服装为中心的人类图像生成。
框架能显著...
PixelHacker–华中科技联合VIVO推出的图像修复模型
AI工具百科:
PixelHacker是什么
PixelHacker 是华中科技大学和 VIVO AI Lab联合推出的图像修复(Image Inpainting)模型。基于引入潜在类别引导(Latent Categories Guidance, LCG)...
Head–AI市场营销工具,自动生成跨平台营销策略
AI工具百科:
Head是什么
Head是全球领先的 AI 市场营销工具,基于 AI 技术自动生成秒级部署的跨平台营销策略,精准计算病毒式传播路径,帮助品牌主和创作者将市场预算转化为可量化增...
VisionStory–AI视频生成工具,支持视频中角色的情感控制
AI工具百科:
VisionStory是什么
VisionStory是创新的AI视频生成工具,能将静态照片转化为生动的会说话的视频头像。通过AI技术,赋予图像丰富的情感和逼真的动作,支持语音克隆和多语...
SuperEdit–字节跳动等机构推出的图像编辑方法
AI工具百科:
SuperEdit是什么
SuperEdit是字节跳动智能创作团队和佛罗里达中央大学计算机视觉研究中心联合推出的指令引导图像编辑方法,基于优化监督信号提高图像编辑的精度和效果。S...
WebSSL–Meta联合纽约大学等机构推出的视觉自监督学习系列模型
AI工具百科:
WebSSL是什么
WebSSL(Webscale SelfSupervised Learning)是Meta、纽约大学等机构推出的视觉自监督学习(SSL)系列模型,基于大规模网络数据(如数十亿图像)训练视觉模...
VideoT1–清华联合腾讯推出的视频生成技术
AI工具百科:
VideoT1是什么
VideoT1 是清华大学和腾讯的研究人员共同推出的视频生成技术,基于测试时扩展(TestTime Scaling,TTS)提升视频生成的质量和一致性。传统视频生成模型在...

