MistralSmall3.1–MistralAI开源的多模态AI模型
AI工具百科:
Mistral Small 3.1是什么
Mistral Small 3.1 是 Mistral AI 开源的多模态人工智能模型,有 240 亿参数,基于 Apache 2.0 许可证发布。在文本和多模态任务上表现出色,支...
HunyuanCustom–腾讯混元开源的多模态定制视频生成框架
AI工具百科:
HunyuanCustom是什么
HunyuanCustom是腾讯混元团队推出的多模态驱动的定制化视频生成框架。HunyuanCustom支持图像、音频、视频和文本等多种输入条件,支持生成具有特定主...
HumanRig–阿里高德推出的3D人形角色自动绑定任务数据集
AI工具百科:
HumanRig是什么
HumanRig 是阿里巴巴团队开发的 3D 人形角色自动绑定研究项目。解决现有绑定技术因缺乏高质量数据集而发展受限的问题,通过提供大规模、高质量的数据集和...
COMET–字节开源的通信优化系统
AI工具百科:
COMET是什么
COMET是字节跳动推出的针对MixtureofExperts(MoE)模型的优化系统,能解决分布式训练中通信开销过大的问题。基于细粒度的计算通信重叠技术,COMET将通信与...
飞猪AI问一问–飞猪推出的多智能体AI旅行助手
AI工具百科:
飞猪AI问一问是什么
飞猪AI问一问是飞猪推出的多智能体驱动的AI旅行助手。通过多个专业智能助手协同工作,为用户提供从行程规划到预订的一站式旅行服务。用户只需提出需...
HoloTime–北大联合鹏城实验室推出的全景4D场景生成框架
AI工具百科:
HoloTime是什么
HoloTime 是北京大学深圳研究生院和鹏城实验室推出的全景 4D 场景生成框架,基于视频扩散模型将单张全景图像转化为具有真实动态效果的全景视频,进一步重...
Oracle–Flowith推出的通用型AIAgent
AI工具百科:
Oracle是什么
Oracle 是 Flowith 团队推出的AI Agent,能实现通用人工智能(preAGI)。Oracle专为处理复杂、多步骤任务而设计,具备自主规划、任务分解、无限制工具调用...
Aether–上海AILab开源的生成式世界模型
AI工具百科:
Aether是什么
Aether 是上海AI Lab开源的生成式世界模型,完全基于合成数据训练。Aether 首次将三维时空建模与生成式建模深度融合,具备 4D 动态重建、动作条件视频预测...
AVD2–清华联合复旦等机构推出的自动驾驶事故视频理解与生成框架
AI工具百科:
AVD2是什么
AVD2(Accident Video Diffusion for Accident Video Description)是清华大学联合香港科技大学、吉林大学、南京理工大学、北京理工大学、复旦大学等机构推出...
SteamerI2V–百度推出的图像到视频生成模型
AI工具百科:
SteamerI2V是什么
SteamerI2V 是百度 Steamer 团队推出的图像到视频生成模型,通过将静态图像转化为动态视频,展现出卓越的视觉生成能力。模型在 VBench 国际权威的视频...
ChatUI–阿里推出的开源智能对话式UI组件库
AI工具百科:
ChatUI是什么
ChatUI 是阿里团队推出的开源智能对话式 UI 组件库,能帮助开发者快速构建高质量的聊天应用,提供响应式设计、国际化、主题定制等功能。ChatUI 基于阿里巴...
Lovart–首个专业AI设计Agent,从创意到交付全链路设计
AI工具百科:
Lovart是什么
Lovart 是 LiblibAI 为设计师打造的世界上首个专业设计 Agent。Lovart 能像专业设计师一样思考和执行设计任务,提供高水平的设计方案。基于自然语言交互,...

