UniAct–清华、商汤、北大、上海AILab共同推出的具身基础模型框架
AI工具百科:
UniAct是什么
UniAct 是新型的具身基础模型框架,解决不同机器人之间行为异构性的问题。通过学习通用行为,捕捉不同机器人共享的原子行为特征,消除因物理形态和控制接口...
MTMegatronLM–摩尔线程开源的混合并行训练框架
AI工具百科:
MTMegatronLM是什么
MTMegatronLM 是摩尔线程推出的面向全功能 GPU 的开源混合并行训练框架,主要用于高效训练大规模语言模型。支持 dense 模型、多模态模型及 MoE(混合...
GPT4.1–OpenAI推出新一代语言模型,支持百万token上下文
AI工具百科:
GPT4.1是什么
GPT4.1 是 OpenAI 最新推出的新一代语言模型,包含 GPT4.1、GPT4.1 mini 和 GPT4.1 nano 三个版本。系列模型在编码能力、指令遵循和长文本处理等方面有显著...
Gemini2.0Flash–Google推出的多模态AI模型
AI工具百科:
Gemini 2.0 Flash是什么
Gemini 2.0 Flash是Google推出的多模态AI模型,结合文本理解和图像生成能力。根据自然语言输入生成高质量的图像,支持多轮对话式的图像编辑,保...
Miras–谷歌推出的深度学习架构设计通用框架
AI工具百科:
Miras是什么
Miras是谷歌推出的用在深度学习架构设计的通用框架,特别是序列建模任务。Miras基于关联记忆和注意力偏差的概念,将Transformer、现代线性RNN等模型重新定义...
FourierN1–傅利叶推出的首款开源人形机器人
AI工具百科:
Fourier N1是什么
Fourier N1 是通用机器人公司傅利叶发布的首款开源人形机器人。身高1.3米,体重38公斤,拥有23个自由度,采用铝合金与工程塑料复合结构,兼具强度与灵...
Qwen2.5Omni–阿里开源的端到端多模态模型
AI工具百科:
Qwen2.5Omni是什么
Qwen2.5Omni 是阿里开源的 Qwen 系列旗舰级多模态模型,拥有7B参数,Qwen2.5Omni具备强大的多模态感知能力,能处理文本、图像、音频和视频输入,支持...
RightNowAI–自动分析和优化CUDA内核代码的AI平台
Ai工具百科:
RightNow AI是什么
RightNow AI 是专注于优化 CUDA 代码的 AI 平台。通过自动分析和优化 CUDA 内核代码,显著提升 GPU 性能,支持多种 NVIDIA GPU 架构,如 Ampere、Hopp...
NEXUSO–多模态AI模型,实现对语言、音频和视觉全方位感知与交互
AI工具百科:
NEXUSO是什么
NEXUSO 是HiThink 研究院、英国帝国理工学院、浙江大学、复旦大学、微软、Meta AI等机构推出的多模态AI模型,能实现对语言、音频和视觉信息的全方位感知与...
SeniorTalk–智源联合南开开源的超高龄老年人中文对话语音数据集
AI工具百科:
SeniorTalk是什么
SeniorTalk 是智源研究院联合南开大学计算机学院人类语言技术实验室(HLT Lab)推出的全球首个中文超高龄老年人对话语音数据集。数据集包含202位75岁及...
MindLLM–耶鲁联合剑桥等机构推出的医疗领域AI模型
AI工具百科:
MindLLM是什么
MindLLM 是耶鲁大学、达特茅斯学院和剑桥大学联合推出的AI模型,能将脑部功能性磁共振成像(fMRI)信号解码为自然语言文本。
MindLLM基于一个主体无关(s...
Vid2World–清华联合重庆大学推出视频模型转为世界模型的框架
AI工具百科:
Vid2World是什么
Vid2World是清华大学联合重庆大学推出的创新框架,支持将全序列、非因果的被动视频扩散模型(VDM)转换为自回归、交互式、动作条件化的世界模型。模型基...

