BAGEL–字节跳动开源的多模态基础模型
AI工具百科:
BAGEL是什么
BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,其中70亿为活跃参数。采用混合变换器专家架构(MoT),通过两个独立编码器分别捕捉图像的像素级和语...
AgentPrune–同济联合港中文等机构推出的多智能体通信优化框架
AI工具百科:
AgentPrune是什么
AgentPrune 是同济大学、香港中文大学等机构联合提出的针对大型语言模型(LLM)驱动的多智能体系统通信优化框架,通过“剪枝”技术,剔除冗余或有害的通...
CodeBuddy–腾讯云推出的AI编程助手
Ai工具百科:
CodeBuddy是什么
CodeBuddy 是腾讯云推出的 AI 编程助手,能帮助开发者高效编程。CodeBuddy 支持代码补全、诊断、优化、重构,能生成单元测试和进行代码评审。核心模式 C...
MealPlanner–AI饮食助手,提供定制化餐饮建议和详细食谱
AI工具百科:
MealPlanner是什么
MealPlanner 是创新的 AI 驱动的餐饮计划应用。基于分析用户的饮食偏好、过敏情况和饮食限制(如素食、无麸质等),生成个性化的餐饮计划。
用户与...
赤兔Chitu–清华联合清程极智开源的大模型推理引擎
AI工具百科:
Chitu是什么
Chitu(赤兔)是清华大学高性能计算研究所与清程极智联合开源的高性能大模型推理引擎,专为解决大模型在推理阶段的高成本和低效率问题设计,具有强大的硬件...
EmbodiedReasoner–浙大联合阿里等机构推出的具身交互推理模型
AI工具百科:
Embodied Reasoner是什么
Embodied Reasoner是浙江大学、中国科学院软件研究所、阿里巴巴集团等机构推出的新型的具身交互推理模型,基于视觉搜索、推理和行动协同完成复...
OmniCam–浙大联合上海交大等高校推出的多模态视频生成框架
AI工具百科:
OmniCam是什么
OmniCam 是先进的多模态视频生成框架,通过摄像机控制实现高质量的视频生成。支持多种输入模态组合,用户可以提供文本描述、视频中的轨迹或图像作为参考,...
VoltAgent–开源的AIAgent构建和编排框架
AI工具百科:
VoltAgent是什么
VoltAgent 是开源的 TypeScript 框架,用在构建和编排 AI Agent。VoltAgent 提供构建 AI 应用的基础结构和工具,简化与大语言模型(LLM)的交互、状态管...
Gemma3–谷歌最新推出的开源多模态AI模型
AI工具百科:
Gemma 3是什么
Gemma 3 是谷歌最新推出的开源人工智能模型,专为开发者设计,支持多种设备上的人工智能应用开发。支持超过 35 种语言,具备分析文本、图像及短视频的能力...
LocAgent–斯坦福联合耶鲁大学等机构推出的代码问题定位智能体
Ai工具百科:
LocAgent是什么
LocAgent是斯坦福大学、耶鲁大学和南加州大学等机构联合推出的,专注于代码定位任务的框架,帮助开发者快速准确地找到代码库中需要修改的部分。LocAgent...
ReveImage–Reve推出的全新AI图像生成模型
AI工具百科:
Reve Image是什么
Reve Image 是 Reve 推出的全新 AI 图像生成模型。专注于提升美学表现、精确的提示遵循能力以及出色的排版设计,能生成高质量的视觉作品。
模型在生...
LlamaNemotron–英伟达推出的系列推理模型
AI工具百科:
Llama Nemotron是什么
Llama Nemotron是NVIDIA推出的一系列推理模型,专注于推理和多种智能代理(agentic AI)任务。模型基于Llama开源模型,经过NVIDIA的后训练,加入推...

