MCPServers–字节跳动推出的大模型生态广场
AI工具百科:
MCP Servers是什么
MCP Servers是字节跳动推出的大模型生态广场,为开发者提供高效、灵活的大模型开发与部署环境。结合MCP Market、火山方舟和Trae开发环境,实现从工具...
ReasonIR8B–MetaAI推出专为推理密集型检索任务设计的模型
AI工具百科:
ReasonIR8B是什么
ReasonIR8B 是 Meta AI 推出的专为推理密集型检索任务设计的模型。基于 LLaMA3.18B 训练,采用双编码器架构,将查询和文档分别编码为嵌入向量,通过余...
MultiSWEbench–字节豆包开源的多语言代码修复基准
Ai工具百科:
MultiSWEbench是什么
MultiSWEbench 是字节跳动豆包大模型团队开源的首个多语言代码修复基准。在SWEbench基础上,首次覆盖Python之外的7种主流编程语言,包括Java、TypeS...
OpenSora2.0–潞晨科技开源的AI视频生成模型
AI工具百科:
OpenSora 2.0是什么
OpenSora 2.0 是潞晨科技推出的全新开源SOTA(StateoftheArt)视频生成模型。OpenSora 2.0 用 20 万美元(224 张 GPU)成功训练出 11B 参数的商业级...
Dia–开源文本转语音模型,支持生成自然逼真的对话语音
AI工具百科:
Dia是什么
Dia 是 Nari Labs 推出的开源文本转语音(TTS)模型,拥有 16亿参数,根据文本脚本直接生成高度逼真的对话语音,支持多说话者标记、情感语调控制以及非语言提...
NexusGen–魔搭联合华东师范等机构开源的全模态图像生成模型
AI工具百科:
NexusGen是什么
NexusGen 是魔搭团队、华东师范大学等机构推出的开源全能图像生成模型,支持同时完成图像理解、生成和编辑任务。NexusGen融合强大的语言模型与扩散模型的...
TokenSwift–超长文本生成加速框架,90分钟内生成10万Token文本
AI工具百科:
TokenSwift是什么
TokenSwift 是北京通用人工智能研究院团队推出的超长文本生成加速框架,能在90分钟内生成10万Token的文本,相比传统自回归模型的近5小时,速度提升了3...
UniFluid–谷歌联合麻省理工推出的多模态图像生成与理解框架
AI工具百科:
UniFluid是什么
UniFluid 是谷歌 DeepMind 和麻省理工学院联合推出的,统一的自回归框架,用在联合视觉生成和理解任务。基于连续视觉标记处理多模态图像和文本输入,生成...
Deepgram
AI音频工具,免费增值,快速低成本的AI语音文本互转API平台
官网:https://deepgram.partnerlinks.io
Deepgram是什么
Deepgram是一个提供先进的AI语音识别和自然语言处理技术的平台...
AgentDevelopmentKit–谷歌开源的AIAgent开发与部署框架
AI工具百科:
Agent Development Kit是什么
Agent Development Kit(ADK)是谷歌开源的首个AI智能体开发工具包,是一个代码优先的Python工具包,简化复杂AI代理的构建、评估和部署过程...
Claude3.7Max–Cursor上线的最新AI模型,支持200k上下文
AI工具百科:
Claude 3.7 Max是什么
Claude 3.7 Max 是 Cursor 推出的专为复杂代码任务设计的最新 AI 模型,称为史上最强代码助手。基于 Claude 3.7 思考模型,具备 200k 超大上下文窗...
OpenLLMVTuber–AI数字人语音交互项目,支持实时语音对话和视觉感知
AI工具百科:
OpenLLMVTuber是什么
OpenLLMVTuber 是开源的跨平台语音交互 AI 伴侣项目。支持实时语音对话、视觉感知,配备生动的 Live2D 动态形象,能完全离线运行,保护隐私。用户将...

