Veo3–谷歌推出的新一代视频生成模型
AI工具百科:
Veo 3是什么
Veo 3是谷歌I/O开发者大会上发布的新一代视频生成模型。Veo 3是谷歌首个可生成视频背景音效的模型,能合成画面,能为鸟鸣、街头交通等场景配上相应的音效,...
ezsiteAI–零代码AI驱动的网站与应用构建平台
Ai工具百科:
ezsite AI是什么
ezsite AI 是无代码AI工具,能快速生成专业网站和应用。用户只需输入简单指令,如“创建一个咖啡店网站”,系统能在60秒内生成一个功能完备的网站,支持支...
ShotAdapter–Adobe联合UIUC推出的多镜头视频生成框架
AI工具百科:
ShotAdapter是什么
ShotAdapter是Adobe联合UIUC推出的用在文本到多镜头视频生成的框架,基于微调预训练的文本到视频模型,引入过渡标记和局部注意力掩码策略,实现对多镜...
网易见外
AI语言翻译,免费试用,网易推出的AI智能翻译平台,支持音视频、文档、图片、字幕等翻译
官网:https://sight.youdao.com
网易见外是由网易的人工智能事业部研发,是一个集视频听...
SpatialVLA–上海AILab联合上科大等推出的空间具身通用操作模型
AI工具百科:
SpatialVLA是什么
SpatialVLA 是上海 AI Lab、中国电信人工智能研究院和上海科技大学等机构共同推出的新型空间具身通用操作模型,基于百万真实数据预训练,为机器人赋予...
StreamBridge–苹果联合复旦推出的端侧视频大语言模型框架
AI工具百科:
StreamBridge是什么
StreamBridge 是苹果公司与复旦大学联合推出的端侧视频大语言模型(VideoLLMs)框架,能帮助 AI 实时理解直播流视频。框架基于内存缓冲区和轮次衰减...
GPTimage1–OpenAI推出的最新图像生成模型
AI工具百科:
GPTimage1是什么
GPTimage1是OpenAI推出的原生多模态图像生成模型,基于API向开发者开放使用。模型根据文本提示和图像生成高质量、专业级的图像,支持多种风格和自定义功...
象寄翻译
AI语言翻译,免费增值,AI图片和视频翻译神器,支持多种语言的翻译
官网:https://www.xiangjifanyi.com/console/register-invite/741be04feb30bf16
象寄翻译是是象寄科技推出的AI...
LangManus–AI自动化框架,多智能体协同完成复杂任务
AI工具百科:
LangManus是什么
LangManus 是 AI 自动化框架,基于分层多智能体系统设计。包含多种智能体,如协调员、规划员、研究员、程序员等,各司其职,协同完成复杂任务。
框架...
ToughTongueAI2.0–AI对话练习工具,具备多模态交互、智能对话模拟
AI工具百科:
Tough Tongue AI 2.0是什么
Tough Tongue AI 2.0 是多模态对话练习工具,帮助用户应对各种困难对话场景而设计。支持创建和分享多种对话场景,如面试、职场沟通、销售谈判...
MCPServers–字节跳动推出的大模型生态广场
AI工具百科:
MCP Servers是什么
MCP Servers是字节跳动推出的大模型生态广场,为开发者提供高效、灵活的大模型开发与部署环境。结合MCP Market、火山方舟和Trae开发环境,实现从工具...
SmolDocling–轻量级的多模态文档处理模型
AI工具百科:
SmolDocling是什么
SmolDocling(SmolDocling256Mpreview )是高效轻量级的多模态文档处理模型。能将文档图像端到端地转换为结构化文本,支持文本、公式、图表等多种元素...

