Picsman–AI图片编辑工具,提供多种智能图片处理功能
AI工具百科:
Picsman是什么
Picsman是强大的在线AI图片编辑工具,提供多种智能图片处理功能,如一键抠图换背景、消除笔、批量编辑、AI背景生成和图片变高清等。工具操作简单,适合电...
Eagle2.5–英伟达推出的视觉语言模型
AI工具百科:
Eagle 2.5是什么
Eagle 2.5是英伟达推出的视觉语言模型,专注于长上下文多模态学习的 AI 模型,参数规模仅为 8B。参数量较小,但在处理高分辨率图像和长视频序列方面表现...
DeepTranslate
AI语言翻译,免费,免费的AI双语翻译器,支持142+种语言
官网:https://deeptranslate.ai
DeepTranslate是什么
DeepTranslate 是一款免费的AI翻译器,能一键生成双语网页,支持多种...
ReasonIR8B–MetaAI推出专为推理密集型检索任务设计的模型
AI工具百科:
ReasonIR8B是什么
ReasonIR8B 是 Meta AI 推出的专为推理密集型检索任务设计的模型。基于 LLaMA3.18B 训练,采用双编码器架构,将查询和文档分别编码为嵌入向量,通过余...
MultiSWEbench–字节豆包开源的多语言代码修复基准
Ai工具百科:
MultiSWEbench是什么
MultiSWEbench 是字节跳动豆包大模型团队开源的首个多语言代码修复基准。在SWEbench基础上,首次覆盖Python之外的7种主流编程语言,包括Java、TypeS...
OpenSora2.0–潞晨科技开源的AI视频生成模型
AI工具百科:
OpenSora 2.0是什么
OpenSora 2.0 是潞晨科技推出的全新开源SOTA(StateoftheArt)视频生成模型。OpenSora 2.0 用 20 万美元(224 张 GPU)成功训练出 11B 参数的商业级...
Dia–开源文本转语音模型,支持生成自然逼真的对话语音
AI工具百科:
Dia是什么
Dia 是 Nari Labs 推出的开源文本转语音(TTS)模型,拥有 16亿参数,根据文本脚本直接生成高度逼真的对话语音,支持多说话者标记、情感语调控制以及非语言提...
Medeo–AI视频创作平台,一句话生成完整视频
AI工具百科:
Medeo是什么
Medeo 是先进的AI视频创作平台,能帮助创作者轻松将创意转化为专业视频。用户只需输入文字描述,Medeo 能自动拆分镜头、生成脚本,从海量素材库中精准匹配画...
Cardamon–AI合规平台,自动解析法规文本转为合规义务
AI工具百科:
Cardamon是什么
Cardamon 是 Y Combinator 推出 AI 驱动的合规平台,专为受监管的金融机构设计,通过自动化法规映射帮助企业快速实现合规。基于人工智能技术,将复杂的法...
NexusGen–魔搭联合华东师范等机构开源的全模态图像生成模型
AI工具百科:
NexusGen是什么
NexusGen 是魔搭团队、华东师范大学等机构推出的开源全能图像生成模型,支持同时完成图像理解、生成和编辑任务。NexusGen融合强大的语言模型与扩散模型的...
可灵2.0–快手推出的新一代AI视频生成模型
AI工具百科:
可灵2.0是什么
可灵2.0是快手推出的新一代 AI 视频生成模型,现已上线可灵AI视频平台。平台更新包含可灵2.0(大师版)和可图2.0两大基础模型。可图2.0大幅提升图片生成质...
TokenSwift–超长文本生成加速框架,90分钟内生成10万Token文本
AI工具百科:
TokenSwift是什么
TokenSwift 是北京通用人工智能研究院团队推出的超长文本生成加速框架,能在90分钟内生成10万Token的文本,相比传统自回归模型的近5小时,速度提升了3...

