未分类
RoboOS – 开启智能机器人协作新时代的跨本体具身大小脑协作框架
RoboOS 是什么 RoboOS 是北京智源人工智能研究院推出的全球首个跨本体具身大小脑协作框架。它基于 “大脑 - 小脑” 分层架构,具身大脑 RoboBrain 负责全局...
Vidu Q1 – 领航 AI 视频生成新时代的高可控多模态模型
Vidu Q1 是什么 Vidu Q1 是由生数科技推出的新一代高性能生成式 AI 视频模型。它以极致的视觉质量、流畅的电影级过渡、精准音效和增强的动画风格等特点引...
ObjectMover – 图像编辑的新革命
ObjectMover 是香港大学和 Adobe Research 联合提出的新型图像编辑模型,它解决了图像中物体移动、插入和移除时出现的光照、阴影不协调以及物体失真等常见问...
PhysGen3D – 开启单图生成交互式 3D 场景的新纪元
PhysGen3D 是什么 PhysGen3D 是一款由清华大学等顶尖高校联合推出的创新性 AI 产品,它能够将单张静态图像转换为可交互的动态 3D 场景,并生成具有物理真...
EmotiVoice – 开源多语言情感 TTS 引擎
EmotiVoice 是什么 EmotiVoice 是由网易有道开源的多语言、多声音和提示控制的文本到语音(TTS)系统。它支持英语和中文,提供超过 2000 种声音,用户可通...
Vibe Draw – 开源AI 3D建模工具,让创意无限绽放
Vibe Draw是什么 :Vibe Draw 是一款开源的 AI 3D 建模工具,它能够将用户在 2D 画布上绘制的涂鸦草图转化为精美的 3D 模型,打破了传统的 3D 建模技术门槛,...
OmniSQL – 开源文本到 SQL 转换的利器
OmniSQL 是什么 OmniSQL 是首个基于百万级合成数据训练的开源文本到 SQL 转换模型,由中国人民大学、字节跳动公司以及相关科研机构联合开发。它能够将自然...
MegaTTS 3 – 零样本语音合成的革新之力
MegaTTS 3 是什么 MegaTTS 3 是由字节跳动与浙江大学联合开发的零样本文本到语音合成系统,采用轻量级扩散模型,参数量仅 0.45B,可高效生成高质量语音。...
AutoGLM沉思 – 开启 AI 智能体 “边想边干” 新时代
AutoGLM沉思是什么 AutoGLM 沉思是由智谱 AI 推出的全球首个集深度研究能力和操作能力于一体的 AI Agent,能够模拟人类的思维过程,完成从数据检索、分析...
cpmGO – 面壁智能打造的全球首款纯端侧汽车智能助手
cpmGO 是什么 cpmGO 是面壁智能推出的全球首款专为汽车智能座舱设计的纯端侧智能助手,基于面壁小钢炮 MiniCPM 端侧模型开发,具备视觉、语音、多模态交互...