未分类

Dolphin – 开源多模态文档解析大模型

什么是Dolphin? Dolphin是由字节跳动开发的一款开源多模态文档解析大模型,专注于高效处理复杂文档图像中的文本、表格、公式等元素。它通过创新的“先解析...

Playwright MCP – AI驱动的浏览器自动化新范式

Playwright MCP 是一款将大型语言模型(LLM)与 Playwright 浏览器自动化技术深度融合的创新工具。它通过 Model Context Protocol(模型上下文协议)实现了 A...

RelightVid – 视频重照明的革命性工具

RelightVid是什么 RelightVid是由上海AI Lab联合复旦大学、上海交通大学、浙江大学、斯坦福大学和香港中文大学共同推出的一款视频重照明模型。它能够根据...

HRAvatar – 开启单目视频生成3D头像的新时代

HRAvatar是什么 HRAvatar(High-Quality and Relightable Gaussian Head Avatar)是由清华大学深圳国际研究生院与国际数字经济学院(IDEA)联合开发的高质...

Pocket Flow – 极简主义的AI开发新范式

Pocket Flow 是一个极简主义的大型语言模型(LLM)框架,仅用约100行代码实现。它以轻量级、无依赖、无厂商锁定为特点,支持多Agents、工作流、检索增强生成...

Aurora – 智能化未来的核心引擎

Aurora是什么 Aurora是一个多功能的AI产品,具体形态和功能因开发团队和应用场景的不同而有所差异。例如,xAI开发的Aurora是一款图像生成器,能够根据用户...

DeepWiki MCP – 打破知识孤岛,连接 AI 与 GitHub 的桥梁

DeepWiki MCP 是什么 DeepWiki MCP 是由 Cognition Labs 推出的一款基于 Model Context Protocol(MCP)的服务工具。它旨在将 DeepWiki 平台对 GitHub 项...

Gemini Diffusion – 重塑文本生成的未来

Gemini Diffusion 是什么? Gemini Diffusion 是由 Google DeepMind 开发的一种实验性文本扩散模型,于 2025 年 5 月 20 日在 Google I/O 大会上首次亮相...

3DTown – 从单视图到逼真3D城镇的创新之旅

3DTown是什么 3DTown是由哥伦比亚大学联合Cybever AI等机构推出的一款创新框架,能够从单张俯视图生成逼真且连贯的3D城镇场景。它采用区域化生成和空间感...

SurfSense – 开源AI研究助手,打造个性化知识管理与研究平台

SurfSense是一款开源的AI研究助手,旨在通过整合个人知识库与全球数据源,为用户提供高效、个性化的研究支持。它不仅支持用户上传和管理多种格式的文件,还能...
1 292 293 294 295 296 442