MM-StoryAgent – 上海交大联合阿里开源的多智能体故事绘本视频生成框架 MM-StoryAgent是什么 MM-StoryAgent 是上海交通大学X-LANCE实验室和阿里巴巴集团联合推出的开源多模态、多智能体框架,用在生成沉浸式的有声故事绘本视频。基于结合大型语言模型... Ai项目 12个月前04,9600
Deep Research Web UI – 开源 AI 研究助手,逐步深入挖掘研究主题 Deep Research Web UI是什么 Deep Research Web UI 是开源的 AI 研究助手工具,帮助用户高效地进行深度研究。通过 AI 驱动的迭代搜索,逐步深入挖掘指定主题,以... Ai项目 12个月前06,9900
Gemma 3 – 谷歌最新推出的开源多模态 AI 模型 Gemma 3是什么 Gemma 3 是谷歌最新推出的开源人工智能模型,专为开发者设计,支持多种设备上的人工智能应用开发。支持超过 35 种语言,具备分析文本、图像及短视频的能力,提供四种不同尺寸的模... Ai项目 12个月前07,8400
Reka Flash 3 – Reka AI 推出的开源推理模型 Reka Flash 3是什么 Reka Flash 3 是 Reka AI 推出的开源推理模型,拥有 21 亿参数。支持多模态输入,包括文本、图像、视频和音频,可处理最多 32k 个令牌的上下文长度... Ai项目 12个月前05,2600
子曰翻译2.0 – 网易有道推出的最新翻译大模型 子曰翻译2.0是什么 子曰翻译2.0是网易有道推出的最新翻译大模型,模型在数据、算法和评估三个关键维度进行了系统性升级,实现了翻译质量、效率和鲁棒性的质的飞跃。 在数据层面,有道收集清洗了数千万高质量... Ai项目 12个月前04,5500
Motion Anything – 腾讯联合京东等高校推出的多模态运动生成框架 Motion Anything是什么 Motion Anything 是澳大利亚国立大学、悉尼大学、腾讯、麦吉尔大学、京东等机构推出的多模态运动生成框架,根据文本、音乐或两者的组合生成高质量、可控的人... Ai项目 12个月前05,1950
AI-Researcher – 香港大学推出的开源自动化科学研究工具 AI-Researcher是什么 AI-Researcher 是香港大学数据科学实验室推出的开源自动化科学研究工具,基于大型语言模型(LLM)代理实现从研究想法到论文发表的全流程自动化。AI-Rese... Ai项目 12个月前04,9400
Open-Sora 2.0 – 潞晨科技开源的AI视频生成模型 Open-Sora 2.0是什么 Open-Sora 2.0 是潞晨科技推出的全新开源SOTA(State-of-the-Art)视频生成模型。Open-Sora 2.0 用 20 万美元(224 张... Ai项目 12个月前04,3350
Gemini Robotics – 谷歌 DeepMind 推出的具身智能大模型 Gemini Robotics是什么 Gemini Robotics 是谷歌 DeepMind 推出的基于 Gemini 2.0 的机器人项目,将大型多模态模型的能力引入物理世界。项目包含两个主要模型... Ai项目 12个月前06,2300
PP-TableMagic – 百度飞桨团队开源的表格识别工具 PP-TableMagic是什么 PP-TableMagic 是百度飞桨团队推出的高性能表格识别工具,用在将图片中的表格结构化信息提取出来,转换为 HTML 等格式,进行进一步的数据处理和分析。PP... Ai项目 12个月前05,7700