Flex3D – Meta GenAI和牛津大学共同推出的两阶段3D生成框架 Flex3D是什么 Flex3D是Meta的GenAI团队和牛津大学研究团队推出的创新的两阶段3D生成框架,能基于任意数量的高质量输入视图,解决从文本、单张图片或稀疏视图图像生成高质量3D内容的挑战... Ai项目 2个月前1,1800
EvolveDirector – 阿里联合南洋理工推出文本到图像生成模型的高效训练技术 EvolveDirector是什么 EvolveDirector是阿里巴巴和南洋理工大学联合推出的创新框架,用公开资源和高级模型的API接口训练一个高性能的文本到图像生成模型。框架基于与现有高级模型的... Ai项目 2个月前1,1350
MCP – Anthropic 开源的模型上下文协议 MCP是什么 MCP(Model Context Protocol,模型上下文协议)是一个开放协议,是Anthropic开源的,能实现大型语言模型(LLM)应用与外部数据源和工具之间的无缝集成。基于客... Ai项目 2个月前1,4750
LazyGraphRAG – 微软推出的图形增强生成增强检索框架 LazyGraphRAG是什么 LazyGraphRAG是微软研究院推出的图形增强生成增强检索(RAG)框架,是GraphRAG的迭代版本。LazyGraphRAG在数据索引成本上大幅降低,是Grap... Ai项目 2个月前1,5100
LEOPARD – 腾讯AI Lab西雅图实验室推出的视觉语言模型 LEOPARD是什么 LEOPARD是腾讯AI Lab西雅图实验室推出的视觉语言模型,专为理解和处理含有大量文本的多图像任务设计。LEOPARD基于两个主要技术创新:一是策划约一百万条专门针对文本丰富... Ai项目 2个月前1,1700
书生InternThinker – 上海 AI Lab 推出的强推理模型 书生InternThinker是什么 书生InternThinker是上海人工智能实验室推出的强推理模型,具备自主生成高智力密度数据和元动作思考能力。基于长思维能力和自我反思、纠正机制,在数学、代码... Ai项目 2个月前1,0900
Pangea – 卡内基梅隆大学开源的多语言多模态大语言模型 Pangea是什么 Pangea是卡内基梅隆大学团队推出的多语言多模态大型语言模型(LLM),能提升全球语言和文化多样性的覆盖。模型包含600万条指令的多样化数据集,支持39种语言,包含高质量英文指令... Ai项目 2个月前1,7050
MobA – 上海交通大学推出的移动智能体 MobA是什么 MobA(Mobile Agent)是上海交通大学团队推出的新型移动智能体,基于多模态大型语言模型(MLLMs)提升移动设备的自动化任务执行能力。MobA采用两级架构:高级全局智能体... Ai项目 2个月前1,2550
Frames – Runway 推出的AI图像生成模型 Frames是什么 Frames是Runway推出的最新AI图像生成模型,在风格控制和视觉保真度方面取得巨大进步。Frames能维持风格一致性,支持广泛的创意探索,为项目建立特定外观,并生成符合用户美... Ai项目 2个月前2,2150
SlideChat – 上海AI Lab联合多所高校和机构推出的视觉语言助手 SlideChat是什么 SlideChat是上海AI实验室、厦门大学、华东师范大学等机构推出的,首个能理解千兆像素级别全切片图像的视觉语言助手。SlideChat能生成详尽的全切片图像描述,针对多样... Ai项目 2个月前1,5300