Genie 2 – 谷歌DeepMind推出的最新一代基础世界模型 Genie 2是什么 Genie 2是DeepMind推出的新一代大规模基础世界模型,仅凭一张图片生成长达1分钟的可交互3D游戏世界。Genie 2能模拟出物体交互、角色动画、物理效果等复杂动态,支持... Ai项目 2周前5,8550
I2V-01-Live – 海螺AI推出的图生视频模型,将静态图像转化为动态视频 I2V-01-Live是什么 I2V-01-Live是海螺AI推出的图生视频模型,能将静态二维图像转化为动态视频。模型基于深度学习技术,增强动作的流畅度和生动性,让人物或对象的动作更加自然和真实。I2... Ai项目 2周前4,6800
StableAnimator – 复旦联合微软等机构推出的端到端身份一致性视频扩散框架 StableAnimator是什么 StableAnimator是复旦大学、微软亚洲研究院、虎牙公司和卡内基梅隆大学共同推出的端到端高质量身份保持视频扩散框架。StableAnimator能根据一张参... Ai项目 2周前5,0900
PersonaCraft – 首尔国立大学推出的单参考图像生成多身份全身图像技术 PersonaCraft是什么 PersonaCraft是韩国首尔国立大学推出的个性化全身图像合成技术,结合扩散模型和3D人类建模,能从单一参考图像生成多个人物的逼真、个性化全身图像。PersonaC... Ai项目 2周前4,8700
Vanna – 开源AI检索生成框架,自动生成精确的SQL查询 Vanna是什么 Vanna是开源的Python RAG(Retrieval-Augmented Generation)框架,能帮助用户基于大型语言模型(LLMs)为其数据库生成精确的SQL查询。Va... Ai项目 2周前5,8300
GPT学术优化 – 专为学术研究和写作设计的多功能开源项目 GPT学术优化是什么 GPT学术优化(GPT Academic)是功能丰富的开源项目,专为学术研究和写作设计。GPT学术优化集成一键论文翻译、源代码解析、互联网信息获取、Latex文章校对、论文润色和... Ai项目 2周前4,9850
Lobe Vidol – AI数字人交互平台,可与虚拟人和 3D 模型聊天互动 Lobe Vidol是什么 Lobe Vidol是开源的数字人创作平台,让每个人都能轻松创建和互动自己的虚拟偶像。Lobe Vidol提供流畅的对话体验、背景设置、动作姿势库、优雅的用户界面、角色编辑... Ai项目 2周前5,6150
HunyuanVideo – 腾讯推出的开源视频生成模型,参数高达130亿 HunyuanVideo是什么 HunyuanVideo是腾讯开源的视频生成模型,拥有130亿参数,是目前参数量最大的开源视频模型之一。HunyuanVideo具备物理模拟、高文本语义还原度、动作一致... Ai项目 2周前7,4900
Amazon Nova – 亚马逊推出的全新大模型系列,覆盖文本、图像、视频生成领域 Amazon Nova是什么 Amazon Nova 是亚马逊云服务(AWS)推出的新一代AI基础模型系列,提供行业领先的性能和成本效益。系列包括专门处理文本的Amazon Nova Micro、多模... Ai项目 2周前6,3750
EfficientTAM – Meta AI推出的视频对象分割和跟踪模型 EfficientTAM是什么 EfficientTAM是Meta AI推出的轻量级视频对象分割和跟踪模型,能解决SAM 2模型在移动设备上部署时的高计算复杂度问题。基于用简单的非层次化Vision ... Ai项目 2周前4,8150