X-Dancer – 字节等机构推出音乐驱动的人像舞蹈视频生成框架 X-Dancer是什么 X-Dancer 是字节跳动联合加州大学圣地亚哥分校和南加州大学的研究人员共同推出的音乐驱动的人像舞蹈视频生成框架,支持从单张静态图像生成多样化且逼真的全身舞蹈视频。X-Dan... Ai项目 12个月前05,1450
AVD2 – 清华联合复旦等机构推出的自动驾驶事故视频理解与生成框架 AVD2是什么 AVD2(Accident Video Diffusion for Accident Video Description)是清华大学联合香港科技大学、吉林大学、南京理工大学、北京理工大... Ai项目 12个月前06,4200
Kiss3DGen – 基于图像扩散模型的3D资产生成框架 Kiss3DGen是什么 Kiss3DGen是创新的3D资产生成框架,通过重新基于预训练的2D图像扩散模型来高效生成、编辑和增强3D对象。核心在于生成“3D Bundle Image”,将多视图图像及... Ai项目 12个月前05,0050
Archon – 开源 AI 智能体框架,自主生成代码构建 AI 智能体 Archon是什么 Archon 是专注于构建和优化 AI 智能体的开源项目。通过自主生成代码和优化智能体性能,展示了现代 AI 开发的核心理念。Archon 的核心功能包括智能体的快速构建、多智能体... Ai项目 12个月前05,0800
PodAgent – 港中文、微软、小红书联合推出的播客生成框架 PodAgent是什么 PodAgent 是香港中文大学、微软和小红书联合推出的播客生成框架。基于模拟真实的脱口秀场景,用多智能体协作系统(包括主持人、嘉宾和编剧)自动生成丰富且结构化的对话内容。Po... Ai项目 12个月前05,1900
Chat2SVG – 文本描述实现高质量矢量图形的生成框架 Chat2SVG是什么 Chat2SVG 是创新的文本到矢量图形(SVG)生成框架,通过结合大型语言模型(LLMs)和图像扩散模型,实现高质量 SVG 图形的自动化创作。通过多阶段流程,首先基于 LL... Ai项目 12个月前05,4350
QwQ-32B – 阿里通义千问开源的最新推理模型 QwQ-32B是什么 QwQ-32B 是阿里巴巴开源的新型推理模型,参数量为 320 亿。基于大规模强化学习(RL)训练,在数学推理、编程等任务上表现出色,性能比肩 6710 亿参数的 DeepSee... Ai项目 12个月前06,9300
Light-R1 – 360智脑开源的长思维链推理模型 Light-R1是什么 Light-R1是360智脑开源的AI模型,专注于数学领域的长思维链推理,具体为 Light-R1-32B。模型基于Qwen2.5-32B-Instruct,用7万条数学数据和... Ai项目 12个月前05,2900
SpatialVLA – 上海 AI Lab 联合上科大等推出的空间具身通用操作模型 SpatialVLA是什么 SpatialVLA 是上海 AI Lab、中国电信人工智能研究院和上海科技大学等机构共同推出的新型空间具身通用操作模型,基于百万真实数据预训练,为机器人赋予通用的3D空间... Ai项目 12个月前04,4600
TheoremExplainAgent – AI教学双智能体,数理化定理自动转动画 TheoremExplainAgent是什么 TheoremExplainAgent(TEA)是滑铁卢大学、Votee AI等机构开源的多模态代理系统,基于生成长篇动画视频帮助人们更好地理解数学和科学... Ai项目 12个月前05,1300