ART – 微软联合清华和北大等推出的多层透明图像生成技术 ART是什么 ART(Anonymous Region Transformer) 是新型的多层透明图像生成技术,能根据全局文本提示和匿名区域布局直接生成多个独立的透明图层(支持 RGBA 格式),图层... Ai项目 12个月前04,7200
NextGenAI – OpenAI 推出的教育联盟,联合15家顶尖大学和机构 NextGenAI是什么 NextGenAI是OpenAI推出的全球性联盟,基于AI技术推动教育和研究的进步。NextGenAI联合包括哈佛大学、麻省理工学院、牛津大学等在内的15所顶尖大学和机构,O... Ai项目 12个月前05,0800
NotaGen – 中央音乐学院联合北航、清华等推出的音乐生成模型 NotaGen是什么 NotaGen 是中央音乐学院、北京航空航天大学、清华大学等机构推出的音乐生成模型,基于模仿大型语言模型(LLM)的训练范式生成高质量的古典乐谱。NotaGen 基于预训练、微调... Ai项目 12个月前05,5300
谛韵DiffRhythm – 西北工业联合港中文推出的端到端音乐生成工具 DiffRhythm是什么 DiffRhythm(中文名称:谛韵) 是西北工业大学与香港中文大学(深圳)联合开发的端到端音乐生成工具,基于潜扩散模型(Latent Diffusion)技术,能快速生成... Ai项目 12个月前05,5450
OmniAlign-V – 上海交大联合上海 AI Lab 等推出的高质量数据集 OmniAlign-V是什么 OmniAlign-V 是上海交通大学、上海AI Lab、南京大学、复旦大学和浙江大学联合推出的专为提升多模态大语言模型(MLLMs)与人类偏好的对齐能力设计的高质量数据... Ai项目 12个月前05,1700
TrendPublish – AI内容发布工具,支持智能总结和自动发布 TrendPublish是什么 TrendPublish 是基于 AI 的趋势发现和内容发布系统。基于多源数据采集,从 Twitter/X、网站等渠道获取信息,用 DeepseekAI、千问等 AI ... Ai项目 12个月前06,3350
Proxy Lite – 开源视觉语言模型,支持自动化网页任务 Proxy Lite是什么 Proxy Lite 是开源的轻量级视觉语言模型(VLM),参数量为3B,支持自动化网页任务。Proxy Lite 能像人类一样操作浏览器,完成网页交互、数据抓取、表单填写... Ai项目 12个月前06,3400
WeGen – 中科大联合上海交大等推出的统一多模态生成模型 WeGen是什么 WeGen 是中国科学技术大学联合上海交通大学、微信团队、中国科学院等机构推出的统一多模态生成模型,基于自然对话实现多样化的视觉生成任务。WeGen结合多模态大语言模型(MLLM)和... Ai项目 12个月前05,0250
DiffBrush – 北邮联合清华等机构推出的图像生成与编辑框架 DiffBrush是什么 DiffBrush是北京邮电大学、清华大学、中国电信人工智能研究所和西北工业大学推出的,无需训练的图像生成与编辑框架,支持用户基于手绘草图直观地控制图像生成。DiffBrus... Ai项目 12个月前06,3450
Liquid – 华中科技、字节、港大联合推出的统一多模态生成框架 Liquid是什么 Liquid是华中科技大学、字节跳动和香港大学联合推出的极简统一多模态生成框架。基于VQGAN将图像编码为离散的视觉token,与文本token共享同一词汇空间,让大型语言模型(L... Ai项目 12个月前06,0900