CosyVoice 2.0 – 阿里开源的语音生成大模型 CosyVoice 2.0是什么 CosyVoice 2.0 是阿里巴巴通义实验室推出的CosyVoice语音生成大模型升级版,模型用有限标量量化技术提高码本利用率,简化文本-语音语言模型架构,推出块... Ai项目 2周前7,5150
SnapGen – Snap联合港科大等机构推出的移动端文生图模型 SnapGen是什么 SnapGen是Snap Inc、香港科技大学、墨尔本大学等机构联合推出的文本到图像(T2I)扩散模型,能在移动设备上快速生成高分辨率(1024×1024像素)的图像... Ai项目 2周前6,7750
Freestyler – 西工大联合微软和香港大学推出的说唱乐生成模型 Freestyler是什么 Freestyler是西北工业大学计算机科学学院音频、语音与语言处理小组(ASLP@NPU)、微软及香港中文大学深圳研究院大数据研究所共同推出的说唱乐生成模型,能直接根据歌... Ai项目 2周前5,2950
FreeScale – 无需微调的推理框架,提升扩散模型生成能力首次实现8K分辨率图像 FreeScale是什么 FreeScale是南洋理工大学、阿里巴巴集团和复旦大学推出无需微调的推理框架,提升预训练扩散模型生成高分辨率图像和视频的能力。FreeScale基于处理和融合不同尺度的信息... Ai项目 2周前5,0500
k1 视觉思考模型 – kimi推出的 k1 系列强化学习模型 k1 视觉思考模型是什么 k1 视觉思考模型是kimi推出的k1系列强化学习AI模型,原生支持端到端图像理解和思维链技术,将能力扩展到数学之外的更多基础科学领域。k1模型在图像理解、数学、物理、化学等... Ai项目 2周前5,1300
POINTS 1.5 – 腾讯微信推出的多模态大模型 POINTS 1.5是什么 POINTS 1.5 是腾讯微信发布的多模态大模型,是POINTS 1.0的升级版本。 模型继续沿用了POINTS 1.0中的LLaVA架构,由一个视觉编码器、一个投影器和... Ai项目 2周前4,6400
360gpt2-o1 – 360 推出国产自研 AI 大模型,多项评测优于GPT-4o 360gpt2-o1是什么 360gpt2-o1是 360 自研的 AI 大模型,在推理能力上有显著提升,特别是在数学和逻辑推理任务上表现出色。模型通过合成数据优化、模型后训练和“慢思考”范式实现了技... Ai项目 2周前5,7650
Step-1o Audio – 阶跃星辰推出的国内首个千亿参数端到端语音大模型 Step-1o Audio是什么 Step-1o Audio是阶跃星辰推出的国内首个千亿参数端到端语音大模型。具备强大的情绪感知能力,能精准识别用户语气中的情感,结合语境做出贴心回应。如,在用户分享喜... Ai项目 2周前5,8450
Meta Motivo – Meta 推出控制数字智能体动作的人工智能模型 Meta Motivo是什么 Meta Motivo 是 Meta 公司推出的AI模型,能提升元宇宙体验的真实性。Meta Motivo基于控制虚拟人形智能体的全身动作,模拟人类行为,增强用户互动。模... Ai项目 2周前4,6850
SVDQuant – MIT 推出的扩散模型后训练量化技术 SVDQuant是什么 SVDQuant是MIT研究团队推出的后训练量化技术,针对扩散模型,将模型的权重和激活值量化至4位,减少内存占用加速推理过程。SVDQuant引入高精度的低秩分支吸收量化过程中... Ai项目 2周前5,4050