ai模型
HiDream-I1 是一款由 HiDream.ai 推出的开源图像生成模型,它凭借 170 亿参数规模,在图像生成领域达到了前所未有的新高度,能够在短短几秒内生成高质量的图像。这一模型的出...
2025-04-20
新闻资讯
702
LHM(Large Animatable Human Reconstruction Model)是由aigc3d团队开发的一个开源项目,旨在通过单一图像在几秒钟内生成可动画的3D人类重建模型。该项目基于PyTorch实现,提...
2025-04-17
新闻资讯
848
“交交”是由上海交通大学听觉认知与计算声学实验室研发的全球首个纯学术界自研的口语对话情感大模型。它不仅是一个智能语音助手,更是一个支持多人实时对话、多语言交互、情...
2025-04-16
新闻资讯
1030
Second Me是心识宇宙(Mindverse)团队倾力打造的开源AI项目,它不仅仅是一个AI助手,而是一个全新的AI分身模型。该项目旨在让用户能够创建、训练和个性化自己的AI自我,这一...
2025-04-14
新闻资讯
1591
MegaTTS3是由字节跳动(Bytedance)开发并开源的一个高质量语音合成(TTS)模型,基于PyTorch实现。该项目旨在通过创新的Diffusion Transformer架构和WaveVAE声码器,提供轻量...
2025-04-04
新闻资讯
1158
CSM(Conversational Speech Model),一个来自Sesame AI实验室的语音生成模型,正在重新定义语音合成的边界。它不仅能从文本生成自然流畅的语音,还能根据上下文生成多轮对话...
2025-04-02
新闻资讯
927
TryOffAnyone是一个基于人工智能技术的开源AI模型,它的核心功能是“一键去除衣服”。它的原理是通过AI技术,从一张穿着衣服的人的照片中,把衣服“脱掉”,并生成一个独立...
2025-04-02
新闻资讯
3340
AnyText 是一种基于扩散模型的多语言视觉文本生成与编辑框架,由阿里巴巴集团智能计算研究所的研究团队开发。它旨在解决当前文本到图像生成模型在文本区域模糊、不可读或错误...
2025-04-01
新闻资讯
1066
YuE 是一个由香港科技大学(HKUST)和多模态艺术投影(M-A-P)团队共同开发的开源 AI 音乐生成基础模型。它的名字在中文中意为“音乐”和“快乐”,寓意着通过技术让音乐创作...
2025-03-31
新闻资讯
1279
谷歌宣布其最新的人工智能旗舰模型 ——Gemini2.5Pro将免费向所有 Gemini 应用用户开放。这一消息意味着,早前仅限于付费.99美元每月的 Gemini Advanced 用户才能体验的高端功...
2025-03-31
新闻资讯
627
AccVideo是由北京航空航天大学、上海人工智能实验室和香港大学联合研发的一项技术,旨在通过合成数据集加速视频扩散模型的推理过程。AccVideo的核心思想是利用预训练的视频扩...
2025-03-27
新闻资讯
740
Pruna是一个专为开发者打造的模型优化框架,旨在通过一系列压缩算法,如缓存、量化、剪枝、蒸馏和编译技术,全面提升模型的综合性能。这些算法能够显著降低模型的大小、提高运...
2025-03-21
新闻资讯
598
近日,Roblox宣布推出并开源Cube3D,这是该公司首个用于生成3D对象的基础AI模型。根据Roblox的新闻稿,Cube3D旨在提高3D创作效率,让开发者能够快速探索创作方向并提升生产力...
2025-03-18
新闻资讯
739
字节跳动直接放出王炸级AI黑科技,一举打破视频创作的最后一道静音魔咒!他们最新推出的SeedFoley音效生成模型,如同为视频注入了声命之魂,只需轻轻一点,就能为你的视频智能...
2025-03-13
新闻资讯
976
R1-Omni是阿里通义团队研发并开源的全模态大语言模型,它采用了强化学习中的RLVR(Reinforcement Learning with Verifiable Reward)训练范式,并结合了GRPO(Generative Rel...
2025-03-12
新闻资讯
707













