ai模型
EarthMind 是由意大利特伦托大学、德国柏林工业大学、慕尼黑工业大学以及保加利亚INSAIT研究院联合开发的开源多模态大模型项目,专门针对地球观测(Earth Observation, EO)数据...
2025-07-07
新闻资讯
736
MOSS-TTSD 是由上海创智学院、复旦大学和模思智能的OpenMOSS团队联合推出的一个开源的文本到口语对话生成模型,专为多人对话场景设计,能够将完整的对话脚本直接转换为自然流...
2025-07-07
新闻资讯
909
Gemma 是由Google DeepMind主导开发的一系列轻量级开源AI模型,该项目基于谷歌旗舰模型Gemini的技术架构,旨在为开发者、研究人员及企业提供高性能、低部署门槛的AI工具。
2025-07-04
新闻资讯
789
ThinkSound是什么ThinkSound 是阿里巴巴通义实验室开源的一款多模态音频生成与编辑模型,它首次将"思维链"(Chain-of-Thought, CoT)推理机制引入多模态音频生成领域,构建了...
2025-07-02
新闻资讯
976
WorldVLA(World Visual-Language-Action)是阿里巴巴达摩院开发的统一视觉-语言-动作自回归世界模型,它创造性地将两类原本独立发展的AI模型——视觉语言动作(VLA)模型与世界模...
2025-07-01
新闻资讯
1046
OmniGen2是由北京人工智能研究院开发的一款开源统一多模态图像生成模型,代表了当前多模态AI领域的最新技术突破。作为OmniGen系列的第二代产品,它通过创新的双轨制架构设计,...
2025-07-01
新闻资讯
931
4D-LRM(Large Space-Time Reconstruction Model)是由Adobe Research联合密歇根大学、北卡罗来纳大学教堂山分校等机构开发的开源项目,旨在通过人工智能技术实现从稀疏视角输...
2025-06-30
新闻资讯
806
OmniAvatar是由阿里巴巴夸克团队开源的一款音频驱动全身视频生成模型,旨在解决现有虚拟人技术中动作生硬、口型同步精度不足、缺乏全身自然交互等问题。该项目通过结合多层次...
2025-06-26
新闻资讯
1077
LingShu是阿里巴巴达摩院LASA团队开发的一款专注于医疗领域的多模态大语言模型(Multimodal Large Language Model, MLLM),旨在解决医学人工智能领域长期存在的知识覆盖不全...
2025-06-24
新闻资讯
965
Confucius3-Math是由网易有道开源的一款专注于数学教育领域的轻量化大语言模型,是国内首个可在单块消费级GPU上高效运行的开源数学推理模型。作为"子曰"教育大模型系列的第三...
2025-06-24
新闻资讯
906
Cosmos-Predict2是英伟达NVIDIA开源的物理AI世界基础模型(World Foundation Model),作为Cosmos平台的核心组件之一,其革命性突破在于融合扩散模型与自回归架构,实现了从多模...
2025-06-16
新闻资讯
1031
Hunyuan3D-2.1是腾讯混元团队全链路开源的工业级3D生成大模型,作为当前最先进的AI驱动3D内容创作框架,其核心突破在于首次将PBR(基于物理的渲染)材质生成技术与几何-纹理解...
2025-06-16
新闻资讯
1246
HistAgent是由普林斯顿大学AI实验室与复旦大学历史学系联合研发的专业级历史研究AI助手,作为全球首个深度融合历史学研究方法论的人工智能系统,该项目包含两大核心组件:史学...
2025-06-13
新闻资讯
1145
V-JEPA 2(Video Joint Embedding Predictive Architecture 2)是Meta AI研究团队于2025年6月推出的第二代世界模型框架,作为首个基于视频训练的自监督学习系统,它实现了从视...
2025-06-13
新闻资讯
1237
Seedance是字节跳动旗下火山引擎团队研发的新一代视频生成基础模型,作为国内首个具备原生多镜头叙事能力的AI视频生成系统,该项目突破性地解决了传统视频生成模型在镜头切换...
2025-06-12
新闻资讯
1229













