开源项目


4D-LRM:首个基于4D高斯重建的开源大规模时空重建模型
4D-LRM(Large Space-Time Reconstruction Model)是由Adobe Research联合密歇根大学、北卡罗来纳大学教堂山分校等机构开发的开源项目,旨在通过人工智能技术实现从稀疏视角输...
2025-06-30 新闻资讯
806

Claudia:开源Anthropic Claude Code图形用户界面工具
Claudia 是一款专为 Anthropic Claude Code 设计的开源图形用户界面(GUI)工具,旨在将原本基于命令行的 Claude Code 操作转化为直观、高效的桌面应用体验。该项目由 Y Comb...
2025-06-27 新闻资讯
1429

DRA-Ctrl:基于深度学习的开源跨模态图片编辑框架
DRA-Ctrl(Dimension-Reduction Attack)是一个创新的跨模态图片编辑框架,通过整合视频模型中的视觉、时间、空间和因果等多维度高维特征表示,实现对图片主体的状态预测与精...
2025-06-27 新闻资讯
628

Kwai Keye-VL:快手技术团队开源的多模态大语言模型
Kwai Keye-VL是快手公司自主研发并开源的一款多模态大语言模型,代表了当前视频理解与复杂推理领域的最前沿技术成果。作为基于Qwen3-8B语言模型构建的多模态系统,Kwai Keye-...
2025-06-27 新闻资讯
1097

FlowDirector:西湖大学AGI实验室开源的一款无需训练的视频编辑框架
FlowDirector是西湖大学AGI实验室开发的一款无需训练的视频编辑框架,它基于"流匹配"(Flow Matching)范式,能够将任意基于流的视频生成模型改造成有效的视频编辑工具,而无需...
2025-06-26 新闻资讯
714

EmbodiedGen:面向具身智能的交互式3D世界生成引擎
EmbodiedGen是由地平线机器人(Horizon Robotics)联合GigaAI、3D-Robotics、上海交通大学、南开大学等多家顶尖机构推出的开源生成式3D世界引擎,专为具身智能(Embodied AI)...
2025-06-26 新闻资讯
953

OmniAvatar:阿里巴巴开源的一款音频驱动全身视频生成模型
OmniAvatar是由阿里巴巴夸克团队开源的一款音频驱动全身视频生成模型,旨在解决现有虚拟人技术中动作生硬、口型同步精度不足、缺乏全身自然交互等问题。该项目通过结合多层次...
2025-06-26 新闻资讯
1077

RAG-Anything:香港大学开源的多模态文档处理系统
RAG-Anything是由香港大学数据科学实验室(HKUDS)开发的开源多模态文档处理系统,基于LightRAG框架构建,旨在解决传统检索增强生成(RAG)系统仅能处理文本的局限性。作为一...
2025-06-25 新闻资讯
1123

Dive3D:北京大学与小红书联合开源的多样化文本到3D生成框架
Dive3D是由北京大学与小红书(Xiaohongshu Inc.)联合研发的开源项目,旨在通过双引擎驱动框架(扩散蒸馏与奖励引导优化)实现高质量、多样化的文本到3D内容生成。该项目于20...
2025-06-24 新闻资讯
853

Confucius3-Math:网易有道开源的低成本高性能数学推理模型
Confucius3-Math是由网易有道开源的一款专注于数学教育领域的轻量化大语言模型,是国内首个可在单块消费级GPU上高效运行的开源数学推理模型。作为"子曰"教育大模型系列的第三...
2025-06-24 新闻资讯
906

PosterCraft:基于统一框架的高质量美学海报生成AI系统
PosterCraft是由香港科技大学(广州)、美团和新加坡国立大学等顶尖学术与工业界机构联合研发的开源项目,它是一个革命性的AI海报生成统一框架,旨在通过端到端的方式解决传统...
2025-06-24 新闻资讯
727

Sparc3D:开源的高精度单图生成3D模型框架
Sparc3D是由Stability AI与伊利诺伊大学香槟分校联合推出的先进单图生成3D模型方法,它能够从单张2D图像中高效重建出高质量的3D对象。作为3D高精度建模领域的新兴技术,Sparc...
2025-06-23 新闻资讯
1468

SurveyForge:基于双数据库与学者导航代理的自动化学术综述生成框架
SurveyForge是由上海人工智能实验室联合复旦大学、上海交通大学等多家单位开发的自动化学术综述生成框架,旨在解决传统人工撰写综述效率低下与现有AI生成方法质量不足的双重挑...
2025-06-23 新闻资讯
916

EX-4D:字节跳动开源的单目到自由视角4D视频生成框架
EX-4D是由字节跳动旗下PICO-MR团队开发的突破性4D视频生成技术,它能够从任意单目(单视角)视频生成对应新视角的高质量视频序列,实现了从2D到4D(3D空间+时间维度)的跨越式...
2025-06-23 新闻资讯
996

LinGen:基于Mamba机制的线性复杂度高清长视频生成框架
LinGen是由普林斯顿大学与Meta联合推出的开源视频生成框架,旨在解决当前视频生成模型计算成本高、效率低下的核心问题。该项目通过创新的MATE(Mamba-Attention混合)架构,将...
2025-06-23 新闻资讯
759