开源项目
4D-LRM(Large Space-Time Reconstruction Model)是由Adobe Research联合密歇根大学、北卡罗来纳大学教堂山分校等机构开发的开源项目,旨在通过人工智能技术实现从稀疏视角输...
2025-06-30
新闻资讯
806
Claudia 是一款专为 Anthropic Claude Code 设计的开源图形用户界面(GUI)工具,旨在将原本基于命令行的 Claude Code 操作转化为直观、高效的桌面应用体验。该项目由 Y Comb...
2025-06-27
新闻资讯
1429
DRA-Ctrl(Dimension-Reduction Attack)是一个创新的跨模态图片编辑框架,通过整合视频模型中的视觉、时间、空间和因果等多维度高维特征表示,实现对图片主体的状态预测与精...
2025-06-27
新闻资讯
628
Kwai Keye-VL是快手公司自主研发并开源的一款多模态大语言模型,代表了当前视频理解与复杂推理领域的最前沿技术成果。作为基于Qwen3-8B语言模型构建的多模态系统,Kwai Keye-...
2025-06-27
新闻资讯
1097
FlowDirector是西湖大学AGI实验室开发的一款无需训练的视频编辑框架,它基于"流匹配"(Flow Matching)范式,能够将任意基于流的视频生成模型改造成有效的视频编辑工具,而无需...
2025-06-26
新闻资讯
714
EmbodiedGen是由地平线机器人(Horizon Robotics)联合GigaAI、3D-Robotics、上海交通大学、南开大学等多家顶尖机构推出的开源生成式3D世界引擎,专为具身智能(Embodied AI)...
2025-06-26
新闻资讯
953
OmniAvatar是由阿里巴巴夸克团队开源的一款音频驱动全身视频生成模型,旨在解决现有虚拟人技术中动作生硬、口型同步精度不足、缺乏全身自然交互等问题。该项目通过结合多层次...
2025-06-26
新闻资讯
1077
RAG-Anything是由香港大学数据科学实验室(HKUDS)开发的开源多模态文档处理系统,基于LightRAG框架构建,旨在解决传统检索增强生成(RAG)系统仅能处理文本的局限性。作为一...
2025-06-25
新闻资讯
1123
Dive3D是由北京大学与小红书(Xiaohongshu Inc.)联合研发的开源项目,旨在通过双引擎驱动框架(扩散蒸馏与奖励引导优化)实现高质量、多样化的文本到3D内容生成。该项目于20...
2025-06-24
新闻资讯
853
Confucius3-Math是由网易有道开源的一款专注于数学教育领域的轻量化大语言模型,是国内首个可在单块消费级GPU上高效运行的开源数学推理模型。作为"子曰"教育大模型系列的第三...
2025-06-24
新闻资讯
906
PosterCraft是由香港科技大学(广州)、美团和新加坡国立大学等顶尖学术与工业界机构联合研发的开源项目,它是一个革命性的AI海报生成统一框架,旨在通过端到端的方式解决传统...
2025-06-24
新闻资讯
727
Sparc3D是由Stability AI与伊利诺伊大学香槟分校联合推出的先进单图生成3D模型方法,它能够从单张2D图像中高效重建出高质量的3D对象。作为3D高精度建模领域的新兴技术,Sparc...
2025-06-23
新闻资讯
1468
SurveyForge是由上海人工智能实验室联合复旦大学、上海交通大学等多家单位开发的自动化学术综述生成框架,旨在解决传统人工撰写综述效率低下与现有AI生成方法质量不足的双重挑...
2025-06-23
新闻资讯
916
EX-4D是由字节跳动旗下PICO-MR团队开发的突破性4D视频生成技术,它能够从任意单目(单视角)视频生成对应新视角的高质量视频序列,实现了从2D到4D(3D空间+时间维度)的跨越式...
2025-06-23
新闻资讯
996
LinGen是由普林斯顿大学与Meta联合推出的开源视频生成框架,旨在解决当前视频生成模型计算成本高、效率低下的核心问题。该项目通过创新的MATE(Mamba-Attention混合)架构,将...
2025-06-23
新闻资讯
759













