新闻资讯
FairyGen是一个基于AI技术的自动化动画生成系统,它能够将儿童手绘的角色草图自动转化为风格一致、剧情驱动的卡通动画视频。与传统的动画制作工具不同,FairyGen只需用户提供...
2025-07-01
新闻资讯
698
OmniGen2是由北京人工智能研究院开发的一款开源统一多模态图像生成模型,代表了当前多模态AI领域的最新技术突破。作为OmniGen系列的第二代产品,它通过创新的双轨制架构设计,...
2025-07-01
新闻资讯
939
VLN-R1是由香港大学与上海AI Lab联合提出的视觉语言导航(Vision-Language Navigation, VLN)开源框架,其核心目标是实现智能体通过自然语言指令在复杂环境中完成连续动作的自...
2025-06-30
新闻资讯
983
4D-LRM(Large Space-Time Reconstruction Model)是由Adobe Research联合密歇根大学、北卡罗来纳大学教堂山分校等机构开发的开源项目,旨在通过人工智能技术实现从稀疏视角输...
2025-06-30
新闻资讯
811
Gemini CLI是谷歌开源的一款命令行界面AI编程工具,它将Google Gemini系列大模型的强大能力直接集成到开发者终端环境中。作为基于Gemini 2.5 Pro多模态模型的AI代理框架,Gem...
2025-06-27
新闻资讯
903
Claudia 是一款专为 Anthropic Claude Code 设计的开源图形用户界面(GUI)工具,旨在将原本基于命令行的 Claude Code 操作转化为直观、高效的桌面应用体验。该项目由 Y Comb...
2025-06-27
新闻资讯
1431
DRA-Ctrl(Dimension-Reduction Attack)是一个创新的跨模态图片编辑框架,通过整合视频模型中的视觉、时间、空间和因果等多维度高维特征表示,实现对图片主体的状态预测与精...
2025-06-27
新闻资讯
636
Kwai Keye-VL是快手公司自主研发并开源的一款多模态大语言模型,代表了当前视频理解与复杂推理领域的最前沿技术成果。作为基于Qwen3-8B语言模型构建的多模态系统,Kwai Keye-...
2025-06-27
新闻资讯
1106
FlowDirector是西湖大学AGI实验室开发的一款无需训练的视频编辑框架,它基于"流匹配"(Flow Matching)范式,能够将任意基于流的视频生成模型改造成有效的视频编辑工具,而无需...
2025-06-26
新闻资讯
717
EmbodiedGen是由地平线机器人(Horizon Robotics)联合GigaAI、3D-Robotics、上海交通大学、南开大学等多家顶尖机构推出的开源生成式3D世界引擎,专为具身智能(Embodied AI)...
2025-06-26
新闻资讯
964
OmniAvatar是由阿里巴巴夸克团队开源的一款音频驱动全身视频生成模型,旨在解决现有虚拟人技术中动作生硬、口型同步精度不足、缺乏全身自然交互等问题。该项目通过结合多层次...
2025-06-26
新闻资讯
1084
RAG-Anything是由香港大学数据科学实验室(HKUDS)开发的开源多模态文档处理系统,基于LightRAG框架构建,旨在解决传统检索增强生成(RAG)系统仅能处理文本的局限性。作为一...
2025-06-25
新闻资讯
1130













