ai框架


MTVCrafter:中科院开源的4D运动建模数字人动画生成框架
MTVCrafter是由中国科学院深圳先进技术研究院Yanbo Ding团队开发的开源4D运动建模框架,其革命性在于首次实现从原始3D动作序列(SMPL参数)直接生成开放世界人像动画,彻底摆...
2025-05-27 新闻资讯
869

Pocket Flow:100行代码构建的开源极简大语言模型(LLM)框架
PocketFlow是由The-Pocket团队开发的开源极简大型语言模型(LLM)框架,其核心代码仅用100行Python实现,却完整支持多智能体协作、工作流编排和检索增强生成(RAG)等复杂功能...
2025-05-26 新闻资讯
709

3DTown:单图生成高保真3D城镇的免训练AI框架
3DTown是由加州大学圣克鲁兹分校、哥伦比亚大学与Cybever AI联合开发的开源AI框架,专注于从单张俯视图生成高质量、连贯的3D城镇场景。其核心突破在于免训练(training-free)...
2025-05-26 新闻资讯
899

Graphiti:为AI智能体打造的实时动态知识图谱框架
Graphiti是由Zep团队开发的开源知识图谱框架(Apache-2.0协议),专为动态环境下的AI智能体设计。与传统的检索增强生成(RAG)技术不同,Graphiti通过双时态数据模型和混合检...
2025-05-23 新闻资讯
1195

X-Dancer:基于Transformer-Diffusion框架的音乐驱动高保真舞蹈视频生成系统
X-Dancer是一个端到端的音乐驱动人像动画框架,其技术核心在于解耦姿态生成与视频渲染的双阶段处理流程。与传统3D动作生成方法不同,该系统首创性地将2D人体姿态建模与扩散模...
2025-05-21 新闻资讯
820

MagicTailor:基于动态掩码退化与双流平衡的组件可控图像个性化框架
MagicTailor是一个基于扩散模型的组件可控个性化框架,其技术核心在于解耦概念学习与组件编辑。与传统个性化方法不同,该系统允许用户通过参考图像定义目标概念(如人物),同...
2025-05-21 新闻资讯
779

NLWeb:基于MCP协议的网站自然语言交互标准化框架
NLWeb是一个开放协议与工具集的组合,其核心使命是降低网站部署自然语言交互的门槛。与传统需要复杂开发的对话系统不同,NLWeb通过标准化接口和语义数据映射,使开发者能够快...
2025-05-21 新闻资讯
958

WorldPM:基于1500万自然偏好数据的大规模对齐模型框架
WorldPM是一个基于Transformer架构的大规模偏好建模框架,其技术核心在于通过自然偏好信号挖掘与多粒度评估体系构建端到端的对齐解决方案。与传统RLHF(基于人类反馈的强化学...
2025-05-20 新闻资讯
1113

Index-AniSora:基于时空掩码机制的动画视频生成全链路系统
Index-AniSora是一个基于扩散Transformer(DiT)架构的动画视频生成框架,其技术核心在于通过时空掩码机制实现多任务统一的生成控制。与传统视频生成系统不同,该系统专门针对...
2025-05-20 新闻资讯
1065

Steamer-I2V:百度开源的多模态条件控制图像到视频生成框架
Steamer-I2V是一个基于扩散模型的图像到视频生成框架,其技术核心在于通过多模态条件输入(包括图像、文本和引导信号)实现像素级精确的视频合成。与传统的端到端生成方法不同...
2025-05-20 新闻资讯
1228

CustomSvg:基于两级分离架构的样式可控SVG生成框架
CustomSvg是一个基于深度学习的两阶段SVG生成与编辑框架,其技术核心在于将传统T2V流程拆解为内容建模与样式迁移两个独立可控的阶段。与直接生成SVG的端到端方法不同,该系统...
2025-05-20 新闻资讯
872

SketchVideo:基于扩散模型的草图驱动视频生成与编辑框架
SketchVideo是一个基于扩散模型的草图驱动视频生成与编辑框架,其核心技术价值在于将稀疏草图控制与稠密视频生成这两个看似矛盾的需求完美统一。该系统允许用户通过1-2帧手绘...
2025-05-20 新闻资讯
820

Sketch2Anim:基于多条件控制的2D分镜转3D动画生成框架
Sketch2Anim是一个基于深度学习框架的2D分镜到3D动画自动转换系统,其名称源自"Sketch to Animation"的技术目标缩写。与传统的动画制作流程不同,该系统能够直接解析艺术家绘...
2025-05-19 新闻资讯
1044

DICE-Talk:基于身份-情感解耦的智能说话人视频生成框架
DICE-Talk(Disentangle Identity, Cooperate Emotion)是一个基于扩散模型的情感化说话人视频生成框架,其名称准确概括了该技术的两大核心特点:身份解耦与情感协同。与传统...
2025-05-19 新闻资讯
820

ShotAdapter:基于扩散模型的文本生成多镜头视频框架
ShotAdapter是一个基于扩散模型(Diffusion Models)的文本到多镜头视频生成框架,它能够将预训练的单镜头文本到视频(T2V)扩散模型通过轻量级微调转化为多镜头视频(T2MSV)...
2025-05-19 新闻资讯
664