ai框架
Self Forcing是Adobe Research与德克萨斯大学奥斯汀分校联合研发的自回归视频扩散模型训练优化框架,该项目针对自回归视频生成中长期存在的训练-测试分布不匹配问题(Exposur...
2025-06-21
新闻资讯
1021
ZeroSearch是阿里巴巴通义实验室开源的大模型搜索能力强化框架,旨在通过模拟搜索引擎的方式激发大型语言模型(LLM)的搜索能力,而无需依赖真实搜索引擎的API调用。作为当前最...
2025-06-16
新闻资讯
920
SeedVR2是由字节跳动Seed团队与南洋理工大学联合开发的开源视频修复框架,作为当前最具突破性的视频增强技术之一,其核心创新在于通过扩散对抗后训练(Diffusion Adversarial ...
2025-06-14
新闻资讯
855
Next-Frame Diffusion(NFD)是由微软研究院与北京大学联合开发的开源自回归视频生成框架,作为当前最具突破性的实时交互式视频生成技术之一,其核心创新在于通过块状因果注意...
2025-06-14
新闻资讯
837
LLIA(Low Latency Interactive Avatar)是由美团技术团队开发并开源的音频驱动肖像视频生成框架,作为当前最具突破性的实时虚拟形象生成技术之一,其核心创新在于将扩散模型...
2025-06-14
新闻资讯
698
AReaL(Ant Reasoning RL)是蚂蚁技术研究院与清华大学交叉信息研究院联合开发的开源强化学习训练框架,作为全球首个实现全异步训练的推理大模型优化系统,其核心突破在于通过...
2025-06-13
新闻资讯
1359
AlphaOne是由伊利诺伊大学厄巴纳-香槟分校与加州大学伯克利分校联合研发的创新性推理控制框架,其核心突破在于通过参数化动态调控技术,解决了大型语言模型在"快速直觉反应"与...
2025-06-12
新闻资讯
781
Vui是Fluxions-AI团队开发的革命性语音交互框架,作为"NotebookLM"风格的轻量级语音模型,它实现了设备端自然对话生成能力,于2025年6月正式开源。该项目突破性地解决了传统语...
2025-06-12
新闻资讯
891
MultiTalk是由中山大学联合美团、香港科技大学研发的突破性视频生成框架,专门解决多人对话场景下的音频-视频同步难题。作为首个支持多音频流精准绑定的开源项目,它实现了从...
2025-06-11
新闻资讯
1192
InftyThink是由浙江大学REAL实验室与北京大学联合研发的创新性大模型推理框架,其核心突破在于通过分段推理与总结机制,解决了传统大模型在长上下文推理中面临的"内存溢出"问...
2025-06-11
新闻资讯
820
MaskSearch是阿里通义实验室推出的创新性预训练框架,旨在通过检索增强型掩码预测(Retrieval-Augmented Mask Prediction, RAMP)任务,显著提升语言模型的搜索与推理能力。其核...
2025-06-11
新闻资讯
590
Playmate是由广州趣丸科技团队提出的一种基于3D隐式空间引导扩散模型的双阶段训练框架,旨在生成高质量且可控的肖像动画视频。该项目通过解耦面部属性(如表情、唇部动作和头...
2025-06-10
新闻资讯
597
Time-R1是由伊利诺伊大学香槟分校(UIUC)团队开发的开源时间推理框架,旨在赋予中等规模语言模型(3B参数)全面理解、预测和生成时间相关内容的能力。该项目通过创新的三阶段...
2025-06-10
新闻资讯
708
MiniMax-Remover是一款开源的视频目标移除框架,专注于通过AI技术实现视频中指定物体的高效擦除与场景修复。该项目基于扩散模型与噪声控制优化技术,能够在6次采样步骤内完成...
2025-06-10
新闻资讯
1580
UniRig是由清华大学与VAST-AI(Tripo)联合研发的开源自动骨骼绑定框架,旨在通过AI技术彻底革新3D模型动画制作流程。该项目基于大型自回归模型(如GPT架构的Transformer)和...
2025-06-09
新闻资讯
892













