新闻资讯


AlphaOne:动态调控大模型推理节奏的智能思考框架
AlphaOne是由伊利诺伊大学厄巴纳-香槟分校与加州大学伯克利分校联合研发的创新性推理控制框架,其核心突破在于通过参数化动态调控技术,解决了大型语言模型在"快速直觉反应"与...
2025-06-12 新闻资讯
784

Seedance:字节跳动推出的多镜头叙事与影视级动态视频生成大模型
Seedance是字节跳动旗下火山引擎团队研发的新一代视频生成基础模型,作为国内首个具备原生多镜头叙事能力的AI视频生成系统,该项目突破性地解决了传统视频生成模型在镜头切换...
2025-06-12 新闻资讯
1231

Vui:Fluxions-AI开源的轻量级本地化语音对话模型与拟真交互引擎
Vui是Fluxions-AI团队开发的革命性语音交互框架,作为"NotebookLM"风格的轻量级语音模型,它实现了设备端自然对话生成能力,于2025年6月正式开源。该项目突破性地解决了传统语...
2025-06-12 新闻资讯
892

MultiTalk:音频驱动的多人口型同步与交互式视频生成框架
MultiTalk是由中山大学联合美团、香港科技大学研发的突破性视频生成框架,专门解决多人对话场景下的音频-视频同步难题。作为首个支持多音频流精准绑定的开源项目,它实现了从...
2025-06-11 新闻资讯
1199

InftyThink:基于分段推理与总结机制的大模型无限深度推理框架
InftyThink是由浙江大学REAL实验室与北京大学联合研发的创新性大模型推理框架,其核心突破在于通过分段推理与总结机制,解决了传统大模型在长上下文推理中面临的"内存溢出"问...
2025-06-11 新闻资讯
825

MaskSearch:阿里通义实验室推出的通用预训练框架
MaskSearch是阿里通义实验室推出的创新性预训练框架,旨在通过检索增强型掩码预测(Retrieval-Augmented Mask Prediction, RAMP)任务,显著提升语言模型的搜索与推理能力。其核...
2025-06-11 新闻资讯
591

PartCrafter:全球首个支持单图生成可分解3D部件的结构化生成模型
PartCrafter是由卡内基梅隆大学(CMU)与北京大学联合研发的全球首个结构化3D生成模型,其革命性突破在于能够从单张RGB图像直接生成可分解的3D部件,而非传统的整体3D模型。与传...
2025-06-11 新闻资讯
1118

ContentV:字节跳动开源的一款高效文本到视频生成模型
ContentV是字节跳动研发的一款高效文本到视频生成模型,其核心创新在于通过极简架构改造和流匹配训练策略,实现了在有限计算资源下训练80亿参数大模型的目标。该项目针对当前...
2025-06-11 新闻资讯
945

苹果正式发布iOS26:液态玻璃设计引领视觉革命,三款旧机型止步更新
北京时间2025年6月10日凌晨,苹果在全球开发者大会(WWDC25)上正式发布iOS26操作系统,这是自iOS7以来最大规模的界面革新。新系统以“液态玻璃(Liquid Glass)”为核心设计...
2025-06-10 新闻资讯
1865

MonkeyOCR:华中科技大学与金山办公联合开源的轻量级文档解析大模型
MonkeyOCR是由华中科技大学VLR实验室与金山办公联合研发的轻量级文档解析大模型,其核心创新在于采用"结构-识别-关系"(Structure-Recognition-Relation, SRR)三元组范式,将非...
2025-06-10 新闻资讯
1325

Playmate:基于3D隐式空间引导扩散模型的高可控肖像动画生成框架
Playmate是由广州趣丸科技团队提出的一种基于3D隐式空间引导扩散模型的双阶段训练框架,旨在生成高质量且可控的肖像动画视频。该项目通过解耦面部属性(如表情、唇部动作和头...
2025-06-10 新闻资讯
598

Time-R1:伊利诺伊大学开源的时间推理框架
Time-R1是由伊利诺伊大学香槟分校(UIUC)团队开发的开源时间推理框架,旨在赋予中等规模语言模型(3B参数)全面理解、预测和生成时间相关内容的能力。该项目通过创新的三阶段...
2025-06-10 新闻资讯
713