新闻资讯


Claude 4:Anthropic公司推出的最新AI编程模型
作为Anthropic公司迄今为止最强大的AI模型系列,Claude 4包含两个核心版本:旗舰级的Claude Opus 4和高效平衡的Claude Sonnet 4。这一代模型在编码能力、复杂任务处理和智能体...
2025-05-26 新闻资讯
806

Pocket Flow:100行代码构建的开源极简大语言模型(LLM)框架
PocketFlow是由The-Pocket团队开发的开源极简大型语言模型(LLM)框架,其核心代码仅用100行Python实现,却完整支持多智能体协作、工作流编排和检索增强生成(RAG)等复杂功能...
2025-05-26 新闻资讯
713

3DTown:单图生成高保真3D城镇的免训练AI框架
3DTown是由加州大学圣克鲁兹分校、哥伦比亚大学与Cybever AI联合开发的开源AI框架,专注于从单张俯视图生成高质量、连贯的3D城镇场景。其核心突破在于免训练(training-free)...
2025-05-26 新闻资讯
902

Graphiti:为AI智能体打造的实时动态知识图谱框架
Graphiti是由Zep团队开发的开源知识图谱框架(Apache-2.0协议),专为动态环境下的AI智能体设计。与传统的检索增强生成(RAG)技术不同,Graphiti通过双时态数据模型和混合检...
2025-05-23 新闻资讯
1201

MMaDA:普林斯顿与北大联合开源的多模态统一扩散架构大模型
MMaDA(Multimodal Model with Diffusion Architecture)是由普林斯顿大学、北京大学和字节跳动联合研发的一款多模态大模型,它采用创新的统一扩散架构,实现了文本与图像等多...
2025-05-23 新闻资讯
753

MoviiGen1.1:基于Wan2.1微调的开源电影级视频生成模型
MoviiGen1.1是由ZulutionAI团队开发的开源视频生成模型,基于Wan2.1框架微调而成,专注于电影级视觉质量的输出。该模型通过11位专业电影制作人和AIGC创作者的60项美学维度评估...
2025-05-23 新闻资讯
1000

Pixel3DMM:基于DINO ViT的单图像3D人脸重建系统,几何精度超越基线15%
由慕尼黑工业大学、Synthesia公司和伦敦大学学院联合发布的Pixel3DMM项目,通过创新的"屏幕空间先验"技术,将这一领域的性能边界推向新高度。该项目基于DINOv2视觉Transforme...
2025-05-22 新闻资讯
976

AutoBE:AI驱动的后端服务器代码生成引擎
AutoBE是一个AI驱动的全栈后端代码生成系统,其核心使命是消除业务需求与工程实现之间的鸿沟。与传统低代码平台不同,AutoBE基于独特的"瀑布-螺旋混合模型",通过持续集成编译...
2025-05-22 新闻资讯
869

BAGEL:字节跳动开源的多模态基础大模型,统一理解与生成的下一代AI架构
BAGEL是字节跳动Seed团队开发的统一多模态基础大模型,其核心定位是成为首个真正实现理解与生成一体化的开源多模态架构。与传统的单一模态模型或仅支持理解或生成其中一种功能...
2025-05-22 新闻资讯
1766

X-Dancer:基于Transformer-Diffusion框架的音乐驱动高保真舞蹈视频生成系统
X-Dancer是一个端到端的音乐驱动人像动画框架,其技术核心在于解耦姿态生成与视频渲染的双阶段处理流程。与传统3D动作生成方法不同,该系统首创性地将2D人体姿态建模与扩散模...
2025-05-21 新闻资讯
822

MagicTailor:基于动态掩码退化与双流平衡的组件可控图像个性化框架
MagicTailor是一个基于扩散模型的组件可控个性化框架,其技术核心在于解耦概念学习与组件编辑。与传统个性化方法不同,该系统允许用户通过参考图像定义目标概念(如人物),同...
2025-05-21 新闻资讯
789

NLWeb:基于MCP协议的网站自然语言交互标准化框架
NLWeb是一个开放协议与工具集的组合,其核心使命是降低网站部署自然语言交互的门槛。与传统需要复杂开发的对话系统不同,NLWeb通过标准化接口和语义数据映射,使开发者能够快...
2025-05-21 新闻资讯
960