开源项目
GPT-OSS(Open-Source Series)是OpenAI发布的两款开源大型语言模型系列,包括GPT-OSS-120B和GPT-OSS-20B两个版本。这是OpenAI自2019年发布GPT-2以来,时隔6年首次回归开源阵...
2025-08-07
新闻资讯
992
KittenTTS 是由KittenML团队开发的一款轻量级开源文本转语音(Text-to-Speech, TTS)引擎,其核心定位是提供高效、低资源消耗的语音合成解决方案。主打“小巧精悍”的特点,模...
2025-08-07
新闻资讯
1933
Chunkr 是由 Lumina AI 公司开发并开源的一款文档智能处理工具,专为将复杂文档转换为适合 RAG(检索增强生成)和 LLM(大语言模型)处理的结构化数据而设计,Chunkr 能够对 ...
2025-08-07
新闻资讯
798
MixGRPO 是腾讯混元团队开源的一项突破性的图像生成框架,通过融合随机微分方程(SDE)与常微分方程(ODE)的混合采样策略,在文本到图像(Text-to-Image, T2I)生成任务中实...
2025-08-06
新闻资讯
851
Qwen-Image 是阿里巴巴通义千问团队开源的首个图像生成基础模型,属于Qwen系列的重要成员。作为一个200亿参数的多模态扩散变换器(MMDiT)模型,它在复杂文本渲染和精确图像编...
2025-08-06
新闻资讯
1031
XBai-o4 是由国内AI厂商"问小白"推出的第四代开源大语言模型,其核心创新在于引入了独创的"反思型生成范式"(Reflective Generative Form)架构,通过深度融合Long-CoT强化学习...
2025-08-05
新闻资讯
1094
MiDashengLM 是小米集团旗下"MiLM Plus"团队于2025年8月4日正式发布并全量开源的声音理解大模型,该模型以Xiaomi Dasheng音频编码器为核心,结合Qwen2.5-Omni-7B Thinker自回...
2025-08-05
新闻资讯
1093
Windows-MCP 是一个开源的轻量级MCP服务器项目,旨在实现人工智能代理(如大型语言模型)与Windows操作系统之间的无缝集成。作为模型上下文协议(Model Context Protocol, MCP)的...
2025-08-05
新闻资讯
890
InteriorGS是由群核科技(SpatialVerse)研发的高质量3D高斯语义数据集,其核心在于将3D高斯溅射(3D Gaussian Splatting, 3DGS)技术与语义理解深度融合,构建了一个既包含几何细...
2025-08-04
新闻资讯
768
WrenAI是由Canner团队开发的开源AI代理项目(AGPL-3.0许可证),旨在通过自然语言处理(NLP)技术实现“文本到SQL”的自动化转换,并扩展至数据可视化、报表生成等全流程分析...
2025-08-04
新闻资讯
793
dots.ocr 是由小红书hi lab团队开发并开源的一款基于视觉语言模型(VLM)的多语言文档解析工具,它通过统一的模型架构实现了文档布局检测与内容识别的一体化处理。
2025-08-02
新闻资讯
2033
ARC-Hunyuan-Video-7B 是腾讯ARC实验室于2025年7月开源的多模态大模型,专注于现实世界短视频的结构化理解与生成。该模型以端到端方式融合视觉、音频和文本信号,具备多粒度时...
2025-08-01
新闻资讯
922
Skywork UniPic 是昆仑万维开源的一款多模态统一预训练模型,它采用自回归范式,在单一模型中实现了图像理解、文本到图像生成和图像编辑三大核心能力的深度融合。与传统的多模...
2025-07-31
新闻资讯
748
HYPIR(High-Performance Image Restoration)是由中国科学院深圳先进技术研究院董超研究员团队开发的图像复原大模型,该项目通过创新的技术路线,解决了传统图像复原领域长期...
2025-07-31
新闻资讯
1753
OpenCode是一款面向终端环境的开源AI编程助手,由SST团队主导开发,前身是Charm公司收购的"OpenCode"项目。该项目在开发者社区中具有独特地位,其诞生源于一次"开源精神"与"商...
2025-07-30
新闻资讯
2342













