新闻资讯
Paper2Code是一个开源的自动化机器学习论文代码生成器,该项目由韩国科学技术院和DeepAuto.ai联合研发。其核心功能在于能够“阅读”机器学习领域的学术论文,并自动化地生成与...
2025-04-28
新闻资讯
1036
LiveCC是一个开源的实时视频解说大模型,由字节跳动与新加坡国立大学合作推出。该项目基于Qwen2-VL-7B模型开发,通过大规模流式语音文本学习,实现了视频内容的实时理解与解说...
2025-04-27
新闻资讯
1044
Kimi-Audio是一个由月之暗面(Moonshot AI)开源的高性能语音处理工具包。它集成了语音识别(ASR)、语音合成(TTS)、语音增强、声纹识别等多种语音处理功能,旨在为开发者提...
2025-04-27
新闻资讯
2103
Open Avatar Chat是一个由阿里巴巴开源的轻量化多模态实时数字人对话系统。它旨在通过先进的人工智能技术,实现数字人与用户之间的自然、流畅交互。该项目整合了语音识别、自...
2025-04-27
新闻资讯
1497
Google DeepMind正式发布其最新音乐生成模型Lyria2,标志着人工智能在音乐创作领域的又一重大突破。这一全新模型通过高保真音频生成和专业级音质,为音乐家、制作人和创作者提...
2025-04-26
新闻资讯
762
Kimi-VL是由月之暗面(MoonshotAI)团队开发的一款高效开源的多模态视觉语言模型(Vision-Language Model, VLM)。该模型采用了混合专家(Mixture-of-Experts, MoE)架构,旨在...
2025-04-25
新闻资讯
1186
微信读书MCP服务器(WeRead MCP Server)是一个开源项目,旨在作为微信读书与Claude Desktop等AI客户端之间的桥梁,实现阅读笔记与AI的深度交互。该项目由freestylefly团队开...
2025-04-25
新闻资讯
881
Describe Anything是一个开创性的开源项目,由NVIDIA、UC Berkeley和UCSF等机构的研究人员共同开发。该项目旨在创建一个能够理解和描述图像和视频中特定区域的模型,为用户提...
2025-04-25
新闻资讯
891
Dia是由Nari Labs团队开发的一款开源文本转语音(TTS)模型,该模型以其生成超逼真对话的能力在GitHub等平台上迅速走红。Dia能够直接基于文本生成高度真实的对话语音,不仅能...
2025-04-24
新闻资讯
1014
WriteHERE是一个由Principia AI团队开发的开源写作框架,旨在通过人工智能技术革新长文写作的过程。与传统AI写作工具相比,WriteHERE不仅提供了更高效的写作体验,还通过其独...
2025-04-24
新闻资讯
1164
UFO²是微软发布的一款面向Windows桌面的创新性多Agent操作系统。它旨在通过多模态大语言模型(LLM)驱动的Computer-Using Agent(CUA),实现复杂桌面工作流程的自动化,从而...
2025-04-24
新闻资讯
729
SocioVerse是一个开创性的社会模拟项目,它利用大型语言模型(LLMs)作为智能代理,构建了一个能够高精度模拟真实人类社会行为的数字世界。该项目由复旦大学主导,联合上海创...
2025-04-24
新闻资讯
851













