排序
语音合成引擎 coqui-ai/TTS 一款经过研发和生产实战检验的深度学习文本转语音工具包
📦 项目开源地址:coqui-ai/TTS ⭐ Stars: 34k+ 🛠️ Python 💡 项目定位:深度学习语音合成(TTS)库,支持多语言、声音克隆以及实时语音生成。 1. 项目基本信息 - 项目名称:coqui-ai/TTS - ...
基于 C++ / Python 的现代化分布式 AI 计算框架 ray 架构深度剖析与全栈实战
📦 项目开源地址:ray ⭐ Stars: 33k+ 🛠️ C++ / Python 💡 项目定位:开源分布式 AI 计算框架,支撑大规模 AI 训练、强化学习、超参数搜索与 Ray Serve 推理服务。 1. 项目基本信息 - 项目名...
Suno bark:基于 PyTorch 的文本到语音生成模型架构深度解析与实战指南
📦 项目开源地址:bark 📸 项目原厂架构与界面演示suno-ai/bark 架构展示图 ⭐ Stars: 34k+ 🛠️ Python / PyTorch 💡 项目定位:Suno 开源的基于 Transformer 的文本到语音/音频生成模型,能逼...
DeepSeek-V2 架构深度剖析:基于 Python / PyTorch 的高性能 MoE 大模型开源实践
📦 项目开源地址:DeepSeek-V2 ⭐ Stars: 15k+ 🛠️ Python / PyTorch 💡 项目定位:深度求索开源的高性能 MoE(混合专家)大模型,以极低的推理成本和顶尖的强推理能力著称。 1. 项目基本信息 ...
阿里云通义千问 Qwen:百亿参数级开源大语言模型的架构解析与全栈实战指南
📦 项目开源地址:Qwen 📸 项目原厂架构与界面演示QwenLM/Qwen 项目展示图QwenLM/Qwen 项目展示图QwenLM/Qwen 项目展示图 ⭐ Stars: 18k+ 🛠️ Python / PyTorch 💡 项目定位:阿里云开源的通义...
全球78k+ Stars的计算机视觉基石:OpenCV 全球顶级的计算机视觉与图像处理基础库
📦 项目开源地址:OpenCV ⭐ Stars: 78k+ 🛠️ C++ / Python 💡 项目定位:全球顶级的计算机视觉与图像处理基础库,涵盖传统视觉算法、计算摄影学及深度学习推理模块。 1. 项目基本信息 OpenCV ...
ChatGLM-6B 架构深度剖析:中英双语对话大模型的开源实践与全栈解析
📦 项目开源地址:ChatGLM-6B 📸 项目原厂架构与界面演示THUDM/ChatGLM-6B 项目展示图THUDM/ChatGLM-6B 项目展示图THUDM/ChatGLM-6B 项目展示图 ⭐ Stars: 39k+ 🛠️ Python / PyTorch 💡 项目...
Fooocus:基于 SDXL 的极简图像生成引擎——架构解析与全栈实战指南
📦 项目开源地址:Fooocus ⭐ Stars: 40k+ 🛠️ Python 💡 项目定位:基于 SDXL 的图像生成工具,结合了 Midjourney 级别的极简交互与 Stable Diffusion 的可控深度。 1. 项目基本信息 - 项目名...
开源系统 llama-index 一款领先的文档代理和 OCR 平台
📦 项目开源地址:llama-index ⭐ Stars: 37k+ 🛠️ Python / TypeScript 💡 项目定位:专注于数据连接与检索增强生成(RAG)的框架,轻松整合私有数据源并接入 LLM。 1. 项目基本信息 - 项目名...
基于 Python / PyTorch 的通用语音识别引擎 whisper 架构深度剖析与全栈实战
📦 项目开源地址:whisper 📸 项目原厂架构与界面演示Approach ⭐ Stars: 68k+ 🛠️ Python / PyTorch 💡 项目定位:OpenAI 开源的通用语音识别(ASR)模型,具备出色的多语言转写、翻译与抗噪...






