AI Open Source

Curated global open-source AI projects. Unlock new paths for technical exploration and practical implementation.

slime — GLM 系列模型背后的开源 RL 后训练框架 slime — GLM 系列模型背后的开源 RL 后训练框架 slime 是智谱 THUDM 团队开发的开源 LLM 强化学习后训练框架,驱动 GLM-4.5 至 GLM-5.2 系列模型训练。连接 Megatron 与 SGLang,支持 Agentic RL。 Sand.ai Magi-1 — 全球首个开源自回归视频生成大模型 Sand.ai Magi-1 — 全球首个开源自回归视频生成大模型 Sand.ai 的 Magi-1 是世界首个大规模自回归视频生成模型,240 亿参数、400 万 token 上下文,图像转视频表现优异,完全开源可商用。 Caveman — 节省 65% Token 的 AI 编程代理优化工具栈 Caveman — 节省 65% Token 的 AI 编程代理优化工具栈 Caveman 是一个开源 AI 编程代理工具栈,核心原理是让 AI 输出像原始人一样简洁(why use many token when few token do trick),平均节省约 65% 输出 Token。支持 Claude Code、Cursor、Windsurf、Cline 等 30+ 编程 Agent,GitHub 74k+ Stars。 LangBot - AI 应用落地设施 LangBot - AI 应用落地设施 LangBot 是开源的多租户即时通讯 AI 机器人平台。支持 QQ、微信、飞书、钉钉等主流平台,让 AI 触达任何场景。 OmniRoute — Free AI Gateway for Multi-Provider LLMs OmniRoute — Free AI Gateway for Multi-Provider LLMs Free, open-source AI router with auto-fallback. 236 providers, one endpoint, 95 MCP tools, 17 routing strategies, A2A protocol, auto-combo engine, semantic cache, memory & skills. Deploy anywhere. Agent-Native — Agent-Native Apps Framework Agent-Native — Agent-Native Apps Framework Build agentic apps where AI agents and UI share the same database and state. Open source framework with ready-to-fork templates. AI Proxy AI Proxy 高性能AI网关,支持OpenAI/Claude/Gemini协议,具备智能错误处理、多通道管理、监控、多模型、限流及多租户隔离功能。 FunASR - End-to-End Speech Recognition Toolkit - 高效语音识别 FunASR - End-to-End Speech Recognition Toolkit - 高效语音识别 FunASR: Industrial-grade speech recognition toolkit. 170x realtime on GPU, 50+ languages, speaker diarization, emotion detection, OpenAI-compatible API, vLLM acceleration, and agent integration. Agent Skills | Tech Leads Club - 精选技能 Agent Skills | Tech Leads Club - 精选技能 为AI编程代理精选的可复用技能合集,扩展Cursor、Claude Code、GitHub Copilot、Windsurf等工具。 Warp Warp NVIDIA 高性能图形与仿真框架 The Agent Skills Directory The Agent Skills Directory The Agent Skills Directory - 汇集Microsoft、GitHub等优质AI Agent技能,提供技能排行榜和搜索功能,帮助用户快速找到并使用各种实用技能。 LongCat-Video LongCat-Video LongCat-Video 是美团“长猫团队”推出的 13.6B 参数基础视频生成模型,支持文本生成视频(Text-to-Video)、图像生成视频(Image-to-Video)和视频续写(Video Continuation)三大任务。该模型原生支持分钟级长视频生成,且在生成过程中无色彩漂移或画质下降问题。其采用粗到精(coarse-to-fine)的时空生成策略和块稀疏注意力机制,兼顾生成质量与推理效率,适用于对长视频生成有高要求的研究者与开发者。 PyTorch - Foundation PyTorch - Foundation PyTorch Foundation 是开源 PyTorch 框架及生态系统的深度学习社区中心。 DeepSpeed DeepSpeed DeepSpeed 是一个深度学习优化库,可实现高效便捷的分布式训练。 Unsloth AI Unsloth AI Unsloth 是一个用于 LLM 微调和强化学习的开源框架,可帮助用户高效训练自有模型。 vLLM - Efficient LLM Serving vLLM - Efficient LLM Serving vLLM 是一个专为大型语言模型设计的高吞吐量和内存高效推理与服务引擎。 SGLang SGLang SGLang官方文档提供框架使用指南和API参考,帮助开发者高效构建语言模型应用。 TensorRT-LLM TensorRT-LLM TensorRT-LLM 是 NVIDIA 推出的高性能深度学习推理库,专为大语言模型优化,提供详细的文档和开发指南。 OpenVINO OpenVINO OpenVINO Toolkit 是英特尔推出的用于优化和部署 AI 推理的开发工具,可提升计算机视觉、语音识别和自然语言处理等深度学习应用的性能。 RamaLama RamaLama RamaLama是一个基于人工智能技术的创新平台,致力于提供智能化的解决方案和服务。
滚动至顶部