Meta推出的开源大语言模型,社区生态活跃模型丰富,全球开发者广泛使用,可本地部署
开源模型
浏览 开源模型 分类下的所有 AI 工具
阿里通义千问开源版本,中文和代码能力优秀,支持多尺寸模型选择,可本地部署和商用
OpenAI开源的语音识别模型,支持多语言高精度转录,可本地部署,开发者语音处理首选
Moonshot AI 发布的 2.8 万亿参数开源前沿模型,Stable LatentMoE 架构(896 个专家激活 16 个),100 万 token 上下文与原生视觉能力,权重预告 2026-07-27 开放但截至当日未放出
欧洲Mistral AI推出的开源模型,性能强劲媲美更大参数模型,商业友好的开源AI选择
清华大学和智谱AI推出的开源对话模型,中文对话能力优秀,支持本地部署和商用
美团开源 1.6T 参数 MoE 旗舰,原生 1M 上下文,MIT 协议,Agentic Coding 取向
SandAI 开源视频生成模型预览版
Datawhale × RadixArk 官方 SGLang 系统化教程《从零手搓SGLang》:先讲透 KV Cache、prefill/decode、compute-bound vs memory-bound,再从 0 手搓 mini-sglang(Continuous Batching、Paged KV Cache、RadixAttention),最后吃透真实 SGLang 源码并带你提第一个 PR。中英双语,在线阅读免费。
DeepSeek-V4-Flash 在 AMD MI300X 上的部署方案
零一万物推出的开源大语言模型,由李开复团队打造,中文能力出色,支持本地部署
百川智能推出的开源大语言模型,中文能力出色,支持商用,适合国内开发者本地部署使用
NORDEF Matrix Open Control:模型无关的 AI Agent 安全带参考实现——确定性 0/1/2 决策、Ed25519 人工授权门(TTL ≤ 900s)、一次性 nonce 重放防护、只追加 SHA-256 证据链,把策略与人类权威放在语言模型之外。LAB 实验版(v3.0.0-lab),所有路径 execute=false。Python + MIT,附 29 测试与 10 事件评估库。
在 8GB 笔记本 GPU 上运行 177B 模型(Qwen3.8-Flash-Next),实测 6.6 GiB 显存、47.8 GiB 内存、34-35 tok/s,本地大模型部署的显存优化方案。
没有找到匹配的工具