Deepseek

支持本地部署Deepseek-R1版本：7B、8B、14B、70B等。

Deepseek是深度求索公司开源的推理模型：DeepSeek-R1-Zero 和 DeepSeek-R1。DeepSeek-R1-Zero 采用大规模强化学习 (RL) 进行训练，无需先进行监督微调 (SFT)，展示了卓越的推理性能。通过 RL，DeepSeek-R1-Zero 自然地涌现出许多强大而有趣的推理行为。然而，DeepSeek-R1-Zero 也面临着诸如无限重复、可读性差和语言混合等挑战。为了解决这些问题并进一步提升推理性能，深度求索公司推出了 DeepSeek-R1，它在 RL 之前引入了冷启动数据。DeepSeek-R1 在数学、代码和推理任务中实现了与 OpenAI-o1 相当的性能。为了支持研究社区，深度求索公司开源了 DeepSeek-R1-Zero、DeepSeek-R1 以及六个基于 Llama 和 Qwen 的从 DeepSeek-R1 蒸馏得到的稠密模型。DeepSeek-R1-Distill-Qwen-32B 在各种基准测试中优于 OpenAI-o1-mini，为稠密模型实现了新的先进结果。（本内容翻译制Deepseek大模型github介绍）

https://github.com/deepseek-ai/DeepSeek-R1