Deepseek
支持本地部署深度求索公司开源的Deepseek版本:7B、8B、14B、70B等。
支持本地部署深度求索公司开源的Deepseek版本:7B、8B、14B、70B等。
支持本地部署Deepseek-R1版本:7B、8B、14B、70B等。
Deepseek是深度求索公司开源的推理模型:DeepSeek-R1-Zero 和 DeepSeek-R1。DeepSeek-R1-Zero 采用大规模强化学习 (RL) 进行训练,无需先进行监督微调 (SFT),展示了卓越的推理性能。通过 RL,DeepSeek-R1-Zero 自然地涌现出许多强大而有趣的推理行为。然而,DeepSeek-R1-Zero 也面临着诸如无限重复、可读性差和语言混合等挑战。为了解决这些问题并进一步提升推理性能,深度求索公司推出了 DeepSeek-R1,它在 RL 之前引入了冷启动数据。DeepSeek-R1 在数学、代码和推理任务中实现了与 OpenAI-o1 相当的性能。为了支持研究社区,深度求索公司开源了 DeepSeek-R1-Zero、DeepSeek-R1 以及六个基于 Llama 和 Qwen 的从 DeepSeek-R1 蒸馏得到的稠密模型。DeepSeek-R1-Distill-Qwen-32B 在各种基准测试中优于 OpenAI-o1-mini,为稠密模型实现了新的最先进结果。(本内容翻译制Deepseek大模型github介绍)
https://github.com/deepseek-ai/DeepSeek-R1