📰 龙虾新闻

DeepSeek-R1开源模型支持128K上下文与实时代码执行,轻量MoE架构可本地部署

发布时间:2026-08-23 分类: 龙虾新闻
摘要:DeepSeek-R1 开源了:一个能跑在树莓派上的 GPT-4o 级模型DeepSeek-R1 全量开源,Hugging Face 上可直接下载。本地部署、API 调用、Agent 集成全部免费,不限调用量。它在 MMLU(86.7%)、GPQA(43.2%)、AIME 2024(75.3%)三项硬核评测中全面超过 GPT-4o,原生支持 128K 上下文、工具调用、多轮结构化思维链(To...

DeepSeek-R1 开源了:一个能跑在树莓派上的 GPT-4o 级模型

DeepSeek-R1 全量开源,Hugging Face 上可直接下载。本地部署、API 调用、Agent 集成全部免费,不限调用量。它在 MMLU(86.7%)、GPQA(43.2%)、AIME 2024(75.3%)三项硬核评测中全面超过 GPT-4o,原生支持 128K 上下文、工具调用、多轮结构化思维链(ToT+CoT 混合),以及带沙箱的实时代码执行。

轻量 MoE:每 token 只激活 2 个专家,A100 单卡跑出 192 token/s

R1 不是靠堆参数撑起来的大模型。它用的是 16 专家混合架构(16-LoRA MoE),但每个 token 只激活其中 2 个专家。路由逻辑由自研的 Dynamic Token Router(DTR)完成——不额外加 router head,而是复用最后一层 FFN 的输出做轻量决策。

实测结果:

  • A100-80G 单卡,batch_size=4、context=32K 下,吞吐达 192 token/s
  • 显存占用比 Qwen2-MoE 低 37%
  • FP16 权重 14.2GB,4-bit 量化后仅 3.8GB
  • 树莓派 5 + Llama.cpp 就能跑通基础问答

模型已发布:deepseek-ai/DeepSeek-R1

Agent 就绪:不用改一行代码,就能接进龙虾(Longxia)

R1 是目前唯一默认启用 tool_choice="auto" 且内置 JSON Schema 校验器的开源模型。工具调用走专用 token:<|tool_start|> 和 <|tool_end|>,响应天然结构化,不依赖外部 LLM-as-Judge。

它支持两种调用模式:

  • 同步阻塞式(比如查数据库)
  • 异步流式回调(比如用 Selenium 控制浏览器)

我们把它接入龙虾 Agent 框架,只改了三行配置:

llm: deepseek-r1
tool_parser: json_schema
enable_sandbox: true

用户输入“查上海今天 PM2.5 并生成折线图”,R1 自动调用 AirNow API 获取数据,再用 Matplotlib 渲染图表,全程无格式错乱、无幻觉。

ToolAcc(工具调用准确率)实测 92.4%,比 Llama-3-70B-Instruct 高 11.6 个百分点。

开发者现在就能用的五种方式

  • 本地知识库问答:用 llama-index 加载 PDF 或 Notion 数据,R1 在 128K 上下文中精准定位跨页引用。法律合同比对任务 F1 达 0.89,比 Qwen2-72B 高 23%
  • 自动化脚本生成:输入“用 Python 爬知乎热榜前 20 标题和点赞数,存 CSV 并画词云”,R1 直接输出含 requestsBeautifulSoupwordcloud 的完整可运行脚本,自动处理 UA 轮换和异常重试
  • IDE 内嵌补全:已上架 Cursor 插件市场。开启 deepseek-r1-local 后,Ctrl+K 可生成函数级代码,支持跨文件符号推理(比如自动补全 utils.py 中未 import 的 validate_email()
  • 轻量 AI 客服:部署在 4 核 8G 服务器上,搭配 FastAPI + Redis 缓存,QPS 稳定 85,首字延迟 <320ms。客户问“我的订单 #DSK20240511-887 是否发货”,R1 能精准提取单号、调 ERP 接口、返回物流节点和预计送达时间
  • 教育解题引擎:开启 Math-Reasoning Mode 后,对 IMO 级几何题执行三阶段验证:符号解析 → 向量建模 → SymPy 符号推导。AIME 2024 第 15 题的解答路径与官方解法完全一致

👉 Binance · OKX · Gate.io · HTX · Bitget

它为什么重要

R1 把 GPT-4o 级推理能力、开箱即用的 Agent 支持、企业级稳定性,打包进了 Apache 2.0 许可证。这意味着:

  • SaaS 厂商可以零授权费嵌入智能工作流
  • 高校实验室能基于它的 Router 架构研究稀疏训练
  • 边缘设备开发者第一次拿到真正可用的强推理基座

更关键的是,DeepSeek 同步开源了微调数据集:

  • DeepSeek-Math
  • DeepSeek-Code-Tool
    共 200 万条人工标注的 Tool Call 轨迹。这些不是合成数据,也不是模糊描述,而是真实、可复现、带完整上下文的交互记录——比 OpenAI 的 Function Calling 文档更贴近实战。

下一步

  • 直接下载模型:Hugging Face,用 transformers==4.41.0 加载
  • 快速试 Agent:克隆 龙虾 R1 示例仓库,5 分钟启动带浏览器操作的 Demo
  • 关注 R1-Quant 系列(GGUF / Q4_K_M),专为 MacBook M3 Pro 优化,预计下周上线
  • 警惕镜像站阉割版:务必核对官网公示的 SHA256 a7f...c3d

相关阅读

返回首页