🔥 AI资讯
AI人工智能行业每日热点,全球AI前沿动态
DeepSeek百亿级模型无新进展:参数量、测试分数、训练数据等核心技术细节全未公布
DeepSeek最近所谓“半年发布多个百亿级模型”,其实是4天前的旧消息被翻出来重炒。没有新模型、没有API、没有代码开源——零实质性进展。 所有宣传材料里,找不到任何可验证的技术细节: 参数量没写清楚(是10B?还是130B?) 没有MM...
Moonshot开源Kimi K3:200万token上下文+中文结构化推理+轻量多模态实测
Moonshot开源Kimi K3:200万token上下文、中文原生结构化推理与轻量多模态实测 Moonshot开源Kimi K3——Apache 2.0协议,支持200万token上下文,原生适配中文结构化推理与图文联合理解。Huggi...
DeepSeek开源百亿参数大模型DeepSeek-LLM与DeepSeek-Coder,自研DeepTrain训练框架实测A100单卡吞吐128 TFLOPS
DeepSeek半年内开源DeepSeekLLM与DeepSeekCoder两个百亿参数模型。训练基于自研框架+万卡智算集群,实测A100 80GB单卡训练吞吐128 TFLOPS。支持全参数微调和LoRA,但没发布API文档、定价或国际服...
DeepSeek-V4实测:首个支持四端本地100万token上下文的开源大模型
DeepSeekV4 实测:首个能在 Windows/macOS/iOS/Android 四端本地跑满 1M 上下文的开源大模型 DeepSeekV4 已上线实测。这是第一个在主流桌面与移动平台(Windows/macOS/iOS/Andr...
2026年07月24日 AI头条汇总:DeepSeek-V3正式商用、Llama 4开源引爆社区、AI Agent首次通过金融合规全栈测试
今天是2026年7月24日,AI圈没闲着——大模型落地加速、开源节奏拉满、Agent不再“纸上谈兵”,连芯片和监管都同步踩了油门。我们扒了全球17个信源,筛出5条真正影响开发者和从业者的硬新闻,不灌水、不吹牛,只讲你该知道的。 1. Dee...
DeepSeek-V4发布:支持1048576 tokens上下文与双模式推理的国产大模型
DeepSeekV4 正式发布:1M 上下文 + 双模式推理,仅限中国大陆本地部署与体验。 DeepSeekV4 是首个实测支持 1048576 tokens 上下文的闭源大模型,对开源生态友好(提供完整量化 SDK 和 API 规范)。它...
Kimi K3开源大模型发布:128K上下文+中文强推理+全参数开放
Moonshot发布Kimi K3:128K上下文、中文强推理、全参数开源 7月16日,Moonshot AI开源Kimi K3——目前参数量最大、权重完全开放的开源大模型(Apache 2.0协议)。它支持128K上下文,原生适配中文长文...
DeepSeek-V4技术解析:104万token上下文与双模式推理能力详解
DeepSeekV4 已发布技术规格:1,048,576 token 上下文窗口,支持显式切换的“思考模式”与“非思考模式”。但实测数据、可用 API 和海外服务目前均不可用。 模型支持长文档解析、多跳知识检索和 Agent 任务编排。思考...
Kimi K3开源中文大模型:128B参数2M上下文,支持本地部署与多模态推理
Moonshot AI 7月16日开源 Kimi K3:128B 参数、2M token 上下文、Apache 2.0 许可的中文大模型。它支持本地全量部署、Agent 编排和多模态推理,在 A100×8 集群上实测推理吞吐 42 toke...
DeepSeek-V2/DeepSeek-Coder/DeepSeek-MoE开源详解:百亿级模型Hugging Face一键部署与实测对比
DeepSeek半年内密集开源三款百亿级模型:DeepSeekV2(236B激活参数)、DeepSeekCoder 33B、DeepSeekMoE(16×14B)。全部模型已上架Hugging Face,支持transformers、lla...