🔥 AI资讯
AI人工智能行业每日热点,全球AI前沿动态
DeepSeek开源百亿参数大模型DeepSeek-LLM与DeepSeek-Coder,自研DeepTrain训练框架实测A100单卡吞吐128 TFLOPS
DeepSeek半年内开源DeepSeekLLM与DeepSeekCoder两个百亿参数模型。训练基于自研框架+万卡智算集群,实测A100 80GB单卡训练吞吐128 TFLOPS。支持全参数微调和LoRA,但没发布API文档、定价或国际服...
DeepSeek-V4实测:首个支持四端本地100万token上下文的开源大模型
DeepSeekV4 实测:首个能在 Windows/macOS/iOS/Android 四端本地跑满 1M 上下文的开源大模型 DeepSeekV4 已上线实测。这是第一个在主流桌面与移动平台(Windows/macOS/iOS/Andr...
2026年07月24日 AI头条汇总:DeepSeek-V3正式商用、Llama 4开源引爆社区、AI Agent首次通过金融合规全栈测试
今天是2026年7月24日,AI圈没闲着——大模型落地加速、开源节奏拉满、Agent不再“纸上谈兵”,连芯片和监管都同步踩了油门。我们扒了全球17个信源,筛出5条真正影响开发者和从业者的硬新闻,不灌水、不吹牛,只讲你该知道的。 1. Dee...
DeepSeek-V4发布:支持1048576 tokens上下文与双模式推理的国产大模型
DeepSeekV4 正式发布:1M 上下文 + 双模式推理,仅限中国大陆本地部署与体验。 DeepSeekV4 是首个实测支持 1048576 tokens 上下文的闭源大模型,对开源生态友好(提供完整量化 SDK 和 API 规范)。它...
Kimi K3开源大模型发布:128K上下文+中文强推理+全参数开放
Moonshot发布Kimi K3:128K上下文、中文强推理、全参数开源 7月16日,Moonshot AI开源Kimi K3——目前参数量最大、权重完全开放的开源大模型(Apache 2.0协议)。它支持128K上下文,原生适配中文长文...
DeepSeek-V4技术解析:104万token上下文与双模式推理能力详解
DeepSeekV4 已发布技术规格:1,048,576 token 上下文窗口,支持显式切换的“思考模式”与“非思考模式”。但实测数据、可用 API 和海外服务目前均不可用。 模型支持长文档解析、多跳知识检索和 Agent 任务编排。思考...
Kimi K3开源中文大模型:128B参数2M上下文,支持本地部署与多模态推理
Moonshot AI 7月16日开源 Kimi K3:128B 参数、2M token 上下文、Apache 2.0 许可的中文大模型。它支持本地全量部署、Agent 编排和多模态推理,在 A100×8 集群上实测推理吞吐 42 toke...
DeepSeek-V2/DeepSeek-Coder/DeepSeek-MoE开源详解:百亿级模型Hugging Face一键部署与实测对比
DeepSeek半年内密集开源三款百亿级模型:DeepSeekV2(236B激活参数)、DeepSeekCoder 33B、DeepSeekMoE(16×14B)。全部模型已上架Hugging Face,支持transformers、lla...
月之暗面Kimi K3开源模型引发美国出口管制重审:200B参数中文大模型推动AI治理变革
月之暗面Kimi K3开源引爆美出口管制重审:高性价比开源模型正改写AI治理规则 7月16日,月之暗面开源Kimi K3——参数量超200B、支持FP16/INT4量化、全权重可商用下载的中文大模型。它跑得快:A100×8集群上单卡推理吞吐...
DeepSeek半年开源4款百亿级大模型,DeepSpeed-X训练框架加速AI工业化量产
DeepSeek半年内密集开源多个百亿级模型:DeepSeekV2、DeepSeekCoder33B、DeepSeekMoE16B、DeepSeekVL。全部开源权重、Tokenizer和推理脚本,Apache 2.0协议。发布节奏是重点—...