🔥 AI资讯
AI人工智能行业每日热点,全球AI前沿动态
Kimi K3开源大模型正式发布:2.8T参数量支持低延迟商业级API调用
Kimi K3 开源权重正式发布,同步上线 Telnyx Inference API——国内首个公开开源、参数量 2.8T(实测等效激活参数约 120B)的超大规模语言模型,支持免部署、低延迟、商业级就绪的全球实时 API 调用。 Deep...
DeepSeek-V4支持1M上下文与双推理模式详解:长文档处理与Agent任务新突破
DeepSeekV4官宣支持1M上下文与双推理模式:长文档处理和Agent任务有了新变量,但实测数据和API接口仍未落地 DeepSeekV4公开了两项核心能力:原生支持1048576 tokens上下文,以及“思考模式”(ChainofT...
Qwen-AgentWorld-35B-A3B开源:35B参数AI Agent模型,支持结构化思维链与多步工具调用
Qwen 于 2024 年 11 月 27 日在 Hugging Face 开源 QwenAgentWorld35BA3B:一款专为 AI Agent 设计的 35B 参数模型,实际推理开销接近 7B 模型。它采用 A3B 架构(Activ...
DeepSeek算力瓶颈分析:FP8训练吞吐、vLLM调度与NVLink带宽实测差距
DeepSeek暂停新一轮融资。Hacker News泄露的PDF实录暴露了训练基础设施的关键断层:单集群千卡级FP8混合精度长序列训练吞吐,仅为美国头部厂商的58%;vLLM调度器在128K上下文下GPU显存碎片率高达37%;NVLink...
DeepSeek-V4免费API上线:支持100万token上下文与双模推理的开源大模型
DeepSeekV4 免费 API 上线:首个支持 1M 上下文与双模推理的开源大模型,已进入日常开发。 DeepSeekV4 全平台开放免费 API。它在开源/免费层级首次实现 100 万 token 上下文处理,并支持“思考 / 非思考...
DeepSeek开源百亿参数双模大模型:支持通用理解与编程生成,性能媲美Llama3-70B
DeepSeek半年内开源DeepSeekLLM与DeepSeekCoder两款百亿参数模型:HumanEval+Plus(pass@1)73.2%,MMLU(5shot)82.6%。这两项指标与Llama370B基本持平(MMLU差0.5...
DeepSeek暂停融资背后:国产万卡集群互连带宽瓶颈致算力损失3.2倍
DeepSeek官方暂停新一轮融资。Hacker News上泄露的一份内部技术备忘录首次披露:在相同模型规模下,中美万卡级训练集群的实际有效算力相差3.2倍——这直接导致模型收敛慢47%,128K+上下文窗口难以稳定运行,多模态对齐阶段GP...
2026年07月27日 AI头条汇总:核心事件 + 核心观点
2026年07月27日 AI头条汇总:核心事件 + 核心观点 1. 今日AI头条概览 今日,AI行业迎来了两大重要事件:OpenAI发布了其最新一代大模型GPT5,并宣布与多家全球顶级科研机构达成战略合作,共同推进AI技术在科学研究中的应用...
Yorishiro开源:macOS终端纯前端AI人格化沙盒,Three.js驱动Claude Code 3D角色实时反馈
Yorishiro开源上线:macOS终端里的纯前端AI人格化沙盒,用Three.js为Claude Code配上会动的“依代” Yorishiro跑在macOS终端里,不连后端,不调远程模型。它用本地JavaScript(加WebGL)把...
DeepSeek暂停融资实因中美芯片算力差距:H20与A100/ H100算力对比及大模型训练瓶颈分析
DeepSeek暂停新一轮融资属实,创始人在Hacker News实名回应:不是缺钱,而是主动放慢大模型训练节奏——根本卡点在中美之间真实的芯片算力差距。 算力不是概念,是H20上跑不满的FP16吞吐 H20实测FP16峰值1.6 TFLO...