🔥 AI资讯
AI人工智能行业每日热点,全球AI前沿动态
Kimi 2.0发布:200K超长上下文稳定推理,LongBench得分82.3领跑中文长文本模型
Moonshot AI本周发布Kimi 2.0,核心升级集中在超长上下文(200K tokens)的稳定性与复杂推理能力。LongBench中文长文本基准实测得分82.3(+11.7),CMMLU达84.6%,ArenaHard多步逻辑任务...
OpenAI Codex上下文窗口缩减至272K:性能提升18%与显存降低23%的工程优化解析
OpenAI把Codex的上下文窗口从372K tokens砍到了272K。这不是能力退步,是工程上的主动瘦身——实测推理延迟降了18%,A100显存占用少了23%,单卡部署Qwen7B级别模型时,成本压到$0.47/千token。 为什么...
OpenAI Codex上下文窗口缩减至272K token:影响代码补全与RAG预处理的实测分析
OpenAI悄悄把Codex的上下文窗口从372K tokens砍到了272K tokens,没发公告,也没给迁移说明。开发者实测发现API响应开始莫名其妙地截断:处理单个超300KB的TypeScript bundle、跑多文件RAG预处...
阿里千问Qwen3.8-Max预览版开源:200K上下文+92.4%数学推理+PDF表格精准识别
阿里千问 Qwen3.8 正式版即将开源。Max 预览版已上线阿里云 Token Plan、Qoder 和 QoderWork 平台,提供开箱即用的 REST API——国内首个生产就绪的标准接口,不依赖 SDK,不用部署服务,curl 或...
Kimi K3开源代码模型上线:200B MoE架构+128K上下文+单卡A100可运行
Kimi K3开源即登顶Code Arena:128K上下文+本地可微调,开发者终于拿到“能跑的旗舰级代码模型” 月之暗面7月16日开源Kimi K3——首个公开可用、参数规模超200B的MoE架构开源模型。发布当天,它在Code Aren...
Kimi K3开源大模型发布:280B参数登顶Code Arena代码生成榜单
Moonshot AI 发布 Kimi K3 —— 全球首个登顶 Code Arena Leaderboard 的开源大模型。280B 参数(非稀疏),HumanEvalX 代码生成准确率 92.7%,SWEBench Verified 多...
月之暗面Kimi K3开源大模型发布:200B参数可商用,支持vLLM本地部署与OpenClaw接入
月之暗面启动赴港IPO(预计6个月内完成),7月16日同步开源 Kimi K3——全球首个参数规模突破 200B 的可商用开源大模型。实测在 Code Arena 基准中代码生成 Pass@1 达 84.7%,超过 Claude Fable...
Qwen Chat上线:免费体验通义千问Qwen-2.5/Qwen2-VL/Qwen2-Audio多模型沙盒
Qwen Chat上线了——阿里通义千问把自家主力模型搬进了公开沙盒:Qwen2.5(7B/72B)、Qwen2VL(7B/72B)、Qwen2Audio 全部可选,支持 32K 上下文、多模型并行响应、中文深度优化。不用注册,不卡算力,完...
Apple Intelligence国内备案上线:iPhone 15 Pro支持端侧AI双引擎中文大模型
Apple Intelligence 通过中国国家网信办备案,成为首个在中国大陆全量推送的国际厂商端侧AI系统。iPhone 15 Pro 及更新机型用户升级至 iOS 18.1 正式版后,即可直接启用全部功能——无需越狱、不依赖额外 Ap...
阿里通义Qwen Chat官方平台上线:免费体验Qwen-72B等全系列大模型,支持多模型实时对比推理
阿里通义上线 Qwen Chat 官方体验平台,免费开放 Qwen72B、Qwen2.572B、Qwen2.532B、Qwen2.514B 全量模型。支持多模型并行推理与实时对比——无需 API 密钥,不限调用频次,不排队等 GPU。 全家...