🔥 AI资讯
AI人工智能行业每日热点,全球AI前沿动态
Qwen2.5-72B与Moonshot-K1实测:支持国际API调用,推理成本仅GPT-4的1/5
中国AI模型实测支持国际API调用:Qwen2.572B、MoonshotK1推理成本仅为GPT4的1/5,ONNX轻量部署已上Hugging Face Qwen2.572BInstruct 和 MoonshotK1128K 已在 Open...
Kimi v2.5实测:200万上下文+原生文档解析+结构化输出API
Kimi v2.5实测:200万上下文、原生文档解析与结构化输出 Moonshot AI 推出 Kimi v2.5,支持 200 万 token 上下文、直接解析 PDF/Word/PPT/Excel、中文数学推理在 CMMLU 数学子集达...
Moonshot Kimi 4.0与阿里Qwen3双模发布:MoE稀疏化+国产算力栈显著降低AI推理成本
中国双模齐发:Moonshot与阿里千问新模型直击AI算力成本瓶颈 5月22日,Moonshot发布Kimi 4.0,阿里通义实验室开源Qwen3。两者都把GSM8K数学推理做到92.3%,HumanEval代码生成做到78.1%,而API...
Kimi 2.0发布:200K超长上下文稳定推理,LongBench得分82.3领跑中文长文本模型
Moonshot AI本周发布Kimi 2.0,核心升级集中在超长上下文(200K tokens)的稳定性与复杂推理能力。LongBench中文长文本基准实测得分82.3(+11.7),CMMLU达84.6%,ArenaHard多步逻辑任务...
OpenAI Codex上下文窗口缩减至272K:性能提升18%与显存降低23%的工程优化解析
OpenAI把Codex的上下文窗口从372K tokens砍到了272K。这不是能力退步,是工程上的主动瘦身——实测推理延迟降了18%,A100显存占用少了23%,单卡部署Qwen7B级别模型时,成本压到$0.47/千token。 为什么...
OpenAI Codex上下文窗口缩减至272K token:影响代码补全与RAG预处理的实测分析
OpenAI悄悄把Codex的上下文窗口从372K tokens砍到了272K tokens,没发公告,也没给迁移说明。开发者实测发现API响应开始莫名其妙地截断:处理单个超300KB的TypeScript bundle、跑多文件RAG预处...
阿里千问Qwen3.8-Max预览版开源:200K上下文+92.4%数学推理+PDF表格精准识别
阿里千问 Qwen3.8 正式版即将开源。Max 预览版已上线阿里云 Token Plan、Qoder 和 QoderWork 平台,提供开箱即用的 REST API——国内首个生产就绪的标准接口,不依赖 SDK,不用部署服务,curl 或...
Kimi K3开源代码模型上线:200B MoE架构+128K上下文+单卡A100可运行
Kimi K3开源即登顶Code Arena:128K上下文+本地可微调,开发者终于拿到“能跑的旗舰级代码模型” 月之暗面7月16日开源Kimi K3——首个公开可用、参数规模超200B的MoE架构开源模型。发布当天,它在Code Aren...
Kimi K3开源大模型发布:280B参数登顶Code Arena代码生成榜单
Moonshot AI 发布 Kimi K3 —— 全球首个登顶 Code Arena Leaderboard 的开源大模型。280B 参数(非稀疏),HumanEvalX 代码生成准确率 92.7%,SWEBench Verified 多...
月之暗面Kimi K3开源大模型发布:200B参数可商用,支持vLLM本地部署与OpenClaw接入
月之暗面启动赴港IPO(预计6个月内完成),7月16日同步开源 Kimi K3——全球首个参数规模突破 200B 的可商用开源大模型。实测在 Code Arena 基准中代码生成 Pass@1 达 84.7%,超过 Claude Fable...