🔥 AI资讯
AI人工智能行业每日热点,全球AI前沿动态
美国拟将Kimi K3等中国开源大模型列入EAR管制清单及合规影响分析
美国商务部拟将Kimi K3、DeepSeekV2、Qwen2等中国开源大模型列入EAR管制清单,明确“商用即出口”。开发者仍可自由下载权重文件,但企业部署、API调用、云服务集成等行为可能触发出口许可证审批——技术上跑得通,商业上不敢签单...
开源模型现在能扛主力任务
中国AI公司推出Kimi1.5和Qwen3,API价格直接下探到$0.00025/1k tokens(GPT4turbo为$0.001),上下文支持突破2M tokens,多模态输入可实时处理图文混合内容,首跳延迟实测
Qwen 3.8 Max Preview多模态大模型上线:支持图文音混合输入,推理速度提升2.1倍
Qwen 3.8 Max Preview 已上线。发布 24 小时内冲上 Hacker News 热榜第一。实测支持 PNG/JPEG/WebP 图像、WAV/MP3/FLAC 音频与文本混合输入,单次请求最高处理 16MB 多模态载荷;A...
Qwen3与Moonshot-K1海外API实测:vLLM+OpenClaw轻量栈部署,Token成本降至Claude 4的1/3
Qwen3与MoonshotK1实测:中国大模型海外API上线,vLLM+OpenClaw轻量栈可用,Token成本压到Claude 4的1/3 Qwen3(Qwen332BInstruct)和MoonshotK1(K1128B)已开放全球...
DeepSeek-V4正式发布:1M上下文免费国产大模型,支持多语言API调用与vLLM部署
DeepSeekV4 正式发布:支持国际 API 调用、1M 上下文、原生推理链输出的免费国产旗舰大模型,开箱即用。 API 已在 Hugging Face、OpenRouter 和 deepseek.com 全量开放,无需密钥即可调用。实...
Qwen2.5-72B与Moonshot-K1实测:支持国际API调用,推理成本仅GPT-4的1/5
中国AI模型实测支持国际API调用:Qwen2.572B、MoonshotK1推理成本仅为GPT4的1/5,ONNX轻量部署已上Hugging Face Qwen2.572BInstruct 和 MoonshotK1128K 已在 Open...
Kimi v2.5实测:200万上下文+原生文档解析+结构化输出API
Kimi v2.5实测:200万上下文、原生文档解析与结构化输出 Moonshot AI 推出 Kimi v2.5,支持 200 万 token 上下文、直接解析 PDF/Word/PPT/Excel、中文数学推理在 CMMLU 数学子集达...
Moonshot Kimi 4.0与阿里Qwen3双模发布:MoE稀疏化+国产算力栈显著降低AI推理成本
中国双模齐发:Moonshot与阿里千问新模型直击AI算力成本瓶颈 5月22日,Moonshot发布Kimi 4.0,阿里通义实验室开源Qwen3。两者都把GSM8K数学推理做到92.3%,HumanEval代码生成做到78.1%,而API...
Kimi 2.0发布:200K超长上下文稳定推理,LongBench得分82.3领跑中文长文本模型
Moonshot AI本周发布Kimi 2.0,核心升级集中在超长上下文(200K tokens)的稳定性与复杂推理能力。LongBench中文长文本基准实测得分82.3(+11.7),CMMLU达84.6%,ArenaHard多步逻辑任务...
OpenAI Codex上下文窗口缩减至272K:性能提升18%与显存降低23%的工程优化解析
OpenAI把Codex的上下文窗口从372K tokens砍到了272K。这不是能力退步,是工程上的主动瘦身——实测推理延迟降了18%,A100显存占用少了23%,单卡部署Qwen7B级别模型时,成本压到$0.47/千token。 为什么...