🔥 AI资讯

AI人工智能行业每日热点,全球AI前沿动态

Claude Code推理链失控实测:33K tokens异常请求对比OpenCode仅7K

Claude Code 在解析用户 prompt 前就发出 33K tokens 请求——OpenCode 同样任务只发 7K。这不是吞吐优势,是推理链失控的明确信号。 Hacker News 上周热议的一组实测数据来自真实请求日志:团队在...

AI资讯

DeepSeek自研万卡集群与百亿参数模型开源,支持一键安装及多后端本地部署

DeepSeek半年内完成万卡集群自研、训练框架开发和两个百亿参数模型开源。国产AI工程化节奏,正在被重新定义。 DeepSeekLLM 和 DeepSeekCoder 已上线 HuggingFace,支持 pip install deep...

AI资讯

Claude Code sends 33k tokens before reading the prompt; OpenCode sends 7k

Claude Code 被开发者实测出“先发后读”行为:用户还没提交 /code 请求,它已向 Anthropic API 发送 33K tokens 的完整上下文。OpenCode 在同类场景下只发 7K tokens——这不是响应慢,是...

AI资讯

DeepSeek开源百亿级大模型全栈技术:支持本地部署与全参数微调

DeepSeek半年内密集开源DeepSeekLLM、DeepSeekCoder等多款百亿级模型,全部支持本地部署与全参数微调——这是2024年中文大模型领域最激进的开源节奏。团队用自研训练框架DeepSpeedMoE++,在超2000台H...

AI资讯

Claude Code API token冗余实测:33K请求开销解析与优化方案

Claude Code实测暴露33K token冗余请求:API层隐藏开销正吞噬开发者预算 Hacker News开发者团队实测发现,Claude Code执行单次代码生成任务时,向Anthropic API发送的请求体达33,127 to...

AI资讯

DeepSeek开源双模型DeepSeek-LLM与DeepSeek-Coder,支持本地微调量化部署

DeepSeek在6个月内完成从零训练到全栈开源:DeepSeekLLM(109B)、DeepSeekCoder(109B)双模型已正式发布,采用Apache 2.0协议,支持本地微调与量化部署;同步落地自研分布式训练框架DeepSpeed...

AI资讯

Google Gemini API托管智能体上线:支持72小时后台任务与远程MCP

Google Gemini API 正式上线托管智能体(Managed Agents)的后台任务(background tasks)与远程MCP(Model Control Protocol)能力,开发者 now 可直接调用高可靠、异步执行...

AI资讯

OpenAI Fork Git仓库并增强大文件支持:AI原生Git能力解析

OpenAI Fork了 Git 仓库(github.com/git/git),托管在 openai/ 组织下——这不是镜像,而是可提交、可分支、可提 PR 的完整副本。 这事上了 Hacker News 首页,峰值 427 条评论。大家争...

AI资讯

智谱GLM无API无开源无评测?对比DeepSeek R1看AI模型技术可信度真相

智谱创始人唐杰发布内部信《巨浪已来》,宣布“GLM时刻”终结,全面转向Coding能力攻坚。但至今没有公开API、没有开源模型、没有第三方评测报告——所有技术主张只存在于PR稿里。 开发者得清楚:市值破万亿港元,不等于代码能调用。DeepS...

AI资讯

智谱GLM-Coder代码生成模型现状:无API无开源无评测,开发者如何评估Code-First战略

智谱创始人唐杰发布内部信《巨浪已来》,宣布战略重心转向强化 Coding 能力,提出“GLM时刻”后进入“CodeFirst”阶段。但截至目前,没有公开 API、没有开源模型、也没有第三方 benchmark 报告——所有技术主张仍停留在内...

AI资讯