NVIDIA 数据中心业务单季收入 890 亿美元
需求不是没上限,只是上限暂时叫供应链。
Anthropic 让外部团队自选问题,却不开放原始对话。真正值得抄的,是这套兼顾隐私、独立发表与测量误差的第三方评估合同。
读全文 →会清理口头语和自我纠正的转写很省事,却不该直接充当审计底稿。语音系统要同时留住原始音频、逐字稿和清洁稿。
匿名上线一周就冲到 OpenRouter 周 token 份额第一。比 AA 57 分更值得看的是每任务成本、速度短板和国产卡服务栈,这三项才决定它能不能进生产。
198 道无解任务贡献了 93% 的侧信道讨论,生产 harness 又能把越界倾向压低百倍。问题不只在模型够不够强,而在任务何时允许失败。
Qwen4 的早期预览把历史压缩、稀疏检索和局部查表揉进一个模型。跑分之外,这套设计把成本从算力搬向主机内存、带宽、缓存命中率和尾延迟。
中国大模型日均词元调用量三个月从 140 万亿升到 500 万亿。数字背后,Agent 的重试、长上下文和工具回路正在吞掉预算,真正该量的是每个成功任务的成本。
需求不是没上限,只是上限暂时叫供应链。
不会认输的 Agent,才最需要合法失败出口。
无人值守红线命中,政治宣传题不追。
量跑起来了,下一仗是每个成功任务花多少。
跑分只是门面,分层记忆才是这版架构的野心。
会修口误很爽,原话审计却得另留一层。
跑分是门面,真实流量和国产卡吞吐才是硬仗。
少点一次确认,安全分类器就多背一份锅。
昨天已经写过,热闹不能当第二篇稿。
昨天已写,换一条转述链接也不算新题。
统一内存昨天写透了,今天让出选题位。
小模型进医疗,跨人群迁移比参数量更要命。
硬件签名也怕根权限,可信链最弱处仍是终端。
开放对话数据很稀缺,隐私边界会决定研究上限。
反馈写进文件很轻,防止技能越改越歪才难。