Reflection 发布开源权重模型 Beam,以更低算力对标中国开源模型
Reflection AI 发布首个前沿开源权重模型 Beam,为 5010 亿参数、230 亿激活参数的文本混合专家模型,预训练用 23.8 万亿 token,上下文窗口 100 万 token。
Reflection AI 发布首个前沿开源权重模型 Beam,为 5010 亿参数、230 亿激活参数的文本混合专家模型,预训练用 23.8 万亿 token,上下文窗口 100 万 token。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,多场对话聚焦创始人在开源与闭源 AI 之间的模型选择。
硅谷企业正从追求"最强模型"转向"最划算模型",开放权重模型平均每百万Token成本0.83美元,比专有方案的6.03美元便宜7.3倍。AT&T约40%的AI工作负载已运行在开源模型上,计划一年内提升至70%;企业平均使用模型数量从2025年Q1的2.1个增至2026年Q1的4.7个。黄仁勋、纳德拉等133家机构联署公开信呼吁避免过早限制开放权重模型,而Anthropic始终缺席。
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 于 9 月 15 日发布只做判断、不生成文字的决策模型 Jev,OpenAI、Cloudflare、亚马逊及上海人工智能实验室随后两周内相继跟进。
DeepSeek 宣布 TileLang 原生支持华为昇腾 950 NPU,并同步推出 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大核心计算与通信库的昇腾版本。
关注价值:梳理 TileLang 昇腾后端的架构分层与性能对标数据,为观察国产算力软件栈适配路径提供技术参照。
红杉资本发布《Own Your Intelligence》实操指南,提出企业应垂直整合、自建并掌控模型权重,而非完全依赖前沿实验室 API。指南以 Harvey、Mercor、Langchain、Trajectory、Fireworks 的实践为例,给出评估、harness 与上下文工程、后训练三步路线图,并列出成本、速度、专有数据、掌控命运四类自建信号。
据 ATOM 报告,Qwen 在新开源模型微调与适配中的份额从 2024 年 1 月的 1% 升至 2026 年 2 月的 69%,多数美国 AI 初创公司在中国开源权重之上构建产品。