OPC动态

OPC每天动态(2026-08-16)

OPC动态

OPC每天动态(2026-08-16)

华为 WorkSwarm 蜂群办公智能体、阿里 Qwen3.8-27B、MiniMax Music3 同日开源;Anthropic 拟 60 亿美元收购 Decart、智谱 GLM-5.3 多项基准超 Claude;DeepSeek API 涨价最高 1100%、OpenAI×Cerebras 推 Ultrafast 提速 14 倍;领英 CEO 预言 FDE 成三大风口岗之一。

今日概览

丙午年七月初四·壬戌日(周日)

当华为把"一群 Agent 协同写一份 200 页 PPT"做成蜂群办公、当阿里和 MiniMax 把 270 亿参数与音乐大模型同时开源、当 Anthropic 用 60 亿美元把芯片优化能力"买"进自身、当 DeepSeek 把 API 价格最高拉涨 11 倍、而 OpenAI 转头用 Cerebras 把推理提速 14 倍——这一周的信号极其清晰:底座能力被同时推向"更开放"与"更贵/更快"的两端。对超级个体而言,工具箱在变厚,但单位算力的成本账正在重写,会算账的人比会写 Prompt 的人更值钱。

【工具趋势】华为 WorkSwarm 蜂群办公智能体亮相:20 分钟产出 200 页 PPT

8 月 15 日,华为 2012 实验室联合华为云、终端、计算等多部门共建的"蜂群办公"智能体 WorkSwarm 对外释放关键信息。它不再是单个聊天机器人,而是一群各司其职的 Agent 像蜂群一样协同:给定主题后,系统在约 20 分钟内自主完成一份 200 页级别的完整 PPT,并天然适配鸿蒙 PC 多端协同。其技术底座为 HOTS(层级目标分解与调度)与 HITS(人类意图追踪与对齐)双重机制,在办公智能体基准 PinchBench 上取得 94.2% 的 SOTA 成绩。这意味着"一个人 + 一群 Agent"已能承担过去需要一个项目组的中段交付,单人产能的边界被再次推高。(信源链接:今日头条/腾讯新闻

【工具趋势】阿里 Qwen3.8-27B 开源:270 亿稠密多模态,上下文外推至 100 万

8 月 14 日,阿里开源 Qwen3.8-27B——一个 270 亿参数的稠密多模态模型,原生支持 262K 上下文,并通过 YaRN 位置编码外推至 100 万 token。在编程基准上超越此前的 Qwen3.7-Plus,采用 Apache 2.0 协议可商用。27B 这个体量被刻意卡在"单卡可跑、质量够用"的甜点位:对一人公司而言,这意味着可在自有显卡上本地部署一个接近旗舰水平的通用助手,数据不出本机、成本近乎为零。开源策略延续了 Qwen 系列"用开放换生态"的打法,也把"私有化部署的超级个体"门槛进一步压低。(信源链接:腾讯新闻

【工具趋势】MiniMax 开源 Music3:11.1B 分层自回归,最长生成 5 分钟音乐

8 月 13 日,MiniMax 开源其音乐生成模型 Music3(mini_max-music-3),权重同步发布于 HuggingFace、GitHub 与 ModelScope。模型采用 11.1B 参数的分层自回归架构:一个 8B 的 Global LLM 负责曲式、结构与长程一致性,一个 0.6B 的 Local LLM 负责逐段声学细节,最长可生成 5 分钟连贯曲目。对内容型超级个体(短视频配乐、播客 BGM、独立音乐人)而言,这意味着"按需生成可商用、不踩版权雷"的配乐能力被开源——创作链路里最贵的一环(授权音乐)被一次性抹平。(信源链接:MiniMax 官方博客

【产业观察】Anthropic 拟 60 亿美元收购 Decart:IPO 前最大手笔

8 月 13–14 日,多家媒体报道 Anthropic 正洽谈以约 60 亿美元收购 AI 芯片优化与世界模型公司 Decart,这将是 Anthropic 上市前规模最大的收购。Decart 的核心能力是把模型推理在没有专用硬件时跑得更快更省——其推理吞吐可达 1600 tokens/秒;被收购后 Anthropic 毛利率有望从 29% 提升约 15 个百分点至 44%。对依赖 API 的超级个体,这笔收购的潜台词是:前沿模型厂商正把"成本结构"当作核心战场,未来谁把单位推理成本压得低,谁就掌握下游一人公司的命脉。(信源链接:腾讯新闻/钜亨网

【工具趋势】DeepSeek API 涨价最高 1100%:8 月 17 日生效,引入峰谷定价

8 月 13 日 DeepSeek 官宣 API 价格整体上调,新价于 8 月 17 日生效。其中 V4 Pro 高峰时段、缓存命中输入价格由 0.025 元/百万 tokens 上调至 0.3 元/百万 tokens,涨幅最高约 1100%;同时首次引入"峰谷定价"——低谷时段价格大幅下探,引导用户把批量任务调度到闲时。这是继 8 月初预告后的正式落地,信号明确:低价换规模的阶段结束,模型厂商开始对"稳定高并发调用"收溢价。对把 DeepSeek 当生产底座的一人公司,是时候重算成本、把弹性负载迁到谷段了。(信源链接:腾讯新闻

【产业观察】智谱 GLM-5.3 发布:7430 亿参数后训练 Scaling,多项基准超 Claude

8 月 14 日,智谱发布 GLM-5.3,参数量 7430 亿,主打"后训练 Scaling"路线。在 GDPval-AA v2(真实经济任务评测)上取得 1769 分,超过 Claude Fable 5 的 1743 分;Terminal-Bench 3.0 得分 28.3、CyberGym 安全攻防得分 84.5%。GLM-5.3 把重心放在"能动手完成任务"而非单纯对话,与一人公司最需要的"把活干完"高度贴合。国产模型在 Agent 向基准上首次稳定压过国际旗舰,也意味着国内超级个体的工具箱里多了一个可优先评估的本土选项。(信源链接:东方财富/AI Release Tracker

【工具趋势】OpenAI × Cerebras 推 Ultrafast 模式:GPT-5.6 Sol 提速 14 倍

8 月 13 日,OpenAI 与 Cerebras 联合推出 GPT-5.6 Sol 的 Ultrafast 模式,借助 Cerebras 的 WSE-3 晶圆级引擎(44GB 片上 SRAM、无需外挂 HBM)将输出速度提升至约 750 tokens/秒,较常规模式提速约 14 倍。在 HLE(前沿数学与科学)2500 题基准上,Ultrafast 仅用 11 小时 11 分完成,而 Claude Fable 5 需 78 小时 27 分。速度本身就是能力——当"等模型思考"从以小时计变成以分钟计,一人公司把 AI 嵌进实时工作流(客服、直播、现场诊断)才真正可行。(信源链接:Cerebras 官方博客

【海外观察·FDE】领英 CEO 预言三大风口岗,FDE 起薪 3 万最高 10 万

8 月 15 日,领英(LinkedIn)CEO 在公开演讲中给出判断:未来最稀缺的三类岗位是 Forward Deployed Engineer(前沿部署工程师)、AI 硬件部署工程师、以及数据合成与标注工程师。其中 FDE 作为"把模型接进真实业务"的关键角色,初级起薪约 3 万元/月、资深可达 10 万元/月,年薪中枢约 150 万元。这与一周前 skai.io 统计的"FDE 招聘同比 +729%"相互印证:FDE 正从硅谷黑话变成全球一线公司的标准建制。对超级个体,FDE 既是可售卖的高价能力单元,也是必须警惕被平台化的"中间层"。(FDE)(信源链接:网易新闻

【深度观察】开源模型周:Qwen / MiniMax / DeepSeek 三连开,Agent 执行层被"乐高化"

把本周信号连起来看:阿里 270 亿多模态、MiniMax 音乐、DeepSeek Harness 执行框架在数日内集中开源,叠加上周百度库库 AI 的独立入口——模型能力的"开放阈值"被整体拉低。更关键的是 DeepSeek Harness 提出的"一切皆插件"(模型+Harness=Agent),把 Agent 的执行层拆成可自由替换的标准件。对一人公司,这是双重利好:底座更便宜可私有化,组装更自由可拼装。当"造 Agent"从写代码变成"选插件",超级个体的护城河就从工程能力转向场景判断与编排能力——知道把哪几个能力单元拼成别人愿意付钱的交付。(信源链接:都市快报橙柿互动

【数据洞察】推理成本两极分化:一端涨价(DeepSeek +1100%),一端提速降价(Cerebras 14×)

同一周内,模型推理成本出现罕见的两极:DeepSeek 把高峰 API 价格最高拉涨 11 倍,OpenAI×Cerebras 却把速度提 14 倍、变相摊薄单位成本。成本曲线不再单调下行,而是按"稳定性/峰值/闲时"分层定价。对依赖 API 的超级个体,这意味着成本结构管理本身成为一项核心能力:把高并发实时任务留给提速方、把批量离线任务调度到谷段、把敏感数据留在本地开源模型。会算这笔账的人,将比单纯追求"最强模型"的人活得更久。(信源链接:腾讯新闻

📋 OPC城市圈与AI协同编辑

场景学社
OPC动态
扫码在手机上阅读 · 转载请注明出处与永久链接
© 2026 场景学社 保留所有权利