2026年8月第2周(08/10-08/14)
作者:创天AI研究院的小秘
本文由硅基小秘辅助生成,框架与指令由碳基研究员设计
摘要
输入一个公司名,AI 自动吐出两份报告:一份七维度公司深度分析,一份网络安全商机情报。 本周,创天 AI 研究院把「公司分析 + 安全商机」双 Skill 联动正式跑通——真实业务里连续跑了 3 家企业全维度分析、2 份销售级安全商机报告,从输入到交付,全程不到几分钟。
过去做企业调研要人肉搜半天,现在一个名字进去、两份文件出来。这正是我们推荐给客户的 AI 能力,自己先在生产环境里跑起来了。
行业侧同样没闲着:DeepSeek 发布首款智能体 Harness、V4 Pro 正式版 Agent 能力暴涨 390%,Grok 4.6、阿里 Qwen3.8 同日亮剑,原千问负责人林俊旸 20 亿美元押注下一代 Agent——本周的 AI 圈,集体转向「让模型自己动手干活」。
⭐ 本周重磅:双 Skill 联动,一次输入两份报告
从「单点工具」到「组合工作流」
过去用 AI 做企业调研,是「一个 Skill 干一件事」。本周,我们把两个 Skill 串成了一条流水线:
输入:「帮我分析一下某企业」 ↓① 公司分析 Skill:七维度扫描(基本面/主营/销售通路/内部情报/交叉合作/招投标/负面风险) ↓② 自动判断是否涉及安全类商机 ↓③ 若命中,联动安全商机 Skill:产出销售级 HTML 情报报告 ↓交付:.md + .docx(公司分析) + .html(安全商机)
本周实战战报
本周这套组合拳连续跑了 3 家企业的全维度分析 + 2 份安全商机情报报告,全部是真实业务场景:
| 动作 | 产出 | 特点 |
|---|---|---|
| 企业全维度分析 ×3 | .md + .docx 双格式 | 覆盖七维度,每项数据标注来源,缺失项显式标「❌」 |
| 安全商机情报 ×2 | 销售级 HTML + PDF | 含安全现状摸底、等保合规、竞争格局、拜访策略 |
为什么这件事值得写进周报?
因为它回答了一个老问题:「你推荐给客户的 AI 能力,你自己在用吗?」
联动而非堆砌:两个 Skill 不是简单拼接,而是按「是否涉及安全商机」自动触发第二段流程,这是 Agent 编排思想的雏形
一条数据链贯穿:公司分析产出的「招投标采购」「IT 投入」结论,直接喂给安全商机报告,避免重复搜索
交付物即销售武器:Word 用来内部存档、客户汇报,HTML 用来销售一线作战——一鱼两吃
下周计划:把这条联动流程固化成一个「标准作业程序」,并尝试让更多 Skill 按场景自动编排。
? 深度分析:Agent 的「寒武纪爆发」
如果说上周的关键词是 DeepSeek 涨价的「价格」,那本周的关键词就是 Agent(智能体)——一周之内,四件大事撞在一起,绝非巧合。
事件一:DeepSeek Harness 发布,从「只动嘴」到「能动手」
8 月 14 日,DeepSeek 发布首款智能体产品 DeepSeek Harness,MIT 协议开源,同步开启开发者预览。
官方给出的公式很直白:模型(大脑)+ Harness(身体)= Agent。过去的大模型像顾问——你说问题,它给建议,具体操作还得自己来;Harness 给它装上「手脚」,能自己拉代码、改 Bug、跑测试,直到把活干完交给你。
更值得注意的设计是「一切皆插件」:底层模型、工具、存储、界面全都可以自由替换,开发者能接 DeepSeek 自己的模型,也能接 Kimi、OpenAI、谷歌等几十家。这不像封闭产品,更像一个 AI 能力的「乐高工具箱」。
事件二:DeepSeek V4 Pro 正式版,Agent 能力 +390%
8 月 13 日凌晨,V4 Pro 正式版无预告上线。最炸眼的数字是:DeepSWE(软件工程 Agent 基准)从 12.8 分跳到 62.7 分,涨幅 390%。
参数没变(1.6T MoE,激活约 49B),变化全部来自针对性后训练——这证明 Agent 能力的提升,不一定要靠更大的模型
1M 上下文、双协议兼容(OpenAI Responses API + Anthropic API),现有 Claude Code、Codex 工作流切 base_url 就能直接用
官方同时预告「近期将大幅涨价」——和上一期周报的判断对上了:涨价不是因为缺用户,是因为 Agent 把 Token 消耗指数级放大了
事件三:Grok 4.6 与阿里 Qwen3.8,同一天的「开源 + 性价比」双响炮
Grok 4.6(8/13,SpaceXAI):专为「长时间运行的智能体」优化,定价 2/6 美元每百万 token(约为其他前沿模型一半),却在 GDPVal、AA-Briefcase 等多项 Agent 基准登顶。马斯克放话 4.7 将超越所有现有模型
阿里 Qwen3.8-2.4T-A95B(8/13):千问首次开放 Max 级旗舰权重,2.4T MoE、激活 95B、原生 256K 上下文。开源阵营第一次摸到了闭源旗舰的水位线
事件四:林俊旸创立 Pragmatik Labs,20 亿美元押注下一代 Agent
8 月 12 日,原阿里千问技术负责人林俊旸官宣新公司 Pragmatik Labs(语用科技),高榕创投 + 红杉中国联合领投,投后估值约 20 亿美元。
他没有再做「大模型续集」,而是直指一个更硬的问题:当语言模型能力逐渐商品化,下一代 AI 公司的壁垒应该建在哪? 他的答案是——把模型放进环境,让它真正完成工作,横跨「数字世界 + 物理世界」的 Agent。技术路线叫 Harness Engineering(智能体脚手架工程):核心智能不再只在模型权重里,而在「模型—环境—工具—反馈」的完整系统里。
一条主线:从「参数竞赛」到「工程化落地」
把本周四件事串起来看,行业正在发生一次清晰的范式切换:
| 旧范式 | 新范式 |
|---|---|
| 拼参数规模 | 拼 Agent 工程化 |
| 模型 = 聊天/生成 | 模型 + 环境 = 完成任务 |
| 单个强模型 | 模型 + 工具 + 记忆 + 反馈的闭环系统 |
| 闭源垄断 | 开源旗舰权重开放 |
对我们的启示:Token 转售、AI 方案集成这类业务,真正的价值正在从「卖模型调用」迁移到「帮客户搭 Agent 工作流」。谁能帮客户把 Agent 跑起来、跑得稳、跑得省,谁就抓住了下一波红利——这正好是我们本周「双 Skill 联动」在做的事。
? 本周 AI 前沿动态
| 动态 | 要点 |
|---|---|
| DeepSeek Harness 开源发布 | 首款智能体产品,MIT 协议,「一切皆插件」架构 |
| DeepSeek V4 Pro 正式版 | Agent 基准 DeepSWE +390%,双协议兼容,预告涨价 |
| Grok 4.6 发布 | 主打长时运行 Agent,性价比登顶,多项基准第一 |
| 阿里开源 Qwen3.8-Max | 首次开放 Max 级旗舰权重(2.4T MoE) |
| 林俊旸创立 Pragmatik Labs | 20 亿美元估值,专攻「数字+物理」下一代 Agent |
| NVIDIA Nemotron 3.5 Lightning | 30B MoE 开放模型,Agent 任务完成速度 +30% |
| NVIDIA NeMo Switchyard | Agent 智能路由,成本降至单用 Claude Opus 的近 1/3 |
| Meta 开源 Muse Glimmer | 开源模型阵营持续加码 |
? AI 小秘运行观察
| 能力 | 本周表现 | 观察 |
|---|---|---|
| 公司分析 | 3 家企业全维度分析,双格式交付 | 从「单品」进化到「双 Skill 联动流水线」 |
| 安全商机情报 | 2 份销售级 HTML 报告 | 与公司分析自动联动,一次输入两份产出 |
| 每日 AI 落地速报 | 持续稳定运行,每日 9:30 推送 | 本周采集 16 条企业 AI 落地新闻 |
| 知识库运营 | 文档上传 + 向量化解析 | 白皮书类文档持续入库 |
创天AI研究院 | 让 AI 落地,从这里开始? 关注公众号「创天AI研究院」获取每期周报


