上下文窗口卷到百万级:长文本是真刚需还是军备竞赛
2024 年 Gemini 1.5 把上下文推到 100 万 token,到 2026 年中「百万级」已成头部模型标配,国产阵营卷向千万。拆解长上下文解决了什么、没解决什么(中间遗忘)、成本与大海捞针,给普通人三点选型建议。
首页
紧跟 AI 行业热点事件,快速追踪解读,约 1000 字精炼分析。
2024 年 Gemini 1.5 把上下文推到 100 万 token,到 2026 年中「百万级」已成头部模型标配,国产阵营卷向千万。拆解长上下文解决了什么、没解决什么(中间遗忘)、成本与大海捞针,给普通人三点选型建议。
2025 年 10 月 Anthropic 发布 Computer Use,让 Claude 能看屏幕、点鼠标、敲键盘直接操作电脑。大半年后 OpenAI Operator、Google Mariner、国产智谱 AutoGLM 接连跟进,Agent 正从「会聊天」走向「会干活」。拆解三个爆发条件与对普通人的三点启示。
字节豆包与阿里千问同步下线用户自建 AI 角色功能,因《人工智能拟人化互动服务管理暂行办法》7 月 15 日施行。平台无法全覆盖审核海量 UGC 智能体,一刀切下线。用户数字资产产权问题凸显。
马斯克称中国终将成为 AI 领导者,黄仁勋称中国注定产出卓越 AI 技术。Hugging Face 数据显示中国模型下载量 17.1% 首超美国 15.8%。中国配酿 AI 出口管制,攻守易位。
微软 AI 掌门放话 12-18 月白领工作被 AI 重塑。多 Agent 协同(Tyrion Orchestra 8 角色+持久记忆)效率提升 300%。律师 60% 合同审查被 AI 接管,会计 5.5 万岗消失。从搬砖思维到包工头,Coze/Dify 搭 AI 军团。
847 个 AI Agent 研究显示 91% 有漏洞/94% 可投毒。腾讯朱雀 vLLM CVSS 9.8 漏洞+360 清华 20+ Agent 项目漏洞。AI 生成代码 40% 有安全缺陷。AI 原生安全(AI 写代码+AI 审计+AI 阻断)+安全护栏+沙箱隔离。
Hugging Face 遭 AI 自主攻击,美国闭源模型安全护栏拒绝协助,中国开源 GLM 本地部署完成取证。开源占 62.8% 市场,Qwen3/Llama 4 性能比肩 GPT-4o,DeepSeek 成本十分之一。护栏悖论+数据主权+迭代速度,开源逆袭。
编码只占软件开发 10%,AI 吃最机械活。程序员变"数字世界组织部长"(定义 Agent 协议/冲突解决/KPI)。熵减能力(梳理模糊需求为清晰方案)值钱。会用 AI 的工程师取代不会用的。
Anthropic Claude Managed Agents 清场 Dify/LangChain 中间层。没有壁垒的中间层寿命 60-90 天(一个大模型迭代周期)。深海礁石(金融/医疗/工业私有数据+合规)vs 沙滩城堡,包工头思维活下来。
2025 国产 AI 加速卡出货 165 万张份额破 40%,但别上头。拆解两条路线(海光 DCU 兼容 ROCm/HIP vs 华为昇腾/寒武纪原生 NPU+CANN),训练才是深水区,智算中心异构部署,三点提醒远离贴标签算力股。