From Next-One to Next-N:这才是推荐系统的范式改变

推荐系统 20 年来方法换了六七轮,但问题定义从未改变——始终是预测下一个 item。缺多样性、缺发现性、规则泛滥,根源都在这里。真正的范式改变不是换方法,而是重新定义问题:从 Next One 到 Next N。

生成式推荐 (Generative Recommendation) 工业界深度 Survey

覆盖 101 篇核心论文(58 篇工业界 + 43 篇学术精选),系统梳理 2022-2026 年生成式推荐从学术概念到工业主流范式的完整技术演进。以 TIGER、HSTU、OneRec 等里程碑论文为核心,深入分析 Semantic ID、模型架构、训练范式、推理增强、长序列建模等关键技术方向。

2026:推荐系统 All-In Transformer 的元年

2017 年,Ilya Sutskever 读到《Attention Is All You Need》时,立即意识到”这就是我们需要的一切”。OpenAI 随即放弃了 RNN/LSTM 路线,全面转向 Transformer,催生出整个 GPT 系列。Transformer 的并行能力让他们得以实现一直相信的 Scaling 路径。八年后的今天,推荐系统终于走到了同样的路口。 2024 年之前,推荐领域有了 HSTU、TIGER 这样的工作,但大多数团队还在观望。2025 年,我观察到一个明显的转变:大家开始认真地把排序模型 Dense Scaling Up,搞生成式召回和端到端推荐。这很像 2017 年——当时大家忙着把 LR/GBDT/FM 切换到 Deep Model 和双塔,切换过程持续了一两年,之后再没人回头。我的判断是,2026 年将是推荐系统 All-In Transformer 的一年,不改变就落后。

AI 技术日报 - 2026-08-20

今日 AI 领域围绕"隐私安全"与"Agent 工程化"双主线展开。OpenAI 预览 Private Safety Processing,试图调和 Zero Data Retention 承诺与跨交互安全监控的矛盾,正面回应 Anthropic 的企业客户隐私优势;同时 CFO 确认 2027 年上市时间表,商业化路径进一步清晰。开源侧,Ornith-1.5 以自改进策略训练发布三档模型,比肩 Claude Opus 4.8;Qwen3.8-27B 发布 4 天登顶 Cline 本地模型榜首。地缘政治层面,美国出口管制漏洞曝光——中国 AI 公司借道东南亚远程租用 Nvidia 算力,RAS

AI 技术日报 - 2026-08-19

今日 AI 领域动作密集:OpenAI 罕见暂停部分前沿 RL 训练,CEO Sam Altman 与首席科学家 Jakub Pachocki 公开表态"安全信心将越来越决定 AI 进步速度",并签署 Pacing the Frontier 协调倡议。模型竞争白热化,智谱发布 GLM-5.3,Intelligence Index 60 分持平 Kimi K3,agentic Elo 跃至 1770 仅次于 Claude Opus 5;DeepSeek 开源 harness 却遭独立复测分数争议,较官方低 9-33 分。产业资本端,Anthropic 营收 run rate 突破 $65B 并密

AI 技术日报 - 2026-08-18

今日 AI 领域迎来基础设施层的标志性并购:Stripe 以 70 亿美元收购 OpenRouter,模型路由层价值重估,AI 聚合时代开启。与此同时,LiteLLM 供应链攻击波及 2,500+ 公司、434,000 条 CI/CD 管道,成为 2026 年最大 AI 供应链安全事件。NVIDIA 为 OpenAI 提供 4.25 吉瓦 AI 工厂算力,20 年 6000 亿美元算力承诺揭示约束已从芯片迁移到电力。模型侧,Grok 4.6 在 Agentic 指数并列第一且成本仅为 Claude 的 1/4,Qwen3.8-27B 被列为首个达前沿水平的本地模型,消费级硬件跑出超 100 t

AI 技术日报 - 2026-08-17

今日 AI 领域迎来商业化拐点信号:Anthropic 首次实现盈利并秘密提交 IPO,OpenAI 企业收入首超个人客户,两大头部实验室同时进入"用收入说话"的新阶段。技术侧,Stripe 拟超 70 亿美元收购 OpenRouter,DeepSeek 开源 deepseek-harness 编码 Agent 框架并发布超连接约束新论文,清华与 ByteDance 联合开源 CUDA Agent 实现 GPU 内核自动编写。开源小模型生态持续升温,Qwen3.8-27B 本地运行实测引发广泛讨论,8GB 显卡即可跑满 64k 上下文。

AI 技术日报 - 2026-08-16

今日 AI 领域呈现"开源生态爆发 + 自主 Agent 能力质变"的双主线格局。Qwen 开源模型全球下载量突破 30 亿登顶世界第一,Qwen3.8-27B 上线即获社区热捧;X 开源 For You 推荐算法并公布排名权重,马斯克亲自转发。Agent 自主性迎来里程碑:Grok 4.6 连续 48 小时无间断构建射击游戏,Prime Intellect 完成最大规模开源自主 AI 研究实验。成本效率竞争白热化,DeepSeek Pro V4 Max 以 $23 完成 Rust 重写挑战,仅为 Fable 成本的 4%。监管与对齐辩论升温,Dario Amodei 长文回应"监管即权力集中

AI周报 2026-W33

这一周几乎是模型发布周。8/11-8/12 的 Frontier Model Day 前后,xAI、Alibaba、DeepSeek、智谱、Google 在三天内扎堆上新,加上 8/14 的 Cursor 收购,构成了 2026 年至今密度最高的一周。单看模型侧,Grok 4.6(Artificial Analysis 评测)拿下 61 的 Intelligence Index,Qwen3.8-2.4T-A95B 开源,DeepSeek V4 Pro 以 MIT 许可发布,GLM-5.3 上线,Gemini 3.7 Flash 紧随其后。每条单独拎出来都是季度级事件,集中在五天内发生,说明迭代节奏已经从"季度发布"压到了"周级"。 值得注意的第二条线:效率成了这一轮竞争的主轴。Grok 4.6 定价 $2/$6,cache hit 降到 $0.5;Gemini 3.7 Flash 的 intro 价格是 3.6 的一半;OpenAI 预告了 Ultrafast 档位,把 GPT-5.6 Sol 推到 750 tokens/秒。头部模型在智力差距缩小的前提下开始拼单位成本——方向跟 2025 年完全一致,但这周的密度罕见。 第三条线是 Agent 基础设施的整合。Cursor 被 SpaceX 收购加入 SpaceXAI,vLLM 一周内为五个新模型提供 day-0 支持,Agent 的"交付层"和"编排层"都在快速收敛。下面分主题展开。

AI 技术日报 - 2026-08-15

今日 AI 领域迎来多重震荡:SpaceX 正式收购 Cursor 并将其并入 Grok 开发团队,标志马斯克系在 AI 应用层的激进整合;GLM-5.3 以 750B 参数在编码与网络防御基准上登顶开源模型,Interconnects 深度分析称其"不是蒸馏故事";Qwen3.8-27B 以 Apache 2.0 开源并获 vLLM、SGLang、Unsloth 日 0 支持,单卡 RTX 5090 可达 206 tok/s。与此同时,OpenAI IPO 前高管流失潮引发治理担忧,美国数据中心 1066 吉瓦电力申请中仅 28% 可能落地,算力扩张的物理瓶颈与人才流动成为产业隐忧。Anth

AI 技术日报 - 2026-08-14

今日 AI 领域迎来密集发布与资本震荡:Google 发布 Gemini 3.7 Flash,价格腰斩且编码基准大幅提升,OpenAI 同步推出 Ultrafast 服务档位将 GPT-5.6 Sol 提速 14 倍,前沿模型竞争从"能力"转向"速度与价格"双线作战。xAI 宣布 2027 年数据中心容量扩至 10GW、目标 5000 亿美元营收,而 Q2 美国风投 87.5% 流向 AI 创历史最悬殊,资本集中度信号强烈。基础设施层面,MCP 规范转向完全无状态、Scale AI 发布 MCP-Atlas 基准、AWS 推出 AgentCore Browser Tool,Agent 工具调用

AI 技术日报 - 2026-08-13

今日 AI 领域迎来"Frontier Model Day"级别的密集发布:xAI 推出 Grok 4.6(1.5T 参数),以 $2/$6 每百万 token 的定价逼近 GPT-5.6 Sol,同时 Qwen3.8-Max(2.4T 总参/95B 激活)开源登场,DeepSeek V4 Pro 0813 悄然上线,效率与价格成为新战场。Anthropic Frontier Red Team 发布多 Agent 系统实证研究,发现协调式 swarm 漏洞发现量 12 倍于独立并行;OpenAI 企业报告显示前沿企业输出 token 达普通企业 8.3 倍,Codex 在法务/销售增长超 40