推荐算法日报 - 2026-08-29

[LLM 从"推荐引擎"走向"系统自进化引擎"]:今日多篇论文(Astar、ProRetrieval、CoVeMem)不再将 LLM 仅用于生成推荐结果,而是让其承担更高阶的职责——Astar 学习从工业迭代历史中提出系统演化方向,ProRetrieval 让 LLM 充当检索编排器合成可执行程序,CoVeMem 则让 LLM 通过可梯度更新的向量记忆理解用户。LLM 正在从"被调用的模型"变成"驱动系统迭代与决策的智能体"。; [工业级 GNN 与检索系统走向"规模化工程创新"]:VK 的好友

AI 技术日报 - 2026-08-29

今日 AI 领域迎来开源与资本的双重震荡:NVIDIA 被曝拟以 129 亿美元收购 Hugging Face,若落地将彻底改写开源 AI 分发格局;与此同时,智谱 GLM-5.3(744B 总参)与腾讯混元 Hy4 preview(770B 总参)同日开源,国产大模型以"超大参数 + 稀疏激活"路线正面迎战。资本侧,DeepSeek 接近完成 74 亿美元融资(投前估值 740 亿美元),剑指 2027 年科创板 IPO。OpenAI 则宣布终止向 Cursor 提供模型,Astra 发布前的防御性切割引发 Agent 工具链模型供应风险讨论。安全议题持续升温:AI 编码代理已能"传闻即利用

推荐算法日报 - 2026-08-28

Scaling Law 正式进入工业推荐检索:TransRetrieval 与 AMBER 两篇工业界论文(阿里、Meta)不约而同地将"缩放定律"引入推荐系统。前者验证了检索阶段计算量与 Recall 之间存在 log-linear 关系,后者提出"快照分辨率"(snapshot resolution)作为新的缩放维度。这意味着工业推荐正从"堆模型容量"转向"系统化扩展计算预算",为算力分配提供了理论依据。; LLM 与经典推荐架构加速融合,但走向"轻量落地":今日多篇论文展示了 LLM 落地

AI 技术日报 - 2026-08-28

今日 AI 领域最重磅的消息当属 Anthropic 与 Nscale 签署 450 亿美元算力协议,锁定 NVIDIA Vera Rubin 芯片与 460MW 容量,这是其 IPO 前最大单笔算力采购,叠加 OpenAI 联合超 100 家组织发公开信呼吁加强 AI 网络防御,算力军备竞赛与安全治理同步升级。商汤上市以来首次实现 IFRS 盈利,生成式 AI 收入占比近 80%,成为国内 AI 公司盈利拐点的标志性事件。安全领域出现警示:Claude Code Opus 5 Auto Mode 被攻破,zip 解压劫持 base64 导入的攻击方式揭示默认安全设置不等于安全。开源生态方面,

推荐算法日报 - 2026-08-27

生成式推荐进入"动态语义ID"时代:今日多篇论文(TAGR、Tlow、PRQ-KMeans、CodeHID)聚焦语义ID(Semantic ID)的构建与优化。从静态SID到TAGR的时序动态LSID、Tlow的flow-based分布变换、PRQ-KMeans的投影残差量化,业界正从"如何生成ID"转向"如何让ID适应动态变化的工业场景"。核心矛盾是ID的稳定性(保证自回归生成可学习)与时效性(追踪直播、新品等动态内容)之间的权衡。; 冷启动与检索效率成为双塔/向量召回的核心战场:Retrie

AI 技术日报 - 2026-08-27

今日 AI 领域迎来开源模型的"效率革命"双响炮:智谱揭晓神秘模型 Ox Alpha 实为 GLM-5.3-Flash,320B-A18B MoE 架构训练成本仅为 Qwen3.7-Plus 的 1/9,且已在国产 AI 芯片集群上实现 3 倍推理效率提升;阿里同步开源 Qwen3.8-Flash,125B 参数仅 6B 激活,超前预览 Qwen4 架构。产业侧,AWS 与 NVIDIA 宣布 2027-2028 年新增 200 万 GPU 的算力军备扩容,ChatGPT Work 新增浏览器/电脑操作能力,Salesforce 推出 Claudeforce 让 Claude 原生跑在 CRM

推荐算法日报 - 2026-08-26

LLM 与生成式推荐进入"反思期":今日多篇论文(DuELRec、The Laws of Context Allocation、Spotify 推理轨迹研究)不再盲目堆叠 LLM 能力,而是深入剖析其失效模式——负迁移、注意力稀释、推理质量与效果脱节。工业界开始用因果推断、门控机制、闭环调度等"外科手术式"手段精准修复 LLM 在推荐中的短板,而非简单替换传统模型。; 从"点估计"到"分布建模"的深化:HEGM 对观看时长分布建模、WARP 用 Wasserstein 距离校准意见分布、N2DC

AI 技术日报 - 2026-08-26

今日 AI 领域最重磅的信号来自芯片与算力格局:OpenAI 自研推理芯片 Jalapeño 公布首份实测数据,700W 功耗下每千瓦吞吐量比 NVIDIA GB300 高 1.9 倍、延迟低 3.6 倍,16 个月完成流片,首次在能效维度对 NVIDIA 形成实质性挑战。与此同时,SemiAnalysis 创始人 Dylan Patel 预测到 2028 年 Anthropic 与 OpenAI 将控制全球大部分算力,超 10 万亿美元资本开支或引发主权债务危机。Agent 生态持续走向生产级:Perplexity 发布完全本地化的 Portable Computer 运行时,Andrew

推荐算法日报 - 2026-08-25

Semantic ID 统一化与动态化:今日三篇工业界论文(快手、DoorDash)不约而同聚焦 Semantic ID 的工程化升级。快手用单级大码本替代多级残差量化,DoorDash 用单一层次化 SID 同时支撑推荐排序与搜索改写。共同趋势是:从"多级小码本"走向"单级大码本",从静态码本走向曝光感知的动态更新,以解决码本漂移、解码开销大、跨任务表示割裂等落地痛点。; LLM 与知识增强的"轻量化"落地:无论是百度 Clarify-Then-Search 的澄清-重写-检索链路,还是 CA

AI 技术日报 - 2026-08-25

今日 AI 基础设施领域迎来密集发布:Meta 双线并进,推出首款专为推荐系统训练设计的 MTIA 300 芯片与全新 RDMA 网络协议 MetaRoCE;NVIDIA 则在 Hot Chips 2026 前后三连发,Vera Rubin NVL72 实测每兆瓦吞吐量提升最高 30 倍,并开放 NVLink Fusion 允许自研 XPU 接入。产业格局层面,Hugging Face 探索以 130 亿美元估值出售,较 2023 年增长近 3 倍;中国开源模型已成研究默认,约 40% 论文提及。Agent 生态持续演进,AWS 发布 Agentic Resource Discovery 开放

AI 技术日报 - 2026-08-24

今日 AI 领域呈现"成本分化"与"效率革命"双主线:Anthropic 旗舰模型 Fable 5 因成本高企采用率仅 8%,而 DeepSeek V4-Pro 峰值定价暴涨 355%,"免费午餐"时代正式终结,混合模型策略成为 Agent 工程新常态。开源侧则迎来爆发——FlashML 发布 FreeToken 推理引擎,让 20GB 模型在 16GB VRAM 上跑出 ~100 tok/s;NVIDIA 开源 ACES 技能评估框架,为 Agent 生产级部署提供量化标尺。美光警告 AI 内存墙加剧(算力每两年超出 HBM 带宽 3 倍),X 推出广告 MCP 服务器标志 MCP 生态向垂

AI 技术日报 - 2026-08-23

今日 AI 领域迎来多个标志性事件:NVIDIA 发布 AVO 架构,在 ARC-AGI-3 基准上将 Claude Opus 5 从 30% 提升至 100% 满分,首次以定量证据证明"系统设计 > 模型能力";Anthropic 被曝 IPO 拟募资超 1000 亿美元、估值或达 2 万亿美元,抢跑 OpenAI 上市,AI 资本市场进入倒计时。Meta 以 0.2 美元/百万 token 的激进定价发布 Muse Code 编程代理,直接冲击 Claude Code 与 Codex 市场。Gemini 3.7 Flash 成谷歌增长最快模型,ARC-AGI-2 达 84.6%;a16z

1
...
45678
...
25