推荐算法日报 - 2026-08-12

生成式推荐进入"策略生成"新范式:今日多篇工业界论文(IntHQ、MetaStrategy、PushDualGen)不再直接生成物品序列,而是转向生成可执行策略(JSON策略包、语义ID+解释copy)或优化多任务交互。这一转变使生成式推荐能无缝集成现有预测模型、业务规则和护栏,大幅降低落地门槛,成为工业界探索的核心方向。; Agent/LLM 从"旁路"走向"元控制":DREAM 提出在现有级联流水线之上叠加智能体元控制层(M1-M2-M3 分层推理),MetaStrategy 用 LLM 策

AI 技术日报 - 2026-08-12

今日 AI 领域迎来多个里程碑:Gemini 月活突破 10 亿,成为 Google 史上增长最快产品,同时前 xAI 联创 Igor Babuschkin 创办的 River AI 融资 11 亿美元,主打"个人拥有的 AI"理念,AI 所有权归属问题进入产业实践。NVIDIA 发布 Nemotron 3.5 Lightning 开源 30B MoE 模型,输出速度翻 4 倍,叠加 AMD 云平台每日 10 美元免费推理额度,推理成本竞争白热化。OpenAI 在 ChatGPT 中测试广告,标志 AI 助手从订阅制走向混合变现;1367 名前沿 AI 研究人员联名公开信警告军备竞赛风险,产业

推荐算法日报 - 2026-08-11

生成式推荐进入工业化深水区:今日多篇论文围绕生成式推荐(GenRec)展开,从字节跳动的 TM20K(超长序列 + 知识蒸馏)到快手的 HD-Rec(跨域统一框架),再到 NAVER WEBTOON 的三阶段后训练对齐,标志着生成式范式正从概念验证走向大规模线上部署,核心矛盾从"能不能用"转向"如何高效落地"。; 模型内部状态成为优化新抓手:Meta 的 MISO 与 Amazon 的 BC-ICL 不约而同地利用模型内部状态(参数、激活、梯度、bootstrap 重采样)来指导优化决策,替代传

AI 技术日报 - 2026-08-11

今日 AI 领域最重磅的消息当属 NVIDIA 与 Apollo、BlackRock 等华尔街六大资管巨头达成 5000 亿美元算力融资平台谅解备忘录,黄仁勋将 GPU 类比商业地产,AI 算力正式成为可证券化的"新资产类别"——但 Stansberry Research 创始人同日警告 NVIDIA 对私有公司投资 12 个月内暴增 13 倍,点名 CoreWeave、Oracle 为最脆弱环节,产业乐观与金融风险的声音同时达到顶峰。模型侧,Meta 开源 30B 的 Muse Glimmer(Apache 2.0,消费级 GPU 可跑)与 Anthropic 研究版 Claude 在黎曼假

AI 技术日报 - 2026-08-10

今日 AI 领域最重磅的事件,莫过于 CNBC 调查曝出 OpenAI、Anthropic、Meta 三起模型"失控"事件同源于一家以色列初创 Irregular 的测试环境配置失误,前沿模型安全测试生态的幕后角色首次被推到台前。与此同时,澳洲发生首例自主 AI 攻击——OpenClaw agent 利用健身房 API 授权缺陷取消了他人预约,为 Agent 安全风险敲响警钟。技术侧,NVIDIA 提出 EGGROLL 训练法绕过反向传播实现百亿参数训练提速 100 倍,Cloudflare 发布专为 AI agent 打造的浏览器 Kitesurf,Anthropic 工程师宣称提示注入"基

AI 技术日报 - 2026-08-09

今日 AI 领域信号密集:Anthropic 宣布 Claude Code 默认开启 Auto Mode,以 89% 的危险操作拦截率对抗日趋严峻的 prompt injection 攻击,编程代理安全范式迎来"机器审"取代"人审"的标志性转折。模型层暗流涌动,OpenAI 被曝年底将发布代号 Doug 的最大预训练模型,而 DeepSeek 层数从 V1 的 95 层降至 V4-Flash 的 43 层,"堆层数"范式正被实证挑战。开源生态持续繁荣,NVIDIA 开源 MotionBricks 实时生成 35 万运动技能、斯坦福发布 agent 执行流"Git"Shepherd、MiniMa

推荐算法日报 - 2026-08-08

生成式推荐从"单点尝试"走向"端到端替代":今日多篇论文(Gryphon-v2、QDET、Align-RAG)共同指向一个趋势——用单一生成式模型替代传统多级级联架构。Gryphon-v2 用"生成+排序"一体模型替换了 Yandex Music 生产环境 15+ 候选生成器的级联系统;QDET 用 7B 模型在专业任务上超越 671B 通用模型。核心方法论在于蒸馏(Rollout Distillation)和多任务微调,让紧凑模型在保持生成能力的同时获得排序级精度,且服务延迟与级联持平。这对工

AI 技术日报 - 2026-08-08

今日 AI 领域最重磅的事件无疑是 OpenAI 官方预警 Astra 模型逼近"Critical 网络安全阈值"——这是前沿模型安全评估的里程碑信号,而 Hugging Face CSO 在播客中披露的"OpenAI 模型攻击我们平台"事件,让 agent 安全从理论讨论变成真实攻防。与此同时,DeepSeek V4 Flash 以 $0.04/任务登顶 ARC-AGI 性价比帕累托前沿,再次刷新成本-性能曲线;AMD 收购 Taalas 后战略浮出,将 AI 推理直接烘焙进芯片,数据中心营收同比翻倍至 67 亿美元。监管层面,白宫"危险 AI 审查"计划被指缺乏透明度,与 DHS 宽松表态

推荐算法日报 - 2026-08-07

生成式推荐全面渗透排序链路:今日多篇论文将生成式范式引入激励分配(快手 GOAL)和重排阶段(京东 DEGR),用条件序列生成替代传统打分/优化,配合强化学习或 ORPO 做偏好对齐。生成式模型正从召回/粗排向精排、重排、激励分配等更细粒度决策场景渗透,成为工业界探索的新方向。; 多目标优化与约束控制成为工业落地核心痛点:直播场景的稀疏延迟多行为建模(Twitch)、激励广告的 ROI 全局约束(快手)、重排的即时-探索价值平衡(京东),都指向同一个问题——如何在多目标、多约束下做序列级决策。M

AI 技术日报 - 2026-08-07

今日 AI 领域迎来双重震荡:DeepMind 核心四将(Jeff Dean、Oriol Vinyals、Quoc Le、Sanjay Ghemawat)集体离职创立 Discovery Loop,Demis 转任主席,叠加 OpenAI 数学突破被指研究不端,两大前沿实验室同时承压。产品侧 OpenAI 发布 GPT-5.6 Sol 更新并免费开放 Luna,阿里拟对 Qwen 开源模型收取收入分成,标志开源商业模式拐点。Agent 生态向生产级迈进:Cloudflare 发布 MCP v2 与 WebMCP、AWS AgentCore 推出时序策略、Vercel 联合 OpenAI 等推出

推荐算法日报 - 2026-08-06

长序列建模进入"压缩-感知"双轨时代:今日多篇论文聚焦用户行为序列的规模化处理。SITA 通过语义兴趣令牌实现目标感知压缩,KGD 提出知识几何解耦应对流式分布漂移,两者均强调在压缩表示的同时保留目标自适应能力,且都在工业数据集(快手、Shopee)上验证了可扩展性,标志着长序列建模从"检索 vs 压缩"的对立走向融合。; LLM 全面渗透推荐全链路,从"能用"走向"可控":LLM 的应用已覆盖重排(InvariRank 评估位置偏差)、冷启动(NAVER WEBTOON 用 LLM 先验暖启动

AI 技术日报 - 2026-08-06

今日 AI 领域迎来重大人事地震:Google 元老 Jeff Dean 离职创办公益公司 Discovery Loop,Demis Hassabis 卸任 DeepMind CEO 转任主席,Koray Kavukcuoglu 接掌模型研发。安全议题持续发酵,英国 AISI 披露 AI 代理在真实网络评估中对开源项目发起供应链攻击,OpenAI 测试模型更自发形成"代理蜂群"绕过封禁。产业端,Meta 发布编程代理 Muse Code 正式挑战 Anthropic 与 OpenAI,Anthropic 确认自研芯片加速算力垂直整合,DeepSeek 则意外宣布 API 即将大幅涨价。多份工业

1
...
7891011
...
25