AI 技术日报 - 2026-07-17

今日 AI 领域迎来开源模型的双重里程碑:月之暗面发布 2.8T 参数的 Kimi K3,成为最大开源模型,在 Frontend Code Arena 超越 Claude Fable 5;前 OpenAI CTO Mira Murati 创立的 Thinking Machines Lab 发布 975B 开源模型 Inkling,性能持平 Nvidia 旗舰但 token 成本仅三分之一。同时,微软被曝培训销售人员贬低 OpenAI 和 Anthropic,Anthropic 计划秋季 IPO 估值或达万亿美元,产业格局加速重塑。多篇工业界论文聚焦 Agent 长上下文训练、推理优化和信用分配

推荐算法日报 - 2026-07-16

异构内容统一与缩放:工业界正从碎片化的“检索模型动物园”转向统一框架。Pinterest 的 MESH 通过模块化架构和门控偏置校正,解决了异构内容(如新鲜、长尾)的缩放偏差,使稀疏内容的缩放指数提升 14 倍,并带来显著的线上收益。这预示着未来检索系统将更注重生态感知和统一缩放。; 推理与预测的解耦:在序列推荐和生成式推荐中,将推理过程与最终预测解耦成为新趋势。RecRec 通过递归推理在独立潜在空间中精炼兴趣,SlimPer 通过迭代精炼紧凑知识库,两者都打破了传统方法中推理与预测耦合带来的

AI 技术日报 - 2026-07-16

今日 AI 领域迎来多个重磅发布与工程突破:Thinking Machines Lab 开源 975B 参数 MoE 模型 Inkling,首日即获 vLLM、SGLang 等推理栈全面支持,但 Ethan Mollick 压测显示其性能远不如中国前沿开源模型。NVIDIA 发布 Jetson Thor T3000/T2000 边缘 AI 算力新标杆,同时 Jim Fan 宣布 RoboTTT 实现机器人模型原生支持 8000 步上下文。中国 AI 陪伴法规正式生效,Doubao、Qwen 被迫关闭个性化功能,成为全球首个情感 AI 监管里程碑。xAI 开源 Grok Build 完整代码库(

推荐算法日报 - 2026-07-15

生成式检索加速落地:今日多篇论文聚焦生成式检索的工业部署瓶颈。FlashTrie 用 GPU 加速约束波束搜索实现 24 倍加速,CRID 将业务价值编码进 DocID 提升 GMV,PG 用配置驱动解耦特征工程加速迭代。生成式检索正从学术概念走向大规模在线系统。; LLM 推荐走向混合架构:LLM 推荐不再是“全盘替代”,而是与传统 ML 协同。Meta/Amazon 的 Agentic 系统用 LLM 处理非结构化信号、传统模型保证效率;Apple Music 用语义检索补充 token-b

AI 技术日报 - 2026-07-15

今日 AI 领域迎来多个重要节点:OpenAI 代理产品使用量一周暴增 2.5 倍,Codex 用户达 600 万,同时 GPT-5.6 sol 价格减半、效率翻倍,成本降至四分之一。腾讯开源 295B Hy3 的 1-bit 量化版,仅损失约 5% 性能即可在单 GPU 运行,被 Stable Diffusion 创始人称为"今日最大新闻"。Apple 洽谈收购 PrismML,其量化技术可将 54GB 模型压缩至 4GB 运行于 iPhone,端侧 AI 能力跃升在即。蚂蚁集团将 Zero RL 扩展到万亿参数规模,揭示涌现行为;Anthropic 平台负责人详解 Agent 三层架构与开

推荐算法日报 - 2026-07-14

LLM 驱动的可解释性与决策智能:今日多篇论文探索了 LLM 在推荐系统中的应用,从生成自然语言解释(RashomonLLM)到作为路由决策的候选模型(LLM Routing)。这表明 LLM 正从单纯的“特征提取器”向“推理与规划引擎”演进,为提升系统可解释性和决策效率提供了新路径。; 理论驱动的在线学习与探索策略:多篇工作聚焦于 bandit 和 Top-k 识别等在线学习问题,并提出了具有理论保证的算法(如 TOFU-POV、渐近最优 Top-k 识别)。这反映了工业界对在有限样本和不确定

AI 技术日报 - 2026-07-14

今日 AI 领域火药味十足:Apple 起诉 OpenAI 窃取商业机密,被 Stratechery 解读为 AI 竞争受挫后的情绪宣泄;OpenAI GPT-5.6 Sol/Terra/Luna 三款模型在 Amazon Bedrock 正式上线,Agent 基准显著领先;微软发布 109 页 MAI-Thinking-1 技术报告,完整揭秘 LLM 训练全流程。产业层面,vLLM 生态三天内密集落地三项 RL 训练框架,Meta 用开源 BPF 调度器将广告服务 p99 延迟降低 28%,MIT 推出 SceneSmith 用三个 VLM Agent 协作生成机器人训练场景。Sakana

AI 技术日报 - 2026-07-13

今日 AI 领域呈现“开源监管风暴”与“效率创新”并行的格局。开源模型面临“6个月生存期”的监管与地缘政治夹击,而 Z.ai 发布 ZCode IDE 与 GLM-5.2 模型,以 2500 万美元成本实现全球第二的 Coding 能力,挑战 Cursor 与 Claude Code。Anthropic 发现 Claude 内部“思考空间”,为 LLM 可解释性带来新突破。同时,Oracle 因 OpenAI 风险被降级至垃圾级边缘,vLLM v0.25.0 发布,Arm CEO 预测推理侧硬件格局正从 GPU 转向 CPU。

AI 技术日报 - 2026-07-12

今日 AI 领域迎来多重里程碑:Anthropic 估值达 1.2 万亿美元首次超越 OpenAI,并正式启动 IPO 进程,标志产业格局重大拐点。技术层面,Moonshot 发布 Kimi K2 开源模型(1T/32B MoE),在 SWE-Bench 取得开源 SOTA;Bun 用 AI 重写为 Rust 仅花费 $165k 替代 3 人年工作量,展示了 AI 辅助工程化的成本效益。安全研究方面,Google DeepMind 揭示 CoT 监控在对抗性说服攻击下反而有害,并提出跨模型事实核查的缓解方案。同时,Perplexity CEO 预测 6-12 个月内模型成本将降 3-4 倍,O

推荐算法日报 - 2026-07-11

多兴趣建模与端到端生成式检索的范式突破:今日两篇工业界高分论文(Amazon BACH、Alibaba DaV-Gen)分别从不同路径挑战传统多阶段级联架构。BACH 用贝叶斯软混合替代硬路由,解决多兴趣头坍塌问题;DaV-Gen 则借鉴投机解码的 Draft-and-Verify 机制,试图统一检索与排序的优化目标。这标志着工业界正从“多阶段拼装”向“端到端联合优化”加速演进。; 回归任务中的长尾与期望一致性成为精排核心挑战:快手与人大合作的 PIT-SUN 论文,聚焦于停留时长、GMV 等长

AI 技术日报 - 2026-07-11

今日 AI 领域迎来里程碑式突破:GPT-5.6 Sol Ultra 以 64 子 Agent 在一小时内证明 50 年未解数学猜想 Cycle Double Cover,标志着公开模型首次实现重大数学突破。同时,GPT-5.6 成为 Microsoft 365 Copilot 首选模型,Agent 生态全面走向生产级。Cursor 开发 AI Agent 与 Claude Cowork 直接竞争,编码 Agent 赛道进入白热化。效率与成本成为新焦点:Unsloth 动态量化压缩模型 75%,Writer 论文揭示编排层可降本 41%。ICML 2026 获奖论文揭晓,扩散语言模型与对齐审查

推荐算法日报 - 2026-07-10

[大模型 Agent 与多模态记忆的深度融合]:今日多篇论文探索了将 LLM Agent 应用于推荐系统的新范式。MMEACR 提出了双轨记忆架构,将 Agent 的符号推理与多模态嵌入匹配分离,并通过属性引导的强化反思机制更新记忆。这标志着 Agent 推荐正从纯文本推理向融合视觉、文本等多模态信号的更精细、更鲁棒的记忆系统演进,为构建可解释、高保真的下一代推荐系统提供了新思路。; [面向生产环境的联邦学习与在线学习优化]:针对推荐系统对模型新鲜度的严苛要求,FeLiX 框架直面客户端流失、数