- 标签:
- 日报 (291)
- 推荐系统 (197)
- 技术趋势 (163)
- AI (159)
- 周报 (56)
- 论文 (34)
- 推荐 (9)
- 思考 (9)
- LLM (6)
- Agentic Engineering (5)
- 深度学习 (4)
- 工具 (3)
- Transformer (3)
- Harness Engineering (3)
- 强化学习 (1)
- 思维模型 (1)
- 管理 (1)
- 生成式 (1)
今日 AI 领域迎来开源与资本的双重震荡:NVIDIA 被曝拟以 129 亿美元收购 Hugging Face,若落地将彻底改写开源 AI 分发格局;与此同时,智谱 GLM-5.3(744B 总参)与腾讯混元 Hy4 preview(770B 总参)同日开源,国产大模型以"超大参数 + 稀疏激活"路线正面迎战。资本侧,DeepSeek 接近完成 74 亿美元融资(投前估值 740 亿美元),剑指 2027 年科创板 IPO。OpenAI 则宣布终止向 Cursor 提供模型,Astra 发布前的防御性切割引发 Agent 工具链模型供应风险讨论。安全议题持续升温:AI 编码代理已能"传闻即利用
今日 AI 领域最重磅的消息当属 Anthropic 与 Nscale 签署 450 亿美元算力协议,锁定 NVIDIA Vera Rubin 芯片与 460MW 容量,这是其 IPO 前最大单笔算力采购,叠加 OpenAI 联合超 100 家组织发公开信呼吁加强 AI 网络防御,算力军备竞赛与安全治理同步升级。商汤上市以来首次实现 IFRS 盈利,生成式 AI 收入占比近 80%,成为国内 AI 公司盈利拐点的标志性事件。安全领域出现警示:Claude Code Opus 5 Auto Mode 被攻破,zip 解压劫持 base64 导入的攻击方式揭示默认安全设置不等于安全。开源生态方面,
今日 AI 领域迎来开源模型的"效率革命"双响炮:智谱揭晓神秘模型 Ox Alpha 实为 GLM-5.3-Flash,320B-A18B MoE 架构训练成本仅为 Qwen3.7-Plus 的 1/9,且已在国产 AI 芯片集群上实现 3 倍推理效率提升;阿里同步开源 Qwen3.8-Flash,125B 参数仅 6B 激活,超前预览 Qwen4 架构。产业侧,AWS 与 NVIDIA 宣布 2027-2028 年新增 200 万 GPU 的算力军备扩容,ChatGPT Work 新增浏览器/电脑操作能力,Salesforce 推出 Claudeforce 让 Claude 原生跑在 CRM
今日 AI 基础设施领域迎来密集发布:Meta 双线并进,推出首款专为推荐系统训练设计的 MTIA 300 芯片与全新 RDMA 网络协议 MetaRoCE;NVIDIA 则在 Hot Chips 2026 前后三连发,Vera Rubin NVL72 实测每兆瓦吞吐量提升最高 30 倍,并开放 NVLink Fusion 允许自研 XPU 接入。产业格局层面,Hugging Face 探索以 130 亿美元估值出售,较 2023 年增长近 3 倍;中国开源模型已成研究默认,约 40% 论文提及。Agent 生态持续演进,AWS 发布 Agentic Resource Discovery 开放
今日 AI 领域呈现"成本分化"与"效率革命"双主线:Anthropic 旗舰模型 Fable 5 因成本高企采用率仅 8%,而 DeepSeek V4-Pro 峰值定价暴涨 355%,"免费午餐"时代正式终结,混合模型策略成为 Agent 工程新常态。开源侧则迎来爆发——FlashML 发布 FreeToken 推理引擎,让 20GB 模型在 16GB VRAM 上跑出 ~100 tok/s;NVIDIA 开源 ACES 技能评估框架,为 Agent 生产级部署提供量化标尺。美光警告 AI 内存墙加剧(算力每两年超出 HBM 带宽 3 倍),X 推出广告 MCP 服务器标志 MCP 生态向垂