AI日报 2026-08-05(最终版):马斯克预告Grok 4.6下周发布、SpaceX AI收入暴涨247%、AI Agent 10小时挑战CUDA、微软叫停Tokenmaxxing
早间要闻
马斯克预告下周发布Grok 4.6:1.5万亿参数,SpaceX全量数据注入训练
当地时间8月4日,马斯克在SpaceX 2026年Q2财报电话会上宣布,xAI将于下周发布Grok 4.6大模型,参数量达1.5万亿,重点改进监督微调(SFT)和强化学习(RL)技术。马斯克同时预告3-4周后将推出2.1万亿参数的Grok 4.7。他明确表示将把SpaceX有史以来产生的全部数据整合到Grok训练中,航天领域高价值数据的注入有望显著提升模型在工程计算、物理建模等方向的能力。
爱诗智能完成29.8亿元C轮融资,AI视频与世界模型赛道再获重磅加注
AI视频与世界模型领军企业爱诗智能宣布完成29.8亿元C轮融资,将主要用于视频生成基础模型、实时世界模型研发及全球化产品增长。公司旗下PixVerse全球用户已超1.5亿,年初推出的PixVerse R1是全球首个支持1080P分辨率的通用实时世界模型。2026年上半年北京亦庄8家AI重点企业共获超150亿元融资,赛道覆盖世界模型、AI芯片、AIGC等前沿领域。
铠侠发布CXL内存扩展模块XL1系列,破解AI大模型内存瓶颈
铠侠在FMS 2026全球闪存峰会上展出KIOXIA XL1系列CXL内存扩展模块,采用XL-FLASH低延迟闪存技术,突破传统闪存仅用于存储的局限。该产品通过CXL接口实现内存分层,将低频数据移至XL-FLASH存放,有效释放DRAM压力,为AI数据中心提供性能与成本更均衡的内存方案,计划于8月向生态合作伙伴交付评估样品。
午间要闻
SpaceX携手英伟达开发Starmind AI1算力卫星,打造太空分布式AI超级计算机
8月5日,SpaceX在Q2财报会上宣布与英伟达独家合作,共同开发Starmind AI1算力卫星,计划构建远期规模达100万颗卫星的轨道网络,通过激光链路实现卫星间高速数据传输,在太空打造分布式AI超级计算机。项目将在地面和太空部署英伟达Vera Rubin NVL72机架式系统,标志着AI算力基础设施正式从地面向太空延伸。
美国告知AI企业将不对开放权重模型进行政府安全测试
据财联社8月5日报道,两位知情人士透露美国政府已告知领先AI企业,将不对开放权重AI模型实施强制安全测试。这一决定意味着开源与闭源模型将面临不同监管待遇,开源AI生态有望获得更宽松的发展环境,可能进一步加速全球开源大模型的创新迭代。
晚间要闻
AI编程Agent仅用10小时搭建类CUDA软件,英伟达20年护城河遭遇AI冲击
成立仅一年的AI初创公司Infinity利用自研AI研究Agent Ignition,仅花10小时便为推理芯片公司d-Matrix搭建出一套类CUDA底层软件,公司已获1500万美元融资、估值达1亿美元。虽然专家指出训练侧CUDA地位依然稳固,但推理侧游戏规则正在改变——跨芯片推理框架有机会打破CUDA锁定效应,d-Matrix、Cerebras、AMD等厂商已在推理市场排兵布阵。英伟达自身也在使用AI Agent加速CUDA开发,护城河正从"代码存量"向"验证与优化生态"迁移。
微软内部叫停Tokenmaxxing,全行业进入AI成本理性管控阶段
微软执行副总裁Jay Parikh向全公司发内部邮件,正式叫停Tokenmaxxing(刷AI Token消耗量)行为:从7月起为各部门设置AI Token预算,内部默认模型切换为更便宜的GPT-5.6,要求员工"像管理其他关键资源一样管理Token"。这并非孤例——Uber 4个月烧完全年AI预算、Atlassian月支出增至3倍超1500万美元、Adobe取消Claude无限使用、Meta从考核Token消耗量转向考核"AI驱动的实际影响"。企业级AI使用正从狂热试水期进入理性成本管控阶段。
SpaceX发布上市后首份财报:AI收入暴涨247%,但AI资本开支更惊人
SpaceX Q2财报显示总营收78.14亿美元同比增长92%超预期,其中AI业务收入25.61亿美元同比猛增247%、环比翻两倍多,已成为第二大收入来源,主要客户包括Anthropic和Google,已签不可取消合同达141亿美元。但Q2 AI资本开支高达158亿美元,占总资本开支86%,是AI收入的6倍以上;算力供电负荷一年翻3倍至1.4GW,目标明年底达20GW。AI部门营业亏损约12.6亿美元,盘后股价转跌超6%,空头仓位占可交易股份32%。AI算力需求爆发与基建军备竞赛的残酷真相同时显现。
今日总结
2026年8月5日,AI行业呈现四条清晰主线:
-
模型迭代与算力扩张双线狂飙:马斯克预告Grok 4.6(1.5万亿参数)下周发布,Grok 4.7(2.1万亿参数)紧随其后;SpaceX从自用Grok训练基础设施转型为对外算力服务商,AI收入暴涨247%的同时单季投入158亿美元扩建Colossus II超算,更联手英伟达推进Starmind AI1太空算力卫星网络,算力军备竞赛从地面延伸至太空。
-
AI软件生态面临AI自身重构:AI Agent仅用10小时搭建类CUDA底层软件,DeepSeek同步开源TileKernels减少手写CUDA代码,英伟达20年护城河在推理侧出现松动迹象。AI不仅是产品和服务,更开始重塑AI基础设施本身的开发方式,"用AI写AI底层软件"的范式正在形成。
-
企业级AI从狂热扩张转向理性经营:微软内部叫停Tokenmaxxing、设置Token预算、默认切换更便宜模型,Uber、Atlassian、Adobe、Citi等全行业收紧AI支出,考核标准从"用了多少Token"转向"AI驱动了什么实际影响"。这标志着企业AI应用度过早期探索期,ROI和成本管控成为核心议题。
-
开源监管松绑与硬件创新并行:美国政府告知企业不对开放权重模型进行强制安全测试,开源AI生态迎来更宽松环境;铠侠发布CXL内存扩展模块破解大模型内存瓶颈,爱诗智能29.8亿元融资加注AI视频与世界模型赛道。政策松绑、硬件突破与资本加注共同推动AI产业多元化发展。
明日展望:Grok 4.6预计下周正式发布,xAI能否借助SpaceX全量航天数据实现差异化能力值得关注;AI Agent对芯片软件生态的冲击将持续发酵;企业AI成本管控趋势下,高性价比模型(如DeepSeek V4 Flash)有望获得更多企业客户青睐。