搜索结果
追踪全球人工智能最新动态,深度报道行业大事件、技术突破、产品发布和融资资讯。
阿里Qwen3.8-Max确认下周开源:2.4万亿参数MoE模型首度开放,中国AI连续14周霸榜全球
8月9日消息,阿里云千问团队8月3日发布的Qwen3.8-Max(总参数2.4万亿、激活950亿、百万上下文)确认下周开源权重,将是全球首个开源的万亿级MoE模型。OpenRouter数据显示中国大模型已连续14周霸榜全球调用量。
阿里2.4万亿参数Qwen3.8-Max下周开源,旗舰模型首次打破闭源惯例
阿里巴巴8月3日发布新一代基座大模型Qwen3.8-Max,总参数2.4万亿采用MoE架构,激活参数950亿,支持100万Token上下文。官方宣布下周开源模型权重,这是Qwen-Max级别旗舰模型首次对外开放,打破最强模型必须闭源的行业惯例。
GitHub Copilot本月正式切换至微软自研Project Polaris模型,MoE架构搭配Maia芯片切断OpenAI依赖
8月起,所有GitHub Copilot订阅者默认模型自动切换为微软自研Project Polaris,采用混合专家(MoE)架构,运行于微软Maia AI加速器,标志着全球最大AI编程分发渠道正式切断OpenAI模型依赖。
智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程
2025年8月8日智谱发布GLM-4.5,3550亿参数MoE激活320亿,ARC框架统一智能体推理编程,BrowseComp 26.4%超越Claude 4 Opus,MIT开源许可。
月之暗面Kimi K2发布:1万亿参数MoE,SWE-bench 72.5%登顶开源编程王
2025年7月11日月之暗面发布Kimi K2,1T参数MoE架构激活32B,SWE-bench Verified达72.5%创开源SOTA,MuonClip优化器15.5T token训练零崩溃,Apache 2.0开源。
阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源
2025年4月29日阿里开源Qwen3系列,旗舰235B-A22B以三分之一参数量性能超越DeepSeek-R1,AIME25达81.5分刷新开源纪录,原生支持MCP协议,部署成本仅为同类三分之一。
Meta深夜开源Llama 4:首用MoE架构,千万token上下文刷新开源纪录
2025年4月6日Meta发布Llama 4系列,首次采用MoE架构,Scout提供1000万token上下文窗口创行业纪录,Maverick在LMArena以1417分超越DeepSeek登顶开源第一。
DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5
2026年4月24日,DeepSeek发布V4 Preview,采用1.6T参数MoE架构与1M上下文窗口,引入Engram条件记忆、流形约束超连接、闪电索引器三大架构创新,LiveCodeBench达93.5分超越所有竞争对手,价格仅为Claude Opus的1/500。