Asta Lab · 全栈情报站AI FULL-STACK INTELLIGENCE每日 · 全栈 · 精选

AstaNews

AI 全栈每日情报

开放生态全景:Cohere Command A+ 218B Apache 2.0、NVIDIA LatentMoE、Poolside Laguna

同一周内三家机构发布大型开放权重模型,标志着开放模型生态正在经历一轮集中扩张。每个发布背后的逻辑和目标受众有所不同,值得分开看。 Cohere Command A+ 218B 是这批发布中商业许可最友好的一个。218B 总参数、25B 激活参数的 MoE 架构(218B-A25B),Apache 2.0 授权意味着可以自由商用、修改和再分发,无需向 Cohere 支付许可费。相较于 Llama 系列的 Meta 自定义协议,Apache 2.0 在法律清晰度上更高。Cohere 以 RAG 和企业场景优化著称,Command A+ 针对的也主要是这类用例。 NVIDIA Nemotron-3-Ultra-550B 的 LatentMoE 架构是一个技术亮点。LatentMoE 是 NVIDIA 在标准 MoE 基础上的变体,在路由机制和专家激活方式上有所调整,据称在推理效率上优于标准 MoE。550B 的体量意味着它主要面向有数据中心级计算资源的机构,不适合消费级部署。结合 NVFP4 量化(见 rank 12),Nemotron-3-Ultra-550B 的部署成本可以进一步压缩。 Poolside Laguna-M.1 是三者中信息最少的一个。Poolside 是专注代码生成的 AI 公司,Laguna-M.1 的具体参数量、授权方式和评测数据目前公开信息有限,应视为"待观察"而非"已验证"。 从生态演变趋势看,218B、550B 级别的开放权重模型逐渐成为常态,一年前这个参数量级的开放模型极为罕见。随着开放模型能力逼近闭源顶级模型,企业在"API 调用"和"自托管"之间的选择空间在持续扩大。