据少数派报道,8月25日至26日,智谱、英伟达、谷歌等公司密集发布AI新品,其中智谱开源原生多模态模型GLM-5.3-Flash,英伟达发布NVHBM定制高带宽内存,谷歌推出多款AI模型。

智谱于8月26日发布并开源GLM-5系列首款原生多模态模型GLM-5.3-Flash(320B-A18B)。该模型采用混合专家架构,总参数量3200亿,每个Token激活约180亿参数,支持文本和图像输入及100万Token上下文,以MIT许可证开放权重。在Artificial Analysis Intelligence Index v4.1.1评测中,该模型得分为57分,与Claude Opus 4.8 Max Effort持平;在智谱自研的Z.ai Code Bench v1.0测试中,其最高推理档位得分为29.0,Claude Opus 4.8为29.5。模型结合稀疏注意力与线性注意力,并引入流形约束超连接以降低长上下文推理的计算开销和KV Cache占用,同时将视觉能力整合到Coding和Agent工作流中。除软件开发外,该模型还支持办公、金融研究和专业文档处理,可结合外部工具生成PPTX、PDF、DOCX、XLSX等文件。目前,模型已接入ZCode、GLM Coding Plan和官方API,权重已在Hugging Face开放。智谱表示,其常规API定价约为GLM-5.3的十分之一,限时折扣期间约为二十分之一。

英伟达于8月26日宣布扩展NVLink Fusion半定制AI芯片平台,推出面向定制XPU的NVHBM高带宽内存技术。NVHBM采用定制HBM基础裸片,将内存控制器集成到HBM 3D堆叠内部,以减少定制AI加速器集成HBM时的芯片面积、功耗和工程验证成本。与标准HBM4e相比,内存带宽最高可提升30%,HBM功耗最高可降低15%,主计算裸片可用面积最高可增加约30%。亚马逊旗下Annapurna Labs将成为首家与英伟达合作引入NVHBM的厂商,双方此前已确认下一代AI芯片Trainium 4将支持NVLink 6和NVLink Fusion。

谷歌8月26日推出语音转文本模型Gemini 3.5 Transcribe,支持实时流式转录和预录音频转录,可自动删除语气词、重复内容和口误,端到端延迟较上一代Chirp 3缩短约70%。在FLEURS多语言基准测试中,其流式和非流式词错误率分别为5.50%和5.04%;Artificial Analysis的测试显示,平均词错误率分别为4.0%和2.6%。该模型支持85种以上语言,并提供自定义词汇表。开发者可通过Google AI Studio、Gemini API等使用公开预览版。同日,谷歌推出Gemini Omni 1.1 Flash多模态视频生成与编辑模型,支持场景扩展、首尾帧插值、视频参考和高分辨率输出,可将已有视频扩展至最长40秒,并可生成1080p或最高4K分辨率的视频。其API按时长计费,360p至4K价格分别为每秒0.03至0.30美元。

Perplexity于8月25日携手英伟达推出端侧AI智能体Portable Computer,可在设备端完整运行Perplexity Computer核心工作流,实现文件分析、本地检索与任务调度等纯本地化处理。该产品首发支持NVIDIA DGX Spark,可运行Qwen 3.8 27B及Perplexity自研后训练的PPLX 27B模型,本地任务不消耗Perplexity Credits,未来还将引入NVIDIA Nemotron 3.5 Lightning。目前面向Perplexity Pro和Max用户开放,Windows与RTX GPU PC支持将后续推出。

微软Xbox团队8月26日宣布推出“实体光盘数字权益”功能,Xbox Insider预览体验成员将于8月31日开启测试。玩家可将受支持的Xbox One与Xbox Series X实体游戏光盘绑定个人账户,解锁对应数字版游玩权限,无需频繁插入光盘。首批覆盖数千款作品,每张光盘对应一份可撤销的数字授权。

明基8月25日发布Creative Pro PV50系列专业显示器,包括32英寸PV3250U和27英寸PV2750U,均采用4K UHD分辨率,面向视频剪辑和后期调色,支持暗部清晰度、16-bit 3D LUT硬件校准及Thunderbolt 4接口。其他消息方面,苹果宣布将于北京时间9月10日凌晨1点举行新品发布会;GTA 6发布新版游戏预告;铁三角ATH-CKD30C USB-C耳机在美国开售,标价224.99美元;理光映像宣布研发40mm等效镜头的RICOH GR IVx,计划2026年冬季上市。