台积电1.6nm制程预计2026年四季度量产
据外媒报道,台积电已完成1.6nm制程开发验证,预计2026年第四季度量产,较2nm工艺速度提升8%-10%,能耗降低15%-20%。
浏览AI芯片与算力领域的最新新闻、进展与深度报道。
据外媒报道,台积电已完成1.6nm制程开发验证,预计2026年第四季度量产,较2nm工艺速度提升8%-10%,能耗降低15%-20%。
英国AI初创公司Callosum宣布完成1亿美元种子轮融资,其推理优化服务可将部分任务提速3.7倍,并与Cerebras等芯片商合作。
美光CEO梅赫罗特拉接受CNBC专访,强调AI推动内存需求爆发,反驳行业将重蹈周期覆辙的看空论调。
Waymo公开其第六代自动驾驶计算模块细节:核心为两颗自研ASIC,采用台积电车规级5纳米工艺,每秒算力超过1000万亿次,并以双芯片冗余保障可靠性。
韩国关税厅数据显示,8月前20天出口同比增长56%,半导体出口近三倍创新高,对华出口翻倍,贸易顺差140亿美元。
AI数据中心抢购内存引发RAM短缺,汽车制造成本上升,新车价格可能上涨数个百分点,美新车均价或突破6万美元。
Marvell股价涨6%,因与谷歌达成扩大定制芯片合作,谷歌可购买至多122亿美元股票,合作覆盖AI推理加速器等产品。
据CNBC报道,英伟达正为拥有GPU的客户与北欧数据中心运营商牵线搭桥,以扩大在AI基础设施领域的影响力。
据英国《金融时报》报道,字节跳动和腾讯已各接收一万块英伟达H200芯片。中国正放宽限制,以支持本土企业训练前沿AI模型。
据韩联社报道,AI芯片热潮推动韩国经济强劲增长,上半年上市公司利润飙升348.5%,KDI上调2026年增长预期至3.2%,风投创新高。
Velaura AI宣布完成1.1亿美元A轮融资,由Seligman Ventures领投,估值超10亿美元。该公司前身是加密货币芯片商,现专注低功耗AI芯片技术。
据TechRadar报道,英伟达推出新软件路由器,旨在阻止AI成本持续飙升,但该媒体对其实际效果提出疑问。
NVIDIA发布TensorRT Model Connect公开预览,支持从Hugging Face检查点经两条命令直接生成TensorRT推理bundle,免去ONNX中间步骤,实现无PyTorch的C++运行。
AI推理芯片初创公司Etched宣布完成7亿美元新一轮融资,估值达210亿美元。此轮由Jane Street领投,距其获得英伟达支持的3亿美元融资仅数周。
据SiliconANGLE报道,在Supermicro开放存储峰会上,多家科技公司高管表示,AI推理成为主导工作负载,AI优先的neoclouds正凭无传统架构负担等优势重塑企业基础设施,并推动液冷、QLC存储等新技术应用。
据TechCrunch报道,AI芯片初创公司Etched完成7亿美元融资,估值达210亿美元,由Jane Street领投,较上月翻倍。
据雷峰网报道,九章智算云以GLM-5为例,展示其强化学习系统如何通过“训推一致”将训练与推理整合为一条智能生产线,实现模型能力持续低成本生产。
英伟达宣布为OpenAI俄亥俄数据中心提供最高1050亿美元支持,并联合高盛、阿波罗等六家华尔街机构计划动员超5000亿美元第三方资本,以金融手段巩固其AI算力市场领先地位。
诚恒微在无锡发布端侧AI SoC CH3715,集成六核NPU与四核GPGPU等异构计算单元,面向机器视觉、工业设备等场景,实现单芯片替代多芯片组合。
清昴智能推出自进化AI Infra体系,用AI优化AI,将国产算力算子调优从两周缩至约1小时,提升336倍,并打造日均万亿级Token工厂。
字节跳动Seed与清华AIR发布CUDA Agent,用强化学习训练大模型编写GPU内核,在KernelBench达到98.8%通过率,96.8%内核快于torch.compile,平均加速2.11倍。
CNBC报道称,美国私营部门AI投资约为中国23倍,英伟达融资5000亿美元扩张,华为先进芯片算力仅及GB300的13%。中国优先投入AI并规划4万亿元算力网络,力争自给自足。
TheCUBE分析师在最新播客中围绕AI泡沫展开辩论,英伟达5000亿美元投入或令泡沫难以破裂;新兴云厂商财报强劲,思科业绩超预期却遭冷遇。
Hugging Face团队开发了一种考虑资源约束的GPU分配器,在相同硬件和负载下,将GPU利用率最高提升33个百分点,优先级加权输出量最高提升105%。调度顺序而非硬件是提升算力利用效率的关键。