据SiliconANGLE报道,总部位于伦敦的人工智能初创企业Callosum Ltd.于8月20日宣布完成1亿美元融资,以扩大其面向AI推理任务优化的云服务业务。本轮融资由Atomico领投,Plural、DCVC及英国主权AI基金参投,此前该公司曾在2月筹集1025万美元。
Callosum提供名为Tailored Inference的云服务,帮助开发者提升AI应用效率。根据公司说法,其技术完成部分推理任务的速度比GPT-5.6 Luna快3.7倍,且输出质量更高,并承诺降低基础设施成本。AI应用的任务常包含多个步骤,Tailored Inference将任务步骤拆分为独立软件模块,再分发给最适合执行的AI模型。简单任务由低成本算法处理,复杂工作则交给前沿模型。该服务还会优化底层基础设施,在确定模型后将其部署到最高效的芯片上。
Tailored Inference上线时支持超过六家公司的AI加速器,其中包括Cerebras Systems。Cerebras在Callosum融资之际宣布合作,将其WSE系列晶圆级推理加速器集成到Tailored Inference中。Cerebras于周三发布了最新WSE-3 Turbo芯片,核心数与此前产品相同,但通过提高时钟频率实现了两倍性能,同时升级了核间片上网络。该芯片以Wafer-Scale Backpack模块形式提供,包含液冷硬件、电源管理等部件。三个这样的模块组成CS-4机架设备,单台CS-4可运行参数达10万亿的模型。AI模型生成响应包括prefill和decode两个阶段,Cerebras称CS-4特别适合后者,可与AMD、AWS等以prefill优化的芯片配合使用,Callosum平台可在两者的芯片上运行客户工作负载。
Callosum联合创始人兼CEO Danyal Akarca表示:“下一代AI将取决于计算编排的智能程度,而非简单计算规模。”