初创公司Majestic推出普罗米修斯AI服务器,128TB超大内存挑战英伟达HBM架构

来源: 昊群整理 作者: 昊群 发布时间: 2026-08-11 16:03:06 浏览次数: 51

8月2日,特拉维夫初创公司Majestic Labs发布Prometheus(普罗米修斯)AI服务器,摒弃传统GPU+HBM方案,改用自研Ignite AI处理单元(AIU)与8TB至128TB LPDDR6内存池组合。单台最高配置12个AIU,标准40U机架可容纳4台、总功耗120kW,采用液冷散热。官方宣称其快速内存容量达英伟达方案的50倍以上,单机架相当于25台NVL72机柜且功耗更低,计划明年出货并兼容主流AI框架。这一架构创新折射出AI算力基础设施正从"堆GPU"向"内存中心化"演进的趋势。

2026年8月2日,据TechRadar报道,由前谷歌和Meta工程师创立的以色列初创公司Majestic Labs正式发布Prometheus(普罗米修斯)AI服务器。这款产品的核心思路是"换道超车"——不跟随英伟达GPU搭配高带宽内存(HBM)的主流路线,而是用一种全新的内存架构来破解AI推理中的"内存墙"难题。

 

Prometheus服务器没有采用GPU,而是搭载了Majestic自研的Ignite AI处理单元(AIU),该单元将Arm核心与RISC-V向量、张量引擎结合。每台服务器最多可选配12个AIU,并共享一个8TB至128TB的LPDDR6连续一致性内存池,通过自定义内存聚合芯片组经长达一米的铜缆访问,而非直接将内存贴在处理器封装上。标准40U机架可安装4台Prometheus,总功耗120kW,采用冷板液冷散热。

 

Majestic对性能的宣称颇具冲击力:其架构提供的快速内存容量是竞争对手配置的50倍以上,互连带宽为1.7倍;一台Majestic机架的内存容量相当于25台英伟达NVL72 Vera Rubin机架,但功耗仅为其中一小部分,单个处理器的内存容量最高可提升1000倍。公司还表示,该服务器符合OCP(开放计算项目)标准,支持PyTorch、vLLM和OpenAI Triton框架,现有模型无需修改即可运行,计划明年出货,成本有望比同等GPU系统低10%至50%。

 

不过需要客观看待,这些性能数字来自厂商单方声明,尚缺少独立第三方的大规模测试验证。但无论如何,Prometheus的出现释放了一个明确信号:随着大模型上下文长度、多智能体并发和长记忆需求的爆发,AI算力基础设施的瓶颈正从"算力峰值"转向"内存带宽与容量",行业正在探索除GPU堆叠之外的第二条技术路径。

 

【昊群业务关联】

AI服务器的选型与部署正在变得空前复杂——从传统的GPU机型,到液冷、高密度内存、新型互联架构,不同工作负载对硬件配置的要求差异巨大。昊群作为主流服务器厂商的合作伙伴,深耕联想、超聚变、HPE、H3C、Dell、浪潮等品牌产品线,能够结合客户实际的推理、训练或Agent运行场景,提供从机型选型、容量规划、液冷改造到上架运维的一站式交付服务。如果您的企业正在规划AI算力底座,欢迎联系昊群,让我们帮您算清这笔"算力账"。

 

【信息来源】IT之家、TechRadar、腾讯新闻(2026-08-02);昊群整理