2026年8月2日,据TechRadar报道,由前谷歌和Meta工程师创立的以色列初创公司Majestic Labs正式发布Prometheus(普罗米修斯)AI服务器。这款产品的核心思路是"换道超车"——不跟随英伟达GPU搭配高带宽内存(HBM)的主流路线,而是用一种全新的内存架构来破解AI推理中的"内存墙"难题。
Prometheus服务器没有采用GPU,而是搭载了Majestic自研的Ignite AI处理单元(AIU),该单元将Arm核心与RISC-V向量、张量引擎结合。每台服务器最多可选配12个AIU,并共享一个8TB至128TB的LPDDR6连续一致性内存池,通过自定义内存聚合芯片组经长达一米的铜缆访问,而非直接将内存贴在处理器封装上。标准40U机架可安装4台Prometheus,总功耗120kW,采用冷板液冷散热。
Majestic对性能的宣称颇具冲击力:其架构提供的快速内存容量是竞争对手配置的50倍以上,互连带宽为1.7倍;一台Majestic机架的内存容量相当于25台英伟达NVL72 Vera Rubin机架,但功耗仅为其中一小部分,单个处理器的内存容量最高可提升1000倍。公司还表示,该服务器符合OCP(开放计算项目)标准,支持PyTorch、vLLM和OpenAI Triton框架,现有模型无需修改即可运行,计划明年出货,成本有望比同等GPU系统低10%至50%。
不过需要客观看待,这些性能数字来自厂商单方声明,尚缺少独立第三方的大规模测试验证。但无论如何,Prometheus的出现释放了一个明确信号:随着大模型上下文长度、多智能体并发和长记忆需求的爆发,AI算力基础设施的瓶颈正从"算力峰值"转向"内存带宽与容量",行业正在探索除GPU堆叠之外的第二条技术路径。
【昊群业务关联】
AI服务器的选型与部署正在变得空前复杂——从传统的GPU机型,到液冷、高密度内存、新型互联架构,不同工作负载对硬件配置的要求差异巨大。昊群作为主流服务器厂商的合作伙伴,深耕联想、超聚变、HPE、H3C、Dell、浪潮等品牌产品线,能够结合客户实际的推理、训练或Agent运行场景,提供从机型选型、容量规划、液冷改造到上架运维的一站式交付服务。如果您的企业正在规划AI算力底座,欢迎联系昊群,让我们帮您算清这笔"算力账"。
【信息来源】IT之家、TechRadar、腾讯新闻(2026-08-02);昊群整理


