Back to news

Multiverse Computing CEO:先把模型压瘦95%,AI才有机会从“算力玩具”变成工业基础设施

西班牙初创公司Multiverse Computing宣布,基于其量子启发压缩技术CompactifAI推出新一代“压缩大模型”组合:在不显著牺牲性能的前提下,将主流开源LLM参数和内存占用削减多达95%,推理速度提升4–12倍、推理成本降低50%–80%,并已在HyperNova 60B等模型上实测可在手机、Raspberry Pi乃至可穿戴设备上运行,给边缘AI和中小企业打开了“无需巨型算力也能用强模型”的新路径。

公司近期宣布完成2.15亿美元B轮融资,并与Cerebrium、SOHMA AI和多家工业客户合作,把压缩模型推向主流云与行业场景:一边是在云端提供Llama、DeepSeek、Mistral等热门模型的“瘦身版”,帮助金融、制造和公共部门在监管和成本约束下部署近前沿能力;另一边是通过CompactifAI APP等工具,把这些压缩模型以离线方式跑在本地终端上,实现行为识别、情绪感知、工业检测等原本需要云算力才能完成的任务——在全球开始严肃讨论“AI能耗和算力天花板”的时点,Multiverse试图用“先从模型动刀”的路线,把AI从少数巨头的云玩具,推向更广泛、成本可承受的工业和边缘基础设施。

来源:公开信息

AI

Source

·ABAB News
·
2 min read
·181d ago
分享: