Corcel是一家人工智能基础设施公司,提供针对开源大语言模型的无服务器GPU推理服务。该公司运营一个云平台,使开发者和企业能够运行Llama、Mistral及其他开放权重架构等模型,而无需管理底层硬件。Corcel将自己定位为传统云提供商的成本效益替代方案,提供按令牌计费,并消除了预留GPU容量的必要。
2023年成立,Corcel出现于生成式人工智能领域快速增长时期,当时推理计算的需求超过了供应。该公司的平台抽象掉了GPU编排的复杂性,使用户能够通过简单的API调用部署模型。这种方法面向两类用户:希望快速原型开发AI应用的个人开发者,以及希望扩展生产工作负载而不签署长期基础设施合同的大型组织。
历史与创立
Corcel成立于2023年,创始团队拥有云计算和机器学习背景。创始人发现了市场上对灵活、按需推理服务的缺口,这种服务可以支持不断增长的开源模型生态系统。与诸如亚马逊云服务、微软Azure和谷歌云这类需要用户配置和管理虚拟机或Kubernetes集群的主要云提供商不同,Corcel提供了完全托管且具有自动扩展功能的体验。
该公司于2024年初完成了首轮种子融资,参与方包括数名未披露的实友投资者。这笔资金用于构建核心基础设施,并建立与GPU硬件提供商的合作伙伴关系。到2024年中,Corcel已推出公开测试版,吸引了AI开发者社区中的早期采用者。
技术与架构
Corcel平台构建于服务器无状态架构,根据传入请求流量动态分配GPU资源。当用户发送提示时,系统将其路由到运行所请求模型的可用GPU实例。这种设计允许硬件高效利用,因为空闲容量可以在多个客户之间共享。
该公司支持广泛的开源模型,包括Llama系列、Mistral以及各种微调变体。用户可以从预配置模型目录中选择,或上传自定义权重。平台处理模型剪枝和量化,以优化性能并降低成本,从而在性能较低的硬件上实现更快的推理。
Corcel基础设施利用AMD和NVIDIA GPU,专注于提供每百万令牌的竞争性价格。该公司声称实现与专用GPU实例相当的延迟,同时提供按使用量计费的灵活性。这种模式特别适合具有变量流量特征的应用,如聊天机器人、代码生成工具和内容摘要服务。
商业模式与定价
Corcel采用基于消费的计价模式,按每处理的令牌收费。这种方法消除了前期成本,允许用户根据需求扩展或缩减使用量。该公司提供分档定价计划,为高吞吐客户提供批量折扣。
除核心推理API外,Corcel还提供微调即服务等功能,允许用户将开源模型适配到特定领域。平台还包括监控工具和使用分析,帮助客户跟踪支出并优化AI工作负载。Corcel已将自己定位为云巨头提供的原始计算与AI应用开发者特定需求之间的桥梁。
市场定位与竞争
Corcel在竞争激烈的环境中运营,既包括既有的云提供商,也包括专业化的AI推理初创公司。像Groq和SambaNova Systems这样的公司提供专用硬件解决方案以实现高速推理,而Oracle Cloud等超大规模云则按需提供GPU实例。Corcel通过其简单无状态模型来差异化自身,降低了客户的运营开销。
此外,该公司还与其他提供开源模型免费或低成本访问的托管平台竞争。然而,Corcel面向的是可靠性、可扩展性和性能至上的生产用例。截至2025年,该公司尚未披露客户数量或收入数据,但自推出以来,API的使用量一直稳中有增。
未来方向
Corcel计划扩展模型目录,加入新兴架构和能够处理文本、图像和音频的多模态模型。该公司还在探索与硬件制造商的合作,以优化其基础设施适配下一代GPU。此外,Corcel正在开发工具,以简化AI代理和自主系统的部署,利用其推理平台作为更复杂应用的基础。
该公司继续专注于其使命,即实现对AI计算的最广泛访问,使世界各地的开发者更容易构建和部署智能应用。通过不断优化其服务器提供以降低成本,Corcel旨在成为AI基础设施领域的领先者。