计划提供的服务
推理API
可从应用程序调用AI模型的服务。减少自建GPU环境的负担,支持AI功能的验证和实现。
目标用户
开发AI功能的企业和开发团队
专用推理环境
根据处理量和运营需求设计的客户专属推理环境。适用于持续使用或共享环境难以满足的需求。
目标用户
将AI用于核心业务或服务的企业
推理基础设施建设·运营支持
包括GPU、网络、模型执行环境在内,支持推理基础设施的导入和运营。也考虑现有设施的利用。
目标用户
希望自建AI基础设施的企业和基础设施运营商
各服务的提供时间、覆盖范围和价格,将在准备就绪后告知。
我们将确认模型、处理量、响应速度、数据处理方式及运营体制,并整理适合您用途的配置和服务条件。
以服务形式提供推理基础设施的运营。
企业持续使用AI,不仅需要确保计算资源,还需要持续管理执行环境的配置、处理分配、维护和扩展工作。
bloomax的Token Factory致力于管理和运营这些推理基础设施,使客户能够通过服务接口进行使用。我们将明确客户负责管理的应用程序和数据范围,以及bloomax负责的基础设施运营范围,并逐一确定服务条件。
服务架构概念图
bloomax计划负责的范围
- 支撑推理服务的基础设施配置与执行环境管理
- 处理分配及根据使用计划进行扩展的研究
- 基础设施设备的维护与运营管理
- 服务条件、验收方式及支持范围的整理
与客户确认的范围
- 所使用模型和应用程序的需求
- 预计处理量和使用期限
- 业务数据的处理方式与备份
- 账户、API认证信息及访问权限的管理
具体的对应范围和责任分担,将根据提供形式及个别合同加以规定。
导入咨询流程
用途·需求调研
了解AI应用目的、预期使用量、现有系统和数据处理需求。
配置·验证方法研讨
整理适合用途的模型和推理环境、评估方法,研讨导入推进方式。
提供条件·导入计划告知
确认可覆盖范围、提供时间、费用和运营条件,单独告知。
常见问题
推理API计划作为共享型服务,无需自建GPU环境即可从应用程序调用AI模型。专用推理环境是根据处理量和运营需求为客户专门设计的环境,适用于持续使用或共享环境难以满足安全性和性能要求的情况。
即使用途和使用规模尚未确定,也欢迎咨询。从「想在业务中使用AI但不知从何开始」「希望重新审视推理成本」「希望在自有服务中集成AI」等初步咨询,到具体配置讨论,我们均可对应。
我们将在确认使用规模、基础设施配置、使用期限和运营条件后,逐一提供说明。我们计划采用面向持续使用的月固定费用提供形式。费用方式、服务开始条件及扩展时的处理方式等,将在签订合同前进行确认。
Token Factory是bloomax正在准备的企业级AI推理基础设施服务。我们计划以推理API、专用推理环境、推理基础设施建设运营支持三种形态提供服务,结合GPU基础设施和AI模型执行环境。目前正在接受导入咨询,提供时间和价格将在准备就绪后告知。
如能提供AI应用目的、预期使用量(请求数、处理文档量等)、现有系统概要、数据处理要求(存储位置、访问控制等),将有助于提供更具体的方案。即使这些信息尚未确定,也可以进行咨询。
目前提供时间和价格均未确定。一旦确定,将优先通知已联系我们的客户,并在本页面更新信息。
TPM是Tokens Per Minute的缩写,表示每分钟处理的token数量。实际处理量因模型种类、输入输出长度、并发请求数等因素而有所不同。在导入评估阶段,我们不仅会确认TPM数值,还会结合使用条件和评估方法一并进行确认。
将您的AI构想,转化为可持续运行的机制。
希望在自有服务中集成AI。希望重新审视推理成本。希望考虑专用AI执行环境。
bloomax正在接受Token Factory业务启动的导入咨询。即使用途和使用规模尚未确定,也欢迎告知您的想法。
返回首页