bloomax Token Factory
企業向けAI推論基盤「Token Factory」
AIを動かす力を、ビジネスの成長へ。
bloomaxは、企業の継続的なAI活用を支える推論サービスを準備しています。GPUなどの計算基盤とモデルの実行環境を組み合わせ、基盤の構成から保守運用までを管理。お客様のアプリケーションから利用できるサービスとして提供することを目指します。
利用するモデル、想定処理量、利用期間に合わせて、構成と提供条件を個別に整理します。
推論とは、AIモデルが入力に応じて回答や要約などを生成する処理です。Token Factoryは、その処理を継続して実行するための基盤をサービスとして提供する構想です。
提供予定のサービス
推論API
アプリケーションからAIモデルを呼び出せるサービス。自社でGPU環境を構築する負担を抑え、AI機能の検証や実装を進められる形を目指します。
想定する利用者
AI機能を開発する企業・開発チーム
専用推論環境
処理量や運用要件に合わせて設計する、お客様専用の推論環境。継続的な利用や、共有環境では満たしにくい要件への対応を想定しています。
想定する利用者
AIを業務やサービスの中核で利用する企業
推論基盤の構築・運用支援
GPU、ネットワーク、モデルの実行環境を含め、推論基盤の導入と運用を支援するサービス。既存設備の活用も含めて構成を検討します。
想定する利用者
自社でAI基盤を持ちたい企業・インフラ事業者
各サービスの提供時期・対応範囲・料金は、準備が整い次第ご案内します。
モデル、処理量、応答速度、データの取り扱い、運用体制を確認し、用途に合った構成と提供条件を整理します。
推論基盤の運用を、サービスとして。
企業がAIを使い続けるには、計算資源の確保に加え、実行環境の構成、処理の割り当て、保守や拡張を継続して管理する必要があります。
bloomaxのToken Factoryでは、こうした推論基盤を管理・運用し、お客様がサービスインターフェースを通じて利用する形を目指しています。お客様のアプリケーションやデータの管理と、bloomaxが担う基盤運用の範囲を整理したうえで、提供条件を個別に定めます。
サービス構成の概念図
bloomaxが担う予定の範囲
- 推論サービスを支える基盤構成と実行環境の管理
- 処理の割り当てと、利用計画に応じた拡張の検討
- 基盤設備の保守と運用管理
- 提供条件、検収方法、サポート範囲の整理
お客様と確認する範囲
- 利用するモデルとアプリケーションの要件
- 想定する処理量と利用期間
- 業務データの取り扱いとバックアップ
- アカウント、API認証情報、アクセス権限の管理
具体的な対応範囲と責任分担は、提供形態および個別契約によって定めます。
日々の業務にも、次のサービスにも。
以下は想定される活用例です。導入実績や提供済み機能を示すものではありません。具体的な対応範囲は個別に確認します。
導入に向けたご相談の流れ
用途・要件のヒアリング
AIの活用目的、想定する利用量、既存システム、データの取り扱い要件をお伺いします。
構成・検証方法の検討
用途に適したモデルや推論環境、評価方法を整理し、導入に向けた進め方を検討します。
提供条件・導入計画のご案内
対応可能な範囲、提供時期、費用、運用条件を確認し、個別にご案内します。
よくある質問
推論APIは、自社でGPU環境を構築せずにAIモデルを呼び出せる共有型のサービスを想定しています。専用推論環境は、処理量や運用要件に合わせて設計するお客様専用の環境です。継続的な利用や、共有環境では満たしにくいセキュリティ・性能要件がある場合に適した形態を想定しています。
用途や利用規模が固まっていない段階でも相談を受け付けています。「AIを業務に使いたいが何から始めればよいかわからない」「推論コストを見直したい」「自社サービスにAIを組み込みたい」といったご相談から、具体的な構成検討まで対応します。
利用規模、基盤構成、利用期間、運用条件を確認したうえで、個別にご案内します。継続的な利用に向けた月額固定型の提供形態を想定しています。料金方式、利用開始条件、拡張時の扱いなどは、ご契約前に確認します。
bloomaxが準備中の企業向けAI推論基盤サービスです。GPUインフラとAIモデルの実行環境を組み合わせ、推論API・専用推論環境・推論基盤の構築・運用支援の3形態での提供を構想しています。現在は導入相談を受け付けており、提供開始時期・料金は準備が整い次第ご案内します。
AIの活用目的、想定する利用量(リクエスト数・処理文書量など)、既存システムの概要、データの取り扱い要件(保存場所・アクセス制御など)をお伺いできると、より具体的なご提案が可能です。これらが未確定の段階でも相談は可能です。
現時点では提供時期・料金ともに未確定です。準備が整い次第、本ページおよびお問い合わせいただいた方に優先してご案内します。
TPMはTokens Per Minuteの略で、1分間に処理するトークン数を表す指標です。実際の処理量は、モデルの種類、入力・出力の長さ、同時実行数などによって変わります。導入検討では、TPMの数値だけでなく、利用条件や評価方法を合わせて確認します。
そのAI構想を、動かし続けられる仕組みへ。
自社サービスにAIを組み込みたい。推論コストを見直したい。専用のAI実行環境を検討したい。
bloomaxでは、トークンファクトリー事業の立ち上げに向けた導入相談を受け付けています。用途や利用規模が固まっていない段階でも、お考えをお聞かせください。
ホームに戻る