歯科医院
導入した構成:60万円台
- 導入前
- Genspark Teamプラン 12人分で年間68万円
- 導入後
- 月額料金なし
約1年で導入費用を回収できる計算です。
葡萄染
ローカルAIサーバーの構築・設定・導入・運用サポートを行います。ご入金後、ご要望に合わせてハードウェアを組み上げて納品します。個人情報や機密情報を、外部のAIサービスに入力することなく業務に使えます。
クラウドのAIサービスは、値上げや利用制限がすべて一民間企業の判断に依存しています。自社で持つAIサーバーなら、その影響を受けません。
外部のサーバーやサービスを経由しない、スタンドアロンのAIシステムです。
インターネットにつながらないオフライン環境でも動作します。
患者様やお客様の個人情報、社内の機密情報も、気兼ねなく入力して処理できます。外部のAIサービスは「学習には利用しない」としていても、一度は外部のサーバーを経由する仕組みのため、漏洩の危険と常に隣り合わせです。
AIサーバーは院内・社内に置きます。受付や診察室、事務所のパソコン、スマートフォンのアプリから、院内・社内のネットワークを通じて使います。Wi-Fiのない場所では、サーバー本体の無線に直接つないで使うこともできます。
やり取りはすべて建物の中で完結し、入力した内容がインターネットに送られることはありません。
AIサーバーに使うGPU(画像処理用の演算装置)は、一般的な事務用パソコンより大幅に高性能です。AIを使っていない時間は、画像や動画の編集、3Dデータの処理、大量のデータの集計などに使えます。
クラウドのAIサービスには、プランごとに利用量の上限があります。自社のサーバーでは、機械の処理能力の範囲で好きなだけ使えます。
クラウドのAIサービスは1人ごとに月額料金がかかります。自社のサーバーは、使う人が増えても追加の料金はかかりません。
院内・社内のネットワークの中で動くため、インターネット回線やクラウドサービス側の障害があっても使い続けられます。
入力した内容や会話の履歴は、院内・社内のサーバーに残ります。外部のサービスが終了したり、利用規約や料金が変わったりしても、使い方を変える必要はありません。
性能の高いAIモデルが新たに公開されたときは、サーバーの中のモデルを入れ替えて使えます。
試験実証として導入した2件の例です。
導入した構成:60万円台
約1年で導入費用を回収できる計算です。
導入した構成:100万円台
3か月で導入費用を回収できました。
クラウドのAIとは性能が異なるため、単純な比較はできません。
ボタン一つで、あなた専用のAIが起動します。面倒なプログラムを入力する必要も、広告も、更新の要求もありません。専門知識がなくても扱えます。
予算に合わせて、その価格で動かせる最も性能の高いAIモデルを選んで構成します。60万円から10万円単位でご相談いただけます。下の表はその一部です。
| 構築費 | GPU | GPUメモリ | 動かせるAIモデル | 精度 | 生成速度の目安 |
|---|---|---|---|---|---|
| 60万円 | RTX 5070 Ti | 16GB | Qwen3.6-35B-A3B | Q4(一部をメインメモリで処理) | 実機で測定 |
| 70万円 | RTX 5060 Ti ×2 | 32GB | Qwen3.8-27B | Q6 | 約12トークン/秒 |
| 110万円 | RTX 5080 ×2 | 32GB | Qwen3.8-27B | Q6 | 約26トークン/秒 |
| 140万円 | RTX 5090 | 32GB | Qwen3.8-27B | Q6 | 約49トークン/秒 |
| 170万円 | RTX 5090(メインメモリ128GB) | 32GB | Qwen3.8-27B または Qwen3.8-Flash-Next | Q6 4bit | 約49トークン/秒 実機で測定 |
| 260万円 | RTX 5090 ×2 | 64GB | Qwen3.8-27B | Q8 | 約37トークン/秒 |
| 340万円 | RTX PRO 6000 | 96GB | Qwen3.8-27B | Q8 | 約37トークン/秒 |
| 460万円 | RTX PRO 6000 + RTX 5090 | 128GB | Qwen3.8-27B または Qwen3.8-Flash-Next | Q8 4bit | 約37トークン/秒 実機で測定 |
GPUメモリが大きい構成ほど、同時に使える人数や、一度に読み込める文書の量が増えます。
精度は、AIモデルのデータの圧縮の度合いです。Q8は元のモデルにほぼ近い精度で、Q6、Q4の順に圧縮が強くなります。
生成速度の単位のトークンは、AIが文章を処理するときの区切りの単位です。数値は計算上の目安で、実際の速度は納品前に実機で測定してお伝えします。
Qwen3.8-Flash-Nextは2026年8月公開の試験公開版で、メインメモリと合わせて約112GB以上が必要です。
部品の価格は変動が大きいため、構成と金額はお見積もり時に確定します。
クラウドのAIサービスとの比較です。性能は2026年9月27日時点の集計値、料金は2026年6月時点のものです。
グラフは横にスクロールできます
Artificial Analysis Intelligence Indexは、第三者機関が推論・知識・プログラミングなど複数の試験をもとに算出するAIモデルの総合性能指標です。数値が高いほど高性能です。数値はBenchLMが2026年9月27日に公開した一覧によります。
Claude Opus 4.5とOpus 4.1は推論(Thinking)あり、Claude Haiku 4.5は推論ありの値です。
いま払っているAIサービスの料金が、導入費用を何か月で上回るかを示しています。いずれも3年以内に回収できます。
回収期間は「構築費 ÷(いまのAIサービスの月額 − 葡萄染の月々の電気代)」で計算しています。電気代は月2,046円(60万〜70万円の構成)、月2,728円(100万円以上の構成)としています。
AIサービスの料金は2026年6月時点の月払いの料金で、1ドル150円で換算しています(Claude Max 20xは1人月200ドル)。実例の2件は実際の支払額です。
利用人数が少ない場合や、月額の安いプランの場合は、回収期間が長くなります。
月額の固定費をなくすことがこのサービスの目的のため、サブスクリプションのような月額制は基本的に採用していません。ご要望があれば柔軟に対応しますので、担当者までご相談ください。
関東圏は訪問して対応します。それ以外の地域は遠隔サポートを中心に対応します(訪問での対応も可能です)。
モニターとしてご導入いただく場合は、通常より割安な価格でご提供します。詳しい条件はお問い合わせください。
ご相談・お見積もりは、メールで受け付けています。
stromain.hq@gmail.com代表者名・所在地などの詳細は、お見積もりの際にお送りします。