依頼するだけで、作業を開始
エージェントが利用可能なスキルを確認し、タスクを整理したうえで、必要なコマンドを自動で実行します。
構成と根拠を添えて報告
スライドの構成、データの出所、デザイン仕様までを整理して報告します。修正の依頼も、チャット上の指示だけで対応できます。
成果物をその場でプレビュー
グラフや出典を含むPowerPointが完成します。プレビューで内容を確認し、そのままダウンロードできます。
自社専用のGPUサーバー上でオープンウェイトLLMを動かす、日本初のオンプレミス版AIエージェント基盤です。API利用料を気にすることなくClaude Code / Coworkと同等の開発体験を実現し、機密データを社外に持ち出す必要もありません。
計画やフローの設計は不要です。エージェントが依頼を受け取り、必要な機能を自ら選択して実行します。一連の作業は、チャット上の指示だけで貴社専用の「カスタムエージェント」として登録できます。
コーディング業務を大幅に効率化します。レガシーコードの改修やモダナイゼーションにも対応し、最新GPUの活用によりClaude Code比 約2/3〜1/2 の時間でタスクを完了します。
非エンジニアの幅広い業務を効率化します。Agentic OCR、Excel分析、資料作成といった難度の高いタスクも、高い精度で実行します。
IS Coworkの実際の画面。ユーザーが行うのは依頼の一文だけ。エージェントが自らスキルを選び、データを集め、デザインまで仕上げます。
AIエージェントは業務の生産性を大きく高める一方で、従量課金型のコストが経営上の課題となりつつあります。その解決策として、AIを「借りて使う」から「自社で保有する」へと移行する動きが広がっています。
※1 出所:How Do AI Agents Spend Your Money? — Analyzing and Predicting Token Consumption in Agentic Coding Tasks ※2 DGX B300(減価償却費・電気代含む)とClaude Code/Cowork従量課金(1名2万円/月換算)の弊社試算 ※3 DGX H100×2、DeepSeek-R1-Distill-Qwen-32B (FP16) での弊社検証
AIエージェントは推論時のトークン消費が非常に大きく、従業員一人あたり月に数百万円へ達する事例もあります。利用が広がるほど、従量課金のコストは際限なく増加していきます。
顧客情報や機密情報を外部のAPIに送信できないという制約があります。入力してはならない情報が含まれていないかを管理者が監視し続ける負担も、全社展開の障壁となります。
AIエージェントのトークン消費量は、通常のチャット利用の約1,000倍(10³倍)に達します。さらに日本語は英語に比べてトークン効率が低いため、日本企業ほどコスト負担が重くなる傾向があります。
1タスクあたりのトークンコスト効率の言語間比較(英語=1.00)
値が大きいほどトークン消費が多く、コスト高。日本企業ほど従量課金の負担が重くなる構造です。
日本のデジタル赤字額(兆円)の推移
GPTやGemini等の海外APIへの支払いは、この赤字をさらに拡大させます。
海外APIに依存しないAI基盤の整備は、
世界最大の「デジタル赤字」大国・日本を救う有力な選択肢でもあります。
「自社専用のGPUサーバー」に「オープンウェイトLLM」を載せる。この2つを組み合わせることで、API料金ゼロ・データは社外に出さず、AIを”使い放題”にできます。
社内に設置するオンプレミス環境(ハードウェア)です。機密データが社外に出ることはありません。
GPUサーバー上で動かすAIモデル(ソフトウェア)です。オープンウェイトモデルは4か月〜半年でフロンティアモデルに追従し、API料金はかかりません。
従量課金を気にすることなく、全社規模での展開を判断できます。
自社専用オンプレミス
GPUサーバー
コストとデータガバナンスの観点から、生成AIの活用はクラウド一辺倒から、オンプレミスとクラウドを併用するハイブリッドの時代へと移行しつつあります。最も要件の厳しい金融機関が、その動きを牽引しています。
| 金融機関 | 国 | 取組概要 |
|---|---|---|
| Barclays | アメリカ | 86%のCIOがクラウドワークロードの一部または全部をオンプレ等へ回帰する計画。調査史上最高値。 |
| Deutsche Bank | ドイツ | NVIDIA AI Enterpriseを活用し、オンプレDCとクラウドのハイブリッドでAIワークフローを実行。 |
| BNY Mellon | アメリカ | DGX SuperPODをオンプレ導入。600以上のAI活用機会を特定、40以上のアプリを開発中。 |
| BNP Paribas | フランス | NVIDIA技術でAI factoryを構築中。リテール向け次世代バーチャルアシスタントを開発。 |
| OCBC | シンガポール | コスト最適化とデータ主権の観点から、生成AIを主にオンプレで運用。大規模GPU基盤を保有。 |
オープンウェイトモデルの性能は、4か月〜半年ほど遅れてフロンティアモデルに追従する水準に達しています。その性能をオンプレミス環境で最大限に引き出すにはノウハウが求められ、創業当初からオンプレミスを手がけてきた弊社が最も得意とする領域です。
出所:Artificial Analysis「Intelligence Index」。* MiniMax-M3はオープンウェイトながら商用利用に制限あり。トップのOSSモデル GLM-5.2(51)は、最上位フロンティアモデルの約4〜6か月前の水準に相当します。
ハードウェアの進化により、オンプレミス×ローカルLLMはコストパフォーマンスの面でも有力な選択肢となりました。NVIDIA DGX B300(GPUメモリ2.1TB)1台で、1,000〜3,000名規模の同時利用に対応できます。
GPUメモリ2.1TBを搭載した最上位クラスのGPUサーバーです。GLM-5.2クラスの大規模モデルを数百名が同時に利用できるGPUクラスターを、1台で構築できます。
同じ「2,000名が利用する」条件で、クラウド型エージェント(従量課金)と、オンプレDGX B300を導入した場合の月額コストを比較しました。
NVIDIAの推論最適化サービス「NIM」の活用により、推論速度はvLLMの約2倍、Ollamaの約9〜10倍に達します。最新GPUとの組み合わせで、同一タスクをClaude Code比 約2/3〜1/2 の時間で完了します(弊社調べ)。
検証環境:DGX H100×2、Ubuntu 22.04/検証モデル:DeepSeek-R1-Distill-Qwen-32B (FP16) *OllamaはInt4モデルでの速度比をFP16換算で算出。出所:NVIDIA社提供資料および弊社検証。
Claude Code(左)と IS Code / Local AI Agent(右)に同一タスク・同一プロンプトを与えた実測デモ。
DGX B300 × GLM-5.2(NIM活用)構成では、Claude Code比 約2/3〜1/2 の時間でタスクが完了します(弊社調べ)。
計画やフローの設計は不要です。実際の操作画面とともに、依頼から成果物が完成するまでの流れをご紹介します。修正が必要な場合も、チャット上の指示だけで対応できます。
エージェントが利用可能なスキルを確認し、タスクを整理したうえで、必要なコマンドを自動で実行します。
スライドの構成、データの出所、デザイン仕様までを整理して報告します。修正の依頼も、チャット上の指示だけで対応できます。
グラフや出典を含むPowerPointが完成します。プレビューで内容を確認し、そのままダウンロードできます。
エンジニア向けコーディングエージェント IS Code の実際の動作を、デモ動画でご覧いただけます。
依頼に応じて、以下の機能を自ら組み合わせて実行します。
PDF・画像・各種ドキュメントを高精度に読み取り
構造化/非構造化データの処理・分析
docx / xlsx / pptx / pdf 各種オフィス形式に対応
フォルダ内を横断検索し、必要な情報へ到達
様々な言語・形式に対応
コード生成・実行、ファイル・OS操作まで柔軟に
稟議書ドラフトの作成を依頼した場合を例に、内部処理の流れをご紹介します。計画から成果物の生成まで、エージェントが必要な機能を自ら選択して実行します。
一連の作業は、チャット上の指示だけで貴社専用の「カスタムエージェント」として保存し、再利用できます。
業界を問わず、大企業の各部門の定型・非定型業務を効率化します。
取引先のPDF帳票・決算書を読み取り、社内フォーマットへ正規化。財務指標分析まで自動出力。
既存規程と参照情報を照合し、更新必要箇所の抽出から更新案作成まで。法的対応文書のドラフトも。
DB・Excelから集計・グラフ化し、Word/PPTレポートまで自動作成。
企業情報を横断確認し、社内ポリシーに則って評価。調書案を規定フォーマットで作成。
自治体・政府の制度情報を横断し、自社・取引先に該当する制度を自動マッチング。
IS Codeがコードの調査・改修からモダナイゼーションまでを支援。開発生産性を大幅に向上。
大企業に安心してご利用いただくための機能を、標準で備えています。
入力・参照ファイル・実行内容を記録。すべての行動を後から確認可能。
専用の作業領域でファイルを扱い、参照元を書き換え・破損しない設計。
ユーザーごとに専用領域を用意し、他ユーザーの情報へのアクセスを制御。
ユーザーの追加・管理、SharePoint等の外部連携もユーザー単位で安全に。
オンプレミスサーバー(ハードウェア)、IS Cowork / IS Code(ソフトウェア)、保守サポートをワンパッケージで。GPU構成に応じて柔軟にご提案します。
※税別。保守サポート(生成AIモデル・ライブラリの更新)付随。納品後1年間はハードウェア故障時の無償交換対応。契約期間2年、以降1年更新。IaaS/SaaS環境での提供は個別にご提案。
一歩千金 — たった一枚の歩で、千枚の金を上回る価値を。
要件の厳しい金融機関での豊富な導入実績を持ちます。そこで培った品質とセキュリティの水準を、あらゆる業界へ提供します。
NVIDIA Inception Programに採択されています。GPUの特別割引やNIM・NeMoといった最新技術を活用し、高精度な生成AIを提供します。
日本初となる生命保険の引受査定AIエージェントを構築しました。査定者の暗黙知をAIに取り込み、業務の効率化を実現しています。
京都大学大学院修了後、野村総合研究所にて金融機関向けの戦略策定・実行支援コンサルティングに従事。自身もデータサイエンティストとして与信モデル・需要予測等のAIモデル開発〜導入を主導。2024年5月、株式会社Ippu Senkinを創業。日本初となる生命保険の引受査定AI Agentを開発。
FDUA(金融データ活用推進協議会)生成AIガイドライン策定アドバイザー/GUGA(生成AI活用普及協会)協議委員/FDUA「金融生成AIガイドライン1.1版」・日経BP金融DXレポート・月刊金融ジャーナル・銀行実務 ほか執筆多数/NVIDIA 金融AI Meet-up・AI EXPO等 登壇
NVIDIA Inception Programに採択。GPUの特別割引やNIM・NeMoなどの最新ソフトウェアを活用しています。
NVIDIA正規販売代理店マクニカとの連携により、ワークロードに応じた最新GPU構成をご提供。