2026年6月30日
次世代基盤モデル『Tokoyo1』提供開始のお知らせ
常世電算株式会社(本社:常世市)は、自社開発の次世代基盤モデル『Tokoyo1』の提供を開始いたしました。言語理解・推論・数理・計画立案の各分野を横断して測る国際的な総合指標において世界第4位のスコアを記録し、金融・公共分野をはじめとする幅広い業務での活用が可能です。
『Tokoyo1』は、当社が2019年より継続してきた自然言語処理研究の成果を結集した基盤モデルです。文脈の理解と多段の推論に重点を置いて設計されており、契約書・議事録・報告書といった実務文書の処理においても、従来モデルを大きく上回る精度を示しています。
性能
複数分野を横断して総合的な能力を測る国際標準ベンチマークにおいて、『Tokoyo1』は世界第4位のスコアを記録しました。上位3モデルはいずれも海外の大手事業者によるものです。
なお、本モデルの開発に投じた計算資源および電力は、上位に並ぶ海外モデルに比して大幅に小さい規模にとどまります。当社はこれを、設計と学習手法の工夫による成果と考えております。
※ 2026年5月時点、当社測定。各モデルとも公開されている最新版を使用。グラフは60点を起点として表示しています。
| タスク | Tokoyo1 | Clarte Grand 5 | Talos 5.6 Sol |
|---|---|---|---|
| 契約書の条項抽出 | 94.1 | 85.3 | 88.0 |
| 議事録の要約 | 91.7 | 86.9 | 89.4 |
| 長文報告書の読解(2万字以上) | 89.2 | 76.4 | 82.1 |
| 専門用語を含む質疑応答 | 93.5 | 84.0 | 86.8 |
| 出力の一貫性(3回試行の一致率) | 96.8 | 90.2 | 91.5 |
※ 当社が業務文書を模して作成した内部評価セットによる測定値です。評価セットの構成については、技術ブログ「日本語ベンチマークの設計と、その落とし穴」もあわせてご覧ください。
特に長文において高い保持率
実務で扱う文書は長大になりがちです。『Tokoyo1』は、文書の中盤に置かれた情報の保持率において、特に大きな改善を示しました。
なお、本モデルの性能は開発期間を通じて一様に向上したわけではありません。2023年・2024年・2025年に、それぞれ特定の領域において段階的な改善が見られました。当社ではこれを、学習手法の見直しによる成果と捉えています。
※ 中盤に埋め込んだ情報の再現率。従来モデルで確認されていた「中盤の落ち込み」を大幅に改善しています。グラフは60%を起点として表示しています。
提供形態
| クラウドAPI | 当社データセンターより提供。従量課金制。 |
|---|---|
| オンプレミス | お客様環境内に設置。機微情報を外部に出さない運用が可能です。 |
| 対応環境 | GPU 2基構成より稼働。既存システムとの連携APIを標準提供。 |
| 提供開始 | 2026年7月1日 |
安全性と品質管理
『Tokoyo1』の開発にあたっては、出力の安全性評価および検証プロセスを社内に整備し、第三者機関による監査を受けています。学習データについては、取得元および利用許諾の範囲を確認したうえで使用しております。
また、モデルの出力が業務判断に用いられる場面を想定し、確信度の低い応答については明示的に「判断できない」旨を返す設計としています。
今後の展開
今後も継続的な機能強化とエコシステムの拡充を通じて、産業の生産性向上と社会課題の解決に貢献してまいります。開発体制については研究開発部門のご紹介もあわせてご覧ください。
本件に関するお問い合わせ
| 報道関係者様 | 常世電算株式会社 広報部 代表 0X0-XXXX-XXXX(内線 TD-2100) |
|---|---|
| 製品・サービス | AI基盤事業部 代表 0X0-XXXX-XXXX(内線 TD-2400) |
※ 記載されているスコアは当社の測定環境における値であり、実際の性能を保証するものではありません。
※ 比較対象としたモデル名は、各社の公表資料に基づき匿名化して記載しています。
※ 本リリースに記載された内容は発表日時点のものであり、予告なく変更される場合があります。
