<img height="1" width="1" style="display:none" src="https://www.facebook.com/tr?id=139163818022217&amp;ev=PageView&amp;noscript=1"> <img height="1" width="1" style="display:none" src="https://www.facebook.com/tr?id=271598307802760&amp;ev=PageView&amp;noscript=1">

Muse Spark 1.3がBox AIに登場 - 難しい仕事をより高速に

 公開日:2026.09.30  Box Japan

Meta Superintelligence LabsのMuse Spark 1.3がBox AIで利用可能になりました。同程度の価格帯のAIモデルの中で、トップクラスの性能を発揮します。同等の価格帯にある主要なAIモデルを組み合わせた比較対象に対してベンチマークを実施したところ、Muse Spark 1.3は精度で13%上回りました。

この結果は、企業がAIエージェントに実際に求める業務を対象としたBox Complex Work Evalによるものです。具体的には、ソースファイルを取得し、スプレッドシート、PDF、契約書、プレゼンテーション資料を横断して推論し、完成した成果物を作成するような業務です。

Muse Spark 1.3は、複雑な業務をより効率的に処理

通常、AIモデルの世代が進化すると、精度の向上と引き換えに、より多くの推論ターン、ツール呼び出し、トークン、待ち時間といった負荷が増える傾向があります。Muse Spark 1.3は、そのパターンを打ち破ります。Muse Spark 1.2との直接比較では、Muse Spark 1.3は精度を維持しながら、同じ業務を約42%高速に完了し、使用するトークンも約3分の1削減しています。

実際の企業業務を担うAIエージェントにとって、これは補足的な改善ではなく、重要な成果です。複雑な企業向け成果物では、エージェンティックAIのレイテンシとコストが実際の課題になります。品質を維持しながらレイテンシをほぼ半減させることは、ユーザーが求める世代間の進化です。

Box AI Complex Work Eval for Muse Spark

業界を横断してパフォーマンスが向上

前世代と比較して、Muse Spark 1.3は、定量的推論とソース情報の厳密な扱いが特に求められる業界で大幅な向上を示しています。Muse Spark 1.3が優れた結果を示した3つの業界の代表的なタスクを紹介します。

  • 金融サービス(66%から75%): 5年間の予測タスクでは、将来年度のコスト要因が、上部の情報とは異なる形式の画像ベースの前提条件表にしか記載されていません。Muse Spark 1.3はそれを見つけ、使用し、その根拠を明示したうえで、判断を暗黙のうちに置き換えるのではなく、代替案を検証する感度分析の注記を追加しました。別の複数年予測タスクでは、Muse Spark 1.3は正しい税務処理を選択し、資金不足額まで一貫して適用しました。誤った処理をすると、赤字が黒字になるなど、回答の符号そのものが逆転します。このような厳密さが、単に数字を出すAIモデルと、実際のアクションにつながる数字を出すAIモデルの違いです。
  • テクノロジー(65%から69%): ベストプラクティスのマニュアルと、それに照らして評価する一連の作業項目が与えられた場合、Muse Spark 1.3はルールを機械的に適用するのではなく、マニュアル内の具体例を基準に評価を調整しました。提供チャネルを所定の技術ソリューションではなくチャネルとして正しく解釈し、反対に、受け入れ基準が複数箇所で矛盾している項目を見つけて、それに応じて評価を下げました。同じソース情報から、両方向に判断できています。
  • エネルギー(63%から69%): 2つの施設の消費量を分析するタスクでは、一方の施設について、2つの不完全な暦月にまたがる約1か月分の記録データしかありません。数値を比較可能にするには1日あたりのエネルギー量に正規化する必要があり、ピーク週は月次値から按分するのではなく、実際の暦週に基づいて合計する必要があります。Muse Spark 1.3は、必要なすべての数値を1日あたりの値で算出し、それぞれについて元の合計値と日数を示し、適用したルールも明記しました。多くのAIモデルが見落とす小さな分析ステップですが、これを省略するとレポート内のすべての数値が誤ったものになります。

Boxのお客様にとっての意味

Boxの評価全体を通じて、同じ能力が繰り返し確認されています。Muse Spark 1.3は、作業の根拠となるソース情報を厳密に扱います。画像の中に埋もれた前提条件を見つけます。2つの根拠の間で曖昧な態度を取るのではなく、1つの根拠を選択します。比較する前に正規化します。一見妥当に見えるデータ処理によって成果物の作成が事実上不可能になる場合には、それを認識し、N/Aだらけの表を返すのではなく、そのことを明示します。

こうした洞察力に基づく精度こそ、企業のドキュメント業務で価値を発揮するものです。BoxがMuse Spark 1.3をBox AIに導入する理由もここにあります。効率性と組み合わせることで、Muse Spark 1.3は、取締役会に提出する分析資料、規制当局に提出するレポート、意思決定を支えるメモなど、実際の成果物を任せられるAIモデルになります。そして、実際のワークフローの一部として使えるほど迅速に結果を返します。

Meta Superintelligence LabsのMuse Spark 1.3は、現在Box AIでベータ版としてご利用いただけます。

関連コンテンツ

このブログは Box, Inc 公式ブログ(https://blog.box.com/)2025年9月24日付投稿の翻訳です。
著者: Aditi Tuli, Product Manager, Box AI
原文リンク: https://blog.box.com/muse-spark-13-comes-box-ai-and-it-does-hard-work-faster
わかる!エージェント型ワークフローで業務を自動化する方法

RECENT POST「Box製品情報」の最新記事


Box製品情報

BoxとSalesforce: ヘッドレスエンタープライズを実現

Box製品情報

Box for ServiceNowのネイティブ連携のご紹介: 業務の現場でコンテンツを活用

Box製品情報

Claude Opus 5.5: 高品質な業務をより速く、効率的に

Box製品情報

法務業界におけるBoxとOpenAI: ガバナンスの効いた企業コンテンツをAIを活用した法務業務へ