国産LLM開発会社「日本は1年半くらい遅れている。推論モデルは手探りでできた。次はDeepresearch」大丈夫かこれ

1 : 2026/07/25(土) 18:48:29.91 ID:w4/Mrv6L0

https://ledge.ai/articles/preferred_networks_plamo_3_0_prime_interview

国産LLMの現在地と、PLaMo 3.0 Primeが目指したもの── Preferred NetworksのLLM開発キーパーソンに独占インタビュー

2 : 2026/07/25(土) 18:49:01.60 ID:w4/Mrv6L0
OpenAIやAnthropic、Googleなど、世界ではLLM(大規模言語モデル)の開発競争が加速している。これまでLLM開発では、ベンチマーク性能や対話品質の向上が主な競争軸だった。しかし現在は、推論能力を備え、自律的にツールを使いながら業務を遂行する「AIエージェント」への対応、企業での実運用に耐えうる信頼性などが新たな競争軸となっている。

こうした変化を踏まえ、日本のAI開発を牽引する株式会社Preferred Networks(以下、PFN)は、国産フルスクラッチ開発のLLM「PLaMo」の最新版「PLaMo 3.0 Prime」を公開した。

本稿では、PLaMoの開発を率いるLLM開発事業本部 本部長の田中大輔氏と同チームでエンジニアを務める今村秀明氏のインタビューを通じて、LLM開発の競争軸はどのように変化しているのか、そして同社はその変化にどう対応しようとしているのか、話を聞いた。

※取材は2026年7月8日に行われた。

「ベンチマーク競争」から「AIエージェント競争」へ

「この1年半で、LLMの競争軸は大きく変わりました。」と今村氏は語る。

現在のLLM市場は、米国や中国がフロンティアモデルを牽引しており、日本の国産LLMは依然として追いかける立場にある。一方で、生成AIの活用が国内に広がる中、海外サービスへの依存によるリスクや懸念も高まっている。PFNが2026年5月に公開した技術資料の中でも、2030年には日本のデジタル赤字が約8兆円規模まで拡大する可能性について、強い危機意識が示されていた。

レス2番の画像1
22 : 2026/07/25(土) 18:56:32.76 ID:JWlfO+7ua
>>2
言うほどMistralがあるフランスと日本が同じか?
3 : 2026/07/25(土) 18:49:22.83 ID:B6fQIwAb0
1年半ってかなり凄いけど、本当か?
オープンソースAIを日本語学習させただけでは
4 : 2026/07/25(土) 18:49:57.09 ID:w4/Mrv6L0
だからこそ重要なのは「海外モデルに追いつくこと」だけではない。企業が実際の業務で安心して継続的に使えるLLMを国内で開発・維持できるかどうかだ。

そうした中、世界のLLM開発では競争軸そのものがドラスティックに変化しているという。
従来、LLM開発ではベンチマークスコアの向上が主要な目標だった。しかし2024年以降、OpenAIのoシリーズをはじめとする推論モデル(Reasoning Model)の登場によって、状況は一変。そして、現在進行形で進んでいるが「AIエージェント」の台頭である。今村氏はその流れを次のように整理する。

「まず推論能力が獲得され、それまで解けなかった複雑な問題を解けるようになりました。その次にAIがツールを使いながら仕事を進める『エージェンティック・ツールユース(Agentic Tool Use)』という新しいパラダイムが登場したのです」

つまり、LLMは“質問に答えるAI”から“仕事を完遂するAI”へと、その役割を変え始めている。
ロングコンテキストと「やり切る力」が新たな基準に

今回同社が開発したPLaMo 3.0 Primeでは、開発プロセスの一つである「継続事前学習」にも大きな役割が与えられている。継続事前学習とは、事前学習済みのモデルに対して追加の学習を行う工程だ。従来は、「新しい知識を追加すること」が主な目的だったが、今回の開発では別の目的がより重要になっていたと今村氏は明かす。

「長い文章を理解できるようにするために継続事前学習を使うケースが増えています。むしろ、最近ではこちらの目的が主流です」

レス4番の画像1

背景にあるのは、やはりAIエージェントの存在だ。AIエージェントは、ユーザーの指示を受けると、複数のツールを呼び出しながら自律的に作業を進めていく。例えば、ソフトウェア開発であれば、人間の代わりにコードを読み、必要なファイルを開き、テストを実行し、その結果を踏まえて考える、こうした一連のプロセスをこなす。
そのため、一度に扱うコンテキスト(文脈)は従来とは比較にならないほど長くなる。今村氏自身も、「以前は『256kものコンテキスト長が必要なのか』と思っていました。しかし、コーディングエージェントを実際に使うようになると、1つのタスクだけで256kを超えることも珍しくありません。AIエージェント時代では、長いコンテキストを扱えることが必須条件です」と、研究・開発を通して実感したという。

このような時代の変化を受けて、「高性能なLLM」の定義そのものも変わりつつある。これまでは「数学問題を解ける」や「ベンチマークで高得点を取る」などといった指標が評価されてきた。しかし今後はそれだけでは十分ではない。

「一度でもハルシネーションを起こしたり、ツール呼び出しに失敗すると、その後の処理全体が壊れてしまいます。AIエージェントでは、嘘をつかず、正しくツールを呼び出せることが非常に重要になります」

つまり、テストで高得点を取ることと、企業の業務を最後までやり遂げられることは、求められる能力のベクトルが異なるということだ。そのため、PLaMo 3.0 Primeでは、ツール利用を前提とした設計や、今回新たに対応したStructured Outputsの対応にも力を入れた。モデルが決められた形式で正確に出力することで、システム連携時のエラーを減らし、エージェントとして安全に動作させるためだ。

「これから企業で求められるLLMは、単に『賢いモデル』ではなく『仕事を最後までやり切れるモデル』になる。」と今村氏は力を込める。

17 : 2026/07/25(土) 18:54:21.38 ID:I7v1Yvqk0
>>4
それKIMI-3をローカルで動かせば済む話では?🤔
5 : 2026/07/25(土) 18:50:15.09 ID:wrUFmNdi0
これあれだろ、入力したデータを他のAIに飛ばして戻ってきた答えを整形して表示するやつ
6 : 2026/07/25(土) 18:50:47.16 ID:w4/Mrv6L0
手探りで掴んだ推論能力と、現場が求めた「速さ」

PLaMo 3.0 Primeでは、推論能力の獲得だけでなく、強化学習(RL)や学習パイプラインの全面的な見直しが行われた。しかし開発チームはこれで「完成した」とは考えていない。むしろ今回の正式版は、次の競争に向けたスタートラインだという。

現在でこそ推論モデルが当たり前になりつつあるが、PFNが開発を始めた当初は、参考にできる情報は非常に限られていた。本部長の田中氏は「PLaMo 2.2をリリースする前より『推論能力を獲得しよう』という方針を決めていました。ただその頃は、参考になる公開情報がほとんどありませんでした」と振り返る。
当時参考にできたのは、Grokなどの一部のテクニカルレポートや各社の限られた技術公開程度だった。数学やコーディングを重視することや、強化学習を活用する方向性が示されていたものの、具体的な方法論はほとんど公開されていなかった。そのため、PFNでは独自に仮説を立てながら検証を繰り返し行ったという。今村氏も「当時は世界中の研究者が同じように手探りだった」と話す。

結果としてPLaMoでは、比較的シンプルな学習パイプラインで推論能力の獲得に成功した。「思った以上に性能が伸びたことは、開発チームとしても驚きでした」(今村氏)。

また、正式版に先だって3月に提供したβ版では、企業の実態に即した貴重なフィードバックが得られた。当初、開発チームは「推論モデルが賢いので、それだけで十分だろう」と考えていたという。しかし、現場から帰ってきた声は違っていた。リアルタイムのチャット対応や問い合わせ対応などでは「多少性能が落ちても、とにかく早いモデルが欲しい」という要望が少なくなかったのだ。

そこで正式版ではじっくり思考する推論モデルだけでなく、推論を行わない高速な「Non-reasoningモデル」もラインナップに加えて業務に応じて選択できるようにした。

「チャットのようなリアルタイム用途では、そこまで深く考え込む必要はありません。一方で、AIエージェントのようにツールを使いながら複雑なタスクを処理する場合は、推論モデルの方が適しています。ユースケースに応じて最適なモデルを企業側で選択できる必要性があると考えました」(今村氏)。

PLaMo 3.0 PrimeがReasoning(推論)モデルとNon-reasoningモデルを両方提供した背景には、こうしたきれいごとだけではない、実運用のリアルなニーズがあったのだ。
フルスクラッチ開発の先に見据える国産LLMの将来像

現在、多くの国産LLMはLlamaなどのオープンモデルをベースに追加学習を施して開発されている。これは、開発コストや期間を抑えながら高い性能を実現できるため、非常に合理的なアプローチだ。しかしその中で、PLaMoは事前学習から自社で行うフルスクラッチ開発を貫いている。そのこだわりについて、今村氏は“単なる開発手法の違い”ではないと語る。

「公開されているオープンモデルに追加学習をしただけでは、本当の意味での国産LLMとは言えないと考えています。後段の学習になるほど、モデル全体への影響力は限定的になり、新しい知識を入れにくくなります。モデルの根幹である前段(事前学習)から自分たちで設計できることは、PFNの大きな強みです。」

フルスクラッチだからこそ、学習の初期段階から知識の入れ方も、学習パイプラインの構成も、外部の制約を受けずに最適化できる。また、AIエージェント時代に求められるツール利用能力についても、フルスクラッチという土台があるからこそ、独自の強みを磨き上げることができるという。

さらに、PFNが見据えているのは、現在のチャットAIやコーディング支援などにとどまらない世界だ。今村氏は次のマイルストーンとして「Deep Research(ディープリサーチ)」を挙げた。

「調べものをレポートとして詳細にまとめることは、推論能力とエージェント能力の両方を非常に使います。Webだけでなくクラウドやローカル上のファイルサーバーまで調べ、ハルシネーションを抑えながら正確にまとめることが重要になります」(今村氏)。

同社のメイン顧客である官公庁や、国内のあらゆるエンタープライズ企業においてこうした調査・情報整理のニーズは高く、Deep Researchの実現は実運用へ向けた重要なステップになるという。その先にはより高度なコーディングエージェントの実現も視野に入れている。

7 : 2026/07/25(土) 18:51:07.12 ID:w4/Mrv6L0
さらに長期的な展望として、ロボティクスとの融合も見据える。田中氏は次のように述べた。

「現在は、体を持たない賢いモデルを作っている段階ですが、将来的には弊社の別部隊が開発を進めているロボットやロボット基盤モデルとも連携させたいです。物理空間とサイバー空間を区別せず理解できる汎用モデルを目指したいと考えています」

また、今村氏は「最終的には、世界のトップを走るフロンティアモデルを追いかけ、追い越したい」と熱意を語ってくれた。

日本企業が安心して利用できるLLMを提供することと、世界最先端のモデルへ挑戦すること。その両立こそが、PFNがフルスクラッチで開発を続ける理由なのだ。
次の競争のスタートラインへ

インタビューの中で印象的だったのは、開発チームが「PLaMo 3.0 Primeは完成形ではない」と繰り返していたことだ。推論能力は獲得した。安全性も向上し、企業導入も進み始めている。しかし、それはゴールではなく、AIエージェント時代に向けた出発点に過ぎない。

LLMの競争は、今や単純なベンチマーク性能から、実運用における信頼性や業務の代替可能性へと移行している。さらに長期的には、AIが社会や現実世界でいかなる役割を果たせるかという、より本質的な価値が問われる時代を迎えている。

「PLaMo 3.0 Prime」の登場は、日本のLLM開発もまた、この新たなパラダイムに正面から対峙していることを示している。国産モデルの進化は、海外製との単純なスペック比較だけで測るべきではない。国内で企業のコア業務を支えるAIを育て続けられるか、その成否は、日本のAI産業における競争力そのものを左右するカギとなっているのだ。

8 : 2026/07/25(土) 18:51:26.45 ID:69+ciG9Ha
> ※取材は2026年7月8日に行われた。
明示しないと誤解されそうだもんな
9 : 2026/07/25(土) 18:51:42.21 ID:w4/Mrv6L0
OpenAIやAnthropic、中華AI企業とはだいぶ差があるんだな
10 : 2026/07/25(土) 18:51:58.24 ID:w4/Mrv6L0
大丈夫なのか日本
晋さん
11 : 2026/07/25(土) 18:52:06.31 ID:63FW7m6K0
利用者側としては
海外の有名AIがすでに日本語完璧なのに
わざわざ出来の悪い国産AI使う理由ないよね。。、
20 : 2026/07/25(土) 18:55:59.35 ID:w4/Mrv6L0
>>11
でも中国産は農薬が心配だよ
13 : 2026/07/25(土) 18:52:37.77 ID:Avxn5GiY0
AIがいくら学んでいっても
すでに新自由主義者的思考になってるから
国と国民両方豊かにする方法聞いてもアホな回答しかできねんだわ
俺から言わせるとゴミカス
14 : 2026/07/25(土) 18:52:59.49 ID:MFhRCYW30
遅れてようがなんだろうがやるしかないんだべさ
15 : 2026/07/25(土) 18:54:16.85 ID:mnbH95RJ0
要するにオープンモデルをファインチューニングしただけだろ
16 : 2026/07/25(土) 18:54:18.65 ID:YXvRj4ct0
朝鮮人は36親等どころか100親等経っても朝鮮人は朝鮮人だからな。
現に重度の発達障害まるだしじゃないかおまえ。
18 : 2026/07/25(土) 18:55:19.79 ID:ZS/ZeVbF0
ここの何回か使ったけどポンコツすぎた記憶
19 : 2026/07/25(土) 18:55:51.81 ID:X/5p6yEC0
反知性主義国に数学バンバン使うAIは無理だよ
21 : 2026/07/25(土) 18:56:08.10 ID:HqM76iQ00
ジャップみたいな劣等民族が開発できる訳ないだろ
23 : 2026/07/25(土) 18:56:46.48 ID:9DA1Uf3u0
十年前くらいだろ
25 : 2026/07/25(土) 18:58:45.56 ID:w4/Mrv6L0
>>23
10年前はTensorflowやCaffeで画像認識が最先端だった
24 : 2026/07/25(土) 18:58:35.95 ID:IUMP9Hlb0
ラーメン手づかみで食ってる段階か
26 : 2026/07/25(土) 19:01:14.85 ID:n1tajshRr
フルスクラッチでゼロから開発する意味があんまよくわからん
日本固有の価値観が必要ってならその価値観を集めてファインチューニングしたほうが早くね?
馬鹿にするやつは出るだろうがそいつは開発費出す気ないんだから無視すればいいだろ
27 : 2026/07/25(土) 19:01:27.62 ID:7/bQUlQ80
何十年も遅れてるレベルかと思ってたけど1年半遅れなんだね
28 : 2026/07/25(土) 19:02:15.39 ID:XLNburNu0
じゃけん、蒸留して短縮しような
29 : 2026/07/25(土) 19:03:32.14 ID:fuO5wUIi0
海外AIに投げるインチキ国産と違ってすごいな
30 : 2026/07/25(土) 19:03:50.81 ID:du5Iocll0
弊社も感覚的には1年半~2年前ぐらいに流行ってたことを今更着手し始めた的な、圧倒的スピード感の無さを感じとります😔
31 : 2026/07/25(土) 19:04:36.65 ID:fbc4YOtR0
10年遅いんだよ
1年半どころではない
32 : 2026/07/25(土) 19:04:59.67 ID:fFwOPJmy0
そのうちどこも大差なくなるか?
33 : 2026/07/25(土) 19:05:51.62 ID:ajJMVaqw0
またトンキン理系のやってる感全開の税金チューチューか
バカなケンモメンは持ち上げそう
34 : 2026/07/25(土) 19:07:13.92 ID:n+8lOYWX0
そもそも事実として遅延してる側がDeepResearchのような既存サービスの真似事やって何になるんだよ
35 : 2026/07/25(土) 19:08:56.64 ID:w4/Mrv6L0
そもそも10年前に事前学習という概念ないだろ
36 : 2026/07/25(土) 19:09:21.03 ID:TU4HoicE0
言語モデルである以上、情報となるデータが多い英語や中国語が圧倒的に有利らしいね
日本語の学習スピードの何倍ものスピードで学習していくから
37 : 2026/07/25(土) 19:10:30.94 ID:w4/Mrv6L0
>>36
スピードというと語弊があるような気がするがデータが多ければ多いほどモデルをデカくできて性能が上がるという経験則はあるらしい
38 : 2026/07/25(土) 19:11:39.60 ID:7xCj5PtT0
まあ頑張って欲しいけど
税金にたからないで自力でまともな競争力つけてくれ
読んでるとなんか凄い自己満感あってヤバい
39 : 2026/07/25(土) 19:12:22.20 ID:w4/Mrv6L0
>>38
サナがAIに投資すると言ってるんだが?
40 : 2026/07/25(土) 19:14:42.08 ID:oaIBCv/F0
3年くらい遅れてないか?
45 : 2026/07/25(土) 19:23:48.63 ID:I/C3O7s20
>>40
1年半は間違っていないと思うぞ
1年前ならgeminiめっちゃ良かったけど
今は最下位だろ?
それぐらい進化が早い
41 : 2026/07/25(土) 19:15:02.30 ID:OkIC9V630
そもそもゲームもアニメも漫画も自動車も家電も半導体も鉄道も建築
農耕から製鉄まで、すべての分野において、日本が先行した産業なんてなくねえか???w
あとからのらりくらり着いていって悪魔改造するのが日本
44 : 2026/07/25(土) 19:22:55.82 ID:JRoNLDN90
>>41
まあ、それはある
応用が異様にうまい
42 : 2026/07/25(土) 19:19:02.00 ID:ovl97o830
なんでフランスと一括りになってるんだ
日本にMistralと同等のLLMあるか?
43 : 2026/07/25(土) 19:21:52.86 ID:JRoNLDN90
ていうか著作権とか肖像権侵害どうすんの?
西側はまずそこでつまづく
46 : 2026/07/25(土) 19:23:50.77 ID:klzXcnkl0
フルスクラッチとか時間と金の無駄だぞ
常に最新モデルをパクって蒸留し続けるくらいじゃないと追いつけない

コメント

タイトルとURLをコピーしました