※アドブロック等の広告非表示プラグインやアドオンを利用している場合、一部のコンテンツが表示されなくなったり、サイト全体のレイアウトが崩れたりする場合があります。

富士通、AIのTransformer層の差し替えだけで「メモリ使用量1/10」「処理速度475倍」になる魔改造を発表

Hands off my tags! Michael GaidaによるPixabayからの画像
Hands off my tags! Michael GaidaによるPixabayからの画像
1 : 2026/08/10(月) 12:05:08.47 BE:422186189-PLT(12015)

AIの基盤モデルの高性能化を巡り、世界中で競争が激化している。Noetra(ノエトラ)に代表されるように、日本でも国産モデル開発の機運が高まってきた。ただし、研究開発でも巨額の投資でも大幅に先行する米国や中国に、日本が伍していくのは容易ではない。そこで重要になるのが、より少ない計算資源で、より高い性能を見込める独自の技術である。

その候補の一つになりうる新たなアーキテクチャを富士通が開発した。既存のLLM(大規模言語モデル)ベースの基盤モデルが利用するTransformerのメモリの利用効率を大幅に高める「PHOTON」と呼ぶ技術である。

同社の実験によればメモリ容量当たりのトークンの処理速度(スループット)を、最大で1000倍以上に高められるという。

2026年7月に開催した自然言語処理のトップ会議「ACL 2026」で発表した1)、注1)。

《日経Robotics》富士通が新型Transformer提案、メモリ当たりの処理速度を最大3桁向上
 AIの基盤モデルの高性能化を巡り、世界中で競争が激化している。Noetra(ノエトラ)に代表されるように、日本でも国産モデル開発の機運が高まってきた。
PR

NVIDIA 900-21001-0020-100 グラフィックス処理ユニット GPU A100 80GB HBM2e メモリ 2Xスロット PCIe 4.0 x16 GPUカード

Amazonで見る価格、在庫およびポイント情報は表示された日時の時点のものであり、変更される場合があります。本商品の購入においては、購入時にAmazon.co.jpに表示されている情報が適用されます。

13 : 2026/08/10(月) 12:14:40.45

>>1
省電力化は日本の得意分野だからマジで頑張ってほしいな

問題はLLMの成長が止まりつつあって
AI開発が他の方法にシフトしていくスピードが速いと
せっかく省電力化しても誰ももう使わないみたいになっちゃうリスクが(´・ω・`)

83 : 2026/08/10(月) 18:43:40.07
>>1
本当に?
また営業が安請け合いしてるだけなんじゃないの?
富士通案件は現場が悲惨なんだよなぁ

84 : 2026/08/10(月) 18:50:13.74
>>83
まだ研究段階のものに営業も何もないw
何ならarXivで論文読めるし

2 : 2026/08/10(月) 12:05:33.73 BE:422186189-PLT(12015)

3 : 2026/08/10(月) 12:06:11.59

>>2
国産化だけ教えて

笑えるか笑えないか

4 : 2026/08/10(月) 12:06:31.89 BE:422186189-PLT(12015)
必要なメモリが1/10に
メモリ帯域の問題が解決して475倍速に

5 : 2026/08/10(月) 12:06:57.13 BE:422186189-PLT(12015)
マグナRAMのようなもの

6 : 2026/08/10(月) 12:07:13.03 BE:422186189-PLT(12015)
RAMダブラーのようなもの

91 : 2026/08/10(月) 21:44:34.10

>>6

「またあの嫌なConfigPPPが」
とかいう時代



名無しさんのおすすめ

7 : 2026/08/10(月) 12:07:42.49
トークン節約できるのは大きいけど、とういう技術?
AIに要約して貰うか

50 : 2026/08/10(月) 13:02:21.47
>>7
トークンの処理速度が上がるだけで、トークン量は変わらないのでは?

9 : 2026/08/10(月) 12:09:44.77
新しいことより既存のをまともに作れるようになれよ

10 : 2026/08/10(月) 12:11:31.34
ノエトラって成功すんのかあれ

11 : 2026/08/10(月) 12:11:46.51
数字ばっかり一人歩きして使えない技術が富士通多いよな

73 : 2026/08/10(月) 17:40:42.66
>>11
不治痛だから

12 : 2026/08/10(月) 12:14:26.39
某動画で「勝ったも同然」て連呼してて草だった
何にいつ勝つんですか?

14 : 2026/08/10(月) 12:16:11.63
vram4gbでもローカルLLMを動作させられるようになつのか

17 : 2026/08/10(月) 12:19:46.07
>>14
推論の過程の話だからならんやろ
結局はそれなりのモデルをvramにロードしない事には始まらん

41 : 2026/08/10(月) 12:49:48.76
>>14
何でも良けりゃ今でもスマホでも動くぞ

15 : 2026/08/10(月) 12:17:47.27
ノイトラ?

16 : 2026/08/10(月) 12:18:08.66
うさんくさい

18 : 2026/08/10(月) 12:20:10.13
AMDのCPUで鉛筆で線引くとクロック上がるみたいなやつ?

76 : 2026/08/10(月) 18:08:19.43
>>18
何その CD にカッターで筋入れると音が良くなるみたいなやつ

19 : 2026/08/10(月) 12:20:14.24
経産省がAIに金ばらまくから
どーせ突貫で考えただろ

32 : 2026/08/10(月) 12:28:25.38
>>19
そんなものを国際会議で発表するわけないだろ
そんなことしたら大問題だ


20 : 2026/08/10(月) 12:20:56.90
でも激アツになるんでしょう?

21 : 2026/08/10(月) 12:21:43.10
新しく産み出す事は苦手だけど変態魔改造だけは得意な日本らしい

22 : 2026/08/10(月) 12:22:59.88
本当に有用な技術ならすぐに真似されて追いつかれる
優位性と言っても長くは持たないだろう

23 : 2026/08/10(月) 12:23:19.31
中国もNvidiaのチップに比べて糞遅い国産チップをいかに効率よく単純な性能以上に活用できる技術開発してるし
豊富な資金と力業で対抗できない国は技術で対抗するしかないからな

27 : 2026/08/10(月) 12:24:13.75
>>23
中華は既に使えるもん出してるしな
もはや日本は口だけで悲しい

38 : 2026/08/10(月) 12:43:47.86
>>27
使ってるだけで使えるかは微妙だろ中国は未完成でも市場に並ぶ

70 : 2026/08/10(月) 16:01:01.08
>>23
最近作ったスパコンはCPU単体じゃGPU単体に効率じゃ敵わないから
物量と電力使って解決するという脳筋仕様だったが

24 : 2026/08/10(月) 12:23:41.36
逆にメモリの容量をおもいっきり使って処理能力をさらに倍の倍の倍になったりとかせんの?

25 : 2026/08/10(月) 12:23:46.28
成功したらまたアメリカに潰されそう

26 : 2026/08/10(月) 12:23:48.20
縦型メモリハード限定?

29 : 2026/08/10(月) 12:24:31.28
今日のジャッぷ企業お得意、いつものウソ・大げさ・まぎらわしい

75 : 2026/08/10(月) 18:03:40.46

>>29
日本のAI関連の歴史に嫉妬するなよ

文字認識や音声でとっくの昔にインフラに組み込まれてるわ

30 : 2026/08/10(月) 12:26:37.56
よくわからんけど、メモリ安くしてくれ

33 : 2026/08/10(月) 12:28:41.50
日本すごいは日本でしか通用しない。

34 : 2026/08/10(月) 12:29:41.40

もともとPHOTONはメモリ効率を優先した軽量な設計になっているため、単発の推論では従来のTransformerより若干精度が落ちる。その精度低下を補うために、複数解釈を並列で走らせて多数決を取る、という位置づけです。

同じGPUメモリで通常なら1つしか走らせられない推論を、複数同時に並列実行できる。この「同じメモリ予算でたくさん処理できる」効率化こそが475倍という数字の正体です。

42 : 2026/08/10(月) 12:50:39.28
>>34
単発の推論は帰納的な解答が求められる一般層にはありがたがられるが
研究や業務用途では複数解答こそが求められる

35 : 2026/08/10(月) 12:31:46.56
で、関係するエンジニアは今の報酬の20倍の金額で海外に引き抜かれると。

36 : 2026/08/10(月) 12:35:53.06
サイバトロン派

37 : 2026/08/10(月) 12:38:06.09
マジで頑張ってほしい
国産AIが米中に追いつき追い越すには圧倒的な効率化という方向を目指すしかない
基礎技術ではすでに勝負付いてるからな

40 : 2026/08/10(月) 12:49:39.49
「私にいい考えがある」

43 : 2026/08/10(月) 12:51:21.07
メモリ暴落はよ

44 : 2026/08/10(月) 12:51:59.92
技術は凄いのかも知れないけど
理論値ではなく実測値はどうなるんだろ?
あとは信頼性とプロダクションキャパシティの問題か
どんなに優れた物でも歩留まり率が悪かったら儲からないしね

48 : 2026/08/10(月) 12:58:25.10
>>44
歩留まり???

49 : 2026/08/10(月) 13:02:14.93
>>48
製造における良品率ってことね

52 : 2026/08/10(月) 13:07:52.36
>>49
それはこの話には何の関係もないんだが

55 : 2026/08/10(月) 13:10:01.36
>>52
関係あるよ儲からないものにはお金が集まらない
お金が集まらなければ事業を展開出来ない
絵に描いた餅で終わってしまう

56 : 2026/08/10(月) 13:16:07.28
>>55
これは富士通の研究だから金集まる集まらないは関係ないんだが
富士通の金でやってることなんだから
今後富士通がAI関連の事業した時に売れるか売れないかは別の話だが、AIの性能に問題なければメモリの使用量を抑えられる分安く企業に売れるから競争力はあるんじゃないかね

59 : 2026/08/10(月) 13:25:02.85
>>55
製造と何の関係が?
知ったかぶりにしてもひでぇな
ホイ卒じゃねぇか

57 : 2026/08/10(月) 13:17:20.10
>>49
ソフトウェアの話だっての分かってるか?

74 : 2026/08/10(月) 17:43:00.71
>>57
ホームラン級の池沼だと思ったわ

45 : 2026/08/10(月) 12:52:45.79
結局他国のAI頼り

51 : 2026/08/10(月) 13:03:02.48
まあ処理効率が上がればトークンあたりの単価も下がるか

54 : 2026/08/10(月) 13:09:50.80
これアメリカAIの10分の1の資金でAI作れるって事?
さっそく天才AI集団松尾研究所を支援してミュトスみたいの作らせろよ

58 : 2026/08/10(月) 13:17:28.70
日本企業だし
どうせホラッチョじゃないのはt

68 : 2026/08/10(月) 14:55:18.36
またこれをネタに世界が驚愕する日本のAIとかいう
変な動画がでまわるのか


72 : 2026/08/10(月) 16:38:15.84
これ覇権?

85 : 2026/08/10(月) 19:15:23.39
PHOTONで検索して見てみたけど今度は本物の感じがした

87 : 2026/08/10(月) 20:52:10.02
トランスフォーマー?

93 : 2026/08/10(月) 22:44:47.95
なんでほかの物つくらないの?

95 : 2026/08/12(水) 14:30:18.26
こういうのが「大学の優れた研究」止まりでいつもいつも日の目を見ることなく埋没していくのが日本だってよby Gemini

101 : 2026/08/12(水) 15:33:25.03

KVはいいとして、1ビット量子化して大丈夫なの?1.58で非線形にしなきゃダメとかだったような?
>>>
PHOTON
意味単位処理+階層化でKVキャッシュを縮小
長文・多クエリで圧倒的(475倍)

アーキテクチャ変更(Transformerではない)
1ビット量子化(Takane)
重みを1ビット化してモデルサイズを縮小メモリ94%削減、速度3倍
既存Transformerに適用可能
<<<

102 : 2026/08/12(水) 15:38:44.00
>>101
すごそう(小並感)
>>>
1⃣ QEP(Quantization Error Propagation)
→ 1ビット化で失われる情報を“誤差として別経路で伝搬”させる
→ 実質的に「1ビット+補助情報」で1.58bit相当の表現力を確保
2⃣ QQA(Quantized Query Attention)
→ Attentionの線形性が壊れる部分を補正
→ 1ビット化してもAttentionの分布が崩れないようにする
3⃣ Takane全体での再学習(再最適化)
→ 単なる量子化ではなく、1ビット化した状態で再学習して線形性を復元する(LoRAに近いがもっと軽量)

103 : 2026/08/12(水) 17:19:27.55
自然を忘れた科学には、幸せ導く視点がない。