| 講演抄録/キーワード |
| 講演名 |
2025-12-04 10:25
LLM を用いた高齢者向け会話文平易化: SFT と PPO によるやさしい日本語生成 ○下浦隼矢・奥原 俊(三重大) Consen2025-18 |
| 抄録 |
(和) |
日本語の自動平易化研究は主として書き言葉を対象として発展してきたが,会話文は省略・言い直し・過剰敬
語・二重否定など会話固有の現象により,依然として理解負荷が高い.本研究は高齢者の理解容易性向上を目的に,会話
文に特化した「やさしい日本語」生成を行う.ベースとして日本語指示追従モデル llm-jp/llm-jp-3-1.8b-instruct
を採用し,まず既存の平易化対訳で教師あり微調整(SFT)を行い,続いて会話プロンプト集合上で強化学習(PPO)
により生成方策を最適化する.報酬は JReadability(高いほど読みやすい),係り受け解析に基づく構文単純性(最大
依存深さ・分岐数・平均依存距離等),二重否定検出,意味類似(参照欠如時はプロンプト類似),および言語モデル
Perplexity と出力衛生から構成する多目的設計とした.Apple Silicon 上の PyTorch MPS で実装し,SFT と PPO の両段
階で同一ファミリ・同一トークナイザを用いて統一した.定量評価は未実施だが,代表例の観察から,PPO により主
述対応の明確化や依存の浅化など構文的正確性が改善する一方,二重否定の抑制は限定的であった.これは強化学習
データにおける該当現象の希少性に起因すると考えられる.今後は RL データの拡充と,会話特有の難しさを捉える
定量指標の設計・評価を進める. |
| (英) |
|
| キーワード |
(和) |
日本語会話文平易化 / 高齢者支援 / 教師あり微調整(SFT) / 近似方策最適化(PPO) / / / / |
| (英) |
/ / / / / / / |
| 文献情報 |
信学技報, vol. 125, no. 272, Consen2025-18, pp. 14-17, 2025年12月. |
| 資料番号 |
Consen2025-18 |
| 発行日 |
2025-11-27 (Consen) |
| ISSN |
Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
Consen2025-18 |