Yasuhiro Fujita
2026.07.17
Tech
PLaMoベースの強い日本語報酬モデルの構築
By : Yasuhiro Fujita
2025.07.25
大規模言語モデルPLaMo 2シリーズの事後学習
2024.08.07
1,000億パラメータの独自LLM「PLaMo-100B」の事後学習が完了
2017.02.16
深層強化学習ライブラリChainerRL