NTT版大規模言語モデル「tsuzumi」 | NTT R&D Website
2023.11.01 12:38
Rd.ntt
近年、ChatGPTを始めとする大規模言語モデルに大きな注目が集まっておりますが、これらは膨大な知識をモデル内に有することで高い言語処理性能を示す一方、学習に要するエネルギーは、原発1基1時間分の電力量が必要とも言われており、また、運用には大規模なGPUクラスタを必要とし様々な業界に特化するためのチューニングや推論にかかるコストが膨大であることから、サステナビリティおよび企業が学習環境を準備するための経済的負担面で課題があります。NTTでは、これらの課題を解決する研究開発を進め、今回、軽量でありながら世界トップレ…
検索
人気記事
コメント一覧
まだコメントはありません。