大規模言語モデル(教師 gpt-oss-20b)の知識を小規模モデル(生徒 Llama 3.2 1B)に移す「応答蒸留」を、異なるプロバイダー間で実装してみました。生徒の精度が大幅に向上し、さらには教師を上回る結果も得られました。
アンソロピック、評価額141兆円でOpenAI超えへ──人類史上最大の資金調達ラウンド(Forbes JAPAN) - Yahoo!ニュース
山一電機---大幅反落、業績・配当予想上方修正も出尽くし感優勢に - 最新株式ニュース
ライザップ、病歴など生成AIに誤送信 保健指導利用者らの2万件か
10社以上が挑んだ「フルスクラッチ国産LLM」。PFNはなぜ「PLaMo」をつくり続けられるのか - レバテックLAB
生成AI時代の クレデンシャルとパーミッション設計
まだコメントはありません。
コメントを送信しました。