Vol.62 LLMの推論能力を支える「内部対話」のメカニズム
推論モデル(リーズニングモデル)というのが多く使われるようになっていて、性能も高いし、今までのモデルと比べて能力の幅も…...続きを読む
推論モデル(リーズニングモデル)というのが多く使われるようになっていて、性能も高いし、今までのモデルと比べて能力の幅も…...続きを読む
今日の話は、Engram(エングラム)というDeepSeekの研究なんですが、これは何かと言うと、LLMに条件付きメモリ...続きを読む
※英語でのトークを翻訳しています。◆Jubatusから集中型学習へ 今回の話は、分散学習(Distributed Tra...続きを読む
◆開発の目的と成果 今回は、GENIAC第3期でPFNが開発を進めているPLaMo VLM(大規模視覚言語モデル)の話を...続きを読む
◆100兆トークンから読み解く利用実態 今のLLMが「どういったところに利用されてるのか」というのを調査した結果レポート...続きを読む
◆オープンモデルの安全性に関する議論とリスク オープンモデルに関しての安全性を議論している論文で、有名な人たち、例えばB...続きを読む
◆エージェント学習の課題と「統一フォーマット」の提案 エージェント・データ・プロトコルの話をします。これは、CMUのNe...続きを読む
◆汎用的な画像表現学習の課題 今日の話は画像の話で、Perception Encoderという研究を紹介します。これはN...続きを読む
今日は少し前に話題になったハルシネーションに関する論文です。◆OpenAIによるハルシネーション問題の新たな分析 これは...続きを読む
先日、Matlantis(AI技術を応用して新素材の探索や開発を高速化するクラウドサービスを販売しているグループ会社)の...続きを読む

