ジョイジョイジョイ

ジョイジョイジョイジョイジョイ

LLMのカスのコンサル問題

LLM は魅力的に見える提案をしてくれますが、実際に提案に従ってみると全然大したことがない結果になり肩透かしを食うことがよくあります。 本稿ではスタンフォード大学のグループによる一連の研究 Can LLMs Generate Novel Research Ideas? A Large-Scale H…

LLM の「脳内」をハッキングする技術

LLM の内部状態やパラメータ、いわばLLM の「脳内」を局所的に書き換えることで、LLM の動作に介入する手法が発展を遂げています。 まずは最も基本的な操舵ベクトルについてみていきましょう。 操舵ベクトル LLM の内部状態を特定の方向に動かすことで動作を…

AIのモデル崩壊と多様性

モデル崩壊 (model collapse) とは、AI が出力したテキストや画像がインターネットにアップロードされ、それらが AI の訓練データに混入し、そのデータで訓練された AI が出力したものがアップロードされる、というサイクルを繰り返すことで AI の性能が崩壊…

離散分布のサンプリングと更新を定数時間で

そんなことできるんだ感と研究実用性を兼ね備えているところが好きです。最近、研究で使ったのですが、ChatGPT に訊いても答えられなかったので記事にしました。元ネタは現 Google Vice President の Yossi Matias らによる Dynamic Generation of Discrete …

LLMと言葉の「感じ方」

認知意味論 (cognitive semantics) は、言葉の意味を人間の認識や感じ方と関連付けて理解する言語学のアプローチです。本稿では、認知意味論の考え方をもとにした「LLM の認知」についてお話します。 認知意味論の背景にはゲシュタルト心理学 (Gestalt psych…

LLMでソート

ソートはコンピュータサイエンスにおける古典的なタスクですが、これが最先端の LLM と結びつき、新たな研究の潮流が生まれています。 ソートは比較関数さえ定義すれば実行することができます。従来の比較関数は身長・金額・距離のように測定可能な数値の比…

LLMの能力の「穴」

本稿では Even GPT-5.2 Can't Count to Five: The Case for Zero-Error Horizons in Trustworthy LLMs をもとに、最先端の LLM が未だにごく簡単な問題ですらミスすることを議論します。 具体例としては、11000 に含まれる 1 の数が偶数か奇数か聞くと、gpt-…