この記事を書くかどうかにはじゃっかんの躊躇があるのだが、とりあえずはてなブログの記事として提出しておけば、いちおうは批判可能な形になると思い公開することにした。というわけで、この記事は弁明の記事である。たいへん申し訳ございませんでした。もし納得が行かない点があれば、自由に本記事を引用してボコボコにしてくださって構いません。 弁明 mechanical interpretability(MI)とは、計算言語学・自然言語処理における概念であり、たとえば大規模言語モデルの内部パラメータを人間にとって理解可能な形でデコードするような研究を指す。問題はこの mechanical interpretabi…