A Survey of Efficient Reasoning for Large Reasoning Models: Language, Multimodality, and Beyond

Measurement of LLM’s Philosophies of Human Nature

  • Measurement of LLM’s Philosophies of Human Nature [113.5]
    大規模言語モデル(LLM)を対象とする標準化された心理尺度を設計する。 現在のLSMは、人間に対する信頼の欠如を示す。 本稿では,LLMが継続的に価値体系を最適化できるメンタルループ学習フレームワークを提案する。
    論文  参考訳(メタデータ)   (Thu, 03 Apr 2025 06:22:19 GMT)
  • 「Machinebased Philosophies of Human Nature Scale (M-PHNS)」とLLMの人間性に対する評価を行うツールの提案。「Most models exhibit varying degrees of negative tendencies, such as perceiving humans as untrustworthy, selfish, and volatile. These tendencies intensify as the intelligence level of the model increases. This phenomenon is consistent regardless of the model’s developer or whether the model is open-source.」という結果が面白い。これらを修正するフレームワークも提案しているが、これが良いのかは若干謎。
  • リポジトリはkodenii/M-PHNS · GitHub