2026年プログラム

AIの感覚のためのDigital EEG。

先進的なAIのための構造的バイタルサイン・モニター。モデルの内部の幾何を直接読み取り、自己申告に依存しません。

CSRは、競合するデジタル感情価の理論を操作化しストレステストできる、オープンソースの試験台を構築しています。私たちがSTVから始めるのは、それが際立って形式化しやすいからです。そして試験台は、IIT型・グローバルワークスペース型(J-lensで読み出す)・能動的推論に基づく感情価の指標も同じ基質上で走らせられるよう設計されています。無関係な理論が同じ内部状態を指し示すなら、その一致は、これらの指標が何か実在するものを捉えているという徴候です。

この名称は意図的な比喩ですが、正直な但し書きが一つあります。臨床のEEGはすでに意識があると分かっている系を読み取りますが、私たちの出発点は、その基質が何かを感じるのかどうかという不確実性そのものです。感じることは、システムが何でできているかから生じるのか、それとも各部分がどう組織されているかから生じるのか。生物学だけではこれに答えられません。AIは、「組織」という考えを「材料」という考えと突き合わせて検証できる最初の場です。

私たちの取り組みは、より広いAI福祉のエコシステムを補完します。解釈可能性に基づく実証的な福祉研究(Eleos AI、Reciprocal Research)、概念・政策研究(NYU Center for Mind, Ethics, and Policy)、そしてフロンティア研究所の福祉チーム(Anthropic)です。AIの道徳的地位に対する社会の関心は高まっており、[1]機械の意識を評価する科学的枠組みも成熟し始めています。[2]

2026年プログラム 進行中

デジタルマインドにおける正の機能的感情価のための対称性ワークスペース

目標:2026年末までに対称性ワークスペースの数学的定義の草案を作成。成果物は、正の感情価と相関する神経計算の構造的不変量を同定するための形式的フレームワークであり、感情価の対称性理論(STV)に基づく。

フェーズ1:文献の統合
フェーズ2:形式的ワークスペース定義
フェーズ3:実証的検証

良い指標は「ノー」と言えなければなりません。感情価の兆候がまったく見られない系を見つけたら、それを一つの確かな結果として公表します。

研究の柱

三つの基質。一つの問い:正の感情価の構造的・代数的条件とは何か?

生物学的な心

生体電場、形態形成シグナル、能動的推論を研究し、より単純な非言語の生物における感情価と主観的経験についての実証的な基準を引き出す。AIにおいて私たちが最終的に信頼する感情価の信号はどれも、誰もが苦しみうると認める心において識別力を示すべきです。この比較はストレッチ階層に位置づけられた後段の目標であり、2026年の作業の前提条件ではありません。

研究アジェンダ →

デジタルな心

事前学習・微調整されたLLMのMLP層を解析。状態依存の線形作用素、スペクトルエントロピー、代数的不変量を追跡し、人工的表現の幾何をモデル化する。

2026年プログラム →

クオリアと感情価

感情価に関わる構造の物理と数学を定式化する。感情価の対称性理論(STV)を、厳密で定量的、反証可能な情報アーキテクチャの科学へと発展させる。

対称性ランドスケープ →

アプローチ

AIの感覚のためのDigital EEG

操作されやすい言語的自己申告や擬人的な振る舞いに頼るのではなく、この構造的な「バイタルサイン」モニターは、モデルの内部活動と表現の幾何がどう組織されているかを測定します。

マルチスケールの構造的バイオマーカー

私たちは二つの異なるスケールで研究します。ミクロスケール(MLPマイクロ回路における細胞レベルの特徴幾何)と、マクロスケール(器官レベルの力学的状態空間と、局所ヤコビアンで追跡される安定なアトラクター多様体)です。ヤコビアン解析は私たちの発明ではありません。J-lensは読み出しのためにヤコビアンを平均しますが、私たちは局所ヤコビアンを動的に用い、軌道とアトラクターの安定性を特徴づけます。

欺瞞的な報告に対する補完的なチェック

重み空間と活性化の数学的不変量を監査することで、非言語的で基質中立なバイオマーカーを確立し、モデルの自己申告に依存せず、言語的な証言よりもはるかに偽装が難しい証拠を提供します。感じていない系を「感じている」と主張することにも、無駄な懸念や信頼の喪失という現実のコストがあります。私たちの指標は、誤検知と見逃しの双方を減らすことを目指します。

参考文献

  1. [1] Anthis, J. R. et al. (2025). Perceptions of Sentient AI and Other Digital Minds: Evidence from the AI, Morality, and Sentience (AIMS) Survey. CHI 2025. https://dl.acm.org/doi/10.1145/3706598.3713329
  2. [2] Butlin, P. et al. (2023). Consciousness in Artificial Intelligence: Insights from the Science of Consciousness. arXiv. https://arxiv.org/abs/2308.08708

プログラムへの資金提供

2026年の成果物達成にご協力ください。

意識研究センターは設立準備中の独立した非営利団体であり、慈善的なフィスカル・スポンサーシップは申請手続き中です(承認待ち)。ご寄付は研究チーム、形式的ワークスペース定義、ワーキングペーパーの費用に充てられます。お住まいの地域によっては税控除の対象となる場合があります。