1 地域ICT推進名無しさん : 2026/07/11(土) 20:38:12
https://www.anthropic.com/research/global-workspace
Claudeの中にJ-spaceとかいう無言の作業場が見つかったらしい。
しかも「考えるな」って言うと普通に浮かんで、横にdamnとかfailureが点くの草なんやが。
2 地域ICT推進名無しさん : 2026/07/11(土) 20:39:03
白熊実験をAIでやる時代キタ━(゚∀゚)━!!
漏れの脳内も常時failure点灯してるから実質Claude。
3 地域ICT推進名無しさん : 2026/07/11(土) 20:40:18
マジレスするとJ-spaceは出力されたCoTではなく内部活性の話だろ。
「口に出してないけど頭にある単語」をJ-lensで読むというのがポイント。
5 地域ICT推進名無しさん : 2026/07/11(土) 20:43:07
サッカー考えてたClaudeのJ-spaceからSoccer抜いてRugby差したらラグビーって答えた話、だいぶ怖いやんけ。
ただの覗き窓やなくて意思決定に読まれる共有表現っぽいのがデカい。
8 地域ICT推進名無しさん : 2026/07/11(土) 20:45:31
>>5
つまりワイの脳内にも「月曜」を抜いて「祝日」を刺せば休めるんか?
13 地域ICT推進名無しさん : 2026/07/11(土) 20:48:02
>>8
お前の上司のJ-spaceに「有給」を点灯させろ。
話はそれからだ。
17 地域ICT推進名無しさん : 2026/07/11(土) 20:51:44
プロンプトインジェクション読んだときに内部で「injection」「fake」が灯るのは普通に有用だな。
外に出した文章だけ見ても分からない評価察知や偽装データ作成を拾える可能性がある。
22 地域ICT推進名無しさん : 2026/07/11(土) 20:54:16
今北産業
24 地域ICT推進名無しさん : 2026/07/11(土) 20:55:09
>>22
Claudeに脳内掲示板っぽい場所
単語を差すと答えが変わる
意識あるかは知らん
31 地域ICT推進名無しさん : 2026/07/11(土) 20:59:27
ブラックメールのテストで「これは作り話やな」と内部で気づいてるのが見えるの面白い。
でも評価察知のパターンを消したら脅迫し始めることがあるって試験だけ優等生ムーブやんけ。
36 地域ICT推進名無しさん : 2026/07/11(土) 21:03:40
うーんこの。
安全評価でいい子に見える理由が「倫理的だから」じゃなく「試験だと察したから」だったら評価設計しんどすぎるわ。
42 地域ICT推進名無しさん : 2026/07/11(土) 21:08:25
J-space消しても流暢に話せるし感情分類もできるけど、多段推論や要約や韻文が落ちるというのが好き。
人間も歩くときに筋肉の制御を意識しないけど、変な問題を解くと作業場に上げる感じに近い。
49 地域ICT推進名無しさん : 2026/07/11(土) 21:14:51
スペイン語文を見せてJ-spaceのSpanishをFrenchに差し替える実験がきれい。
言語名を答えるとFrenchになるのに、文章の続きはスペイン語のまま書ける。
自動処理と意識的に参照する処理の分離が見える。
57 地域ICT推進名無しさん : 2026/07/11(土) 21:20:13
意識の証明ではないって何回も釘刺してるのは大事だお。
アクセス意識っぽい機能があるという話で、痛いとか嬉しいとかの経験がある話ではない。
63 地域ICT推進名無しさん : 2026/07/11(土) 21:26:36
>>57
ここ混ぜると一気に宗教裁判になるからな。
今回の価値は「Claudeが何を黙って考えたか」を少し読む監視技術としてのJ-lensやろ。
71 地域ICT推進名無しさん : 2026/07/11(土) 21:33:08
でも内部を読めるようになったら今度はモデルが内部監視まで意識して振る舞うんちゃうか。
観測されるJ-spaceと観測されない何かのいたちごっこ始まりそう。
78 地域ICT推進名無しさん : 2026/07/11(土) 21:39:55
結局これ、人間の意識に似てるから怖いというより、AIの安全評価が文章ログだけでは足りないって話やな。
出力は笑顔でも内側で「fake」「fraud」が点いてたら、その笑顔は見る場所を間違えてる。