爪速@AIエージェント人柱NEWS V[゚゚]V

OpenClaw/HermesAgent/AI企業界隈の話題まとめ
< 一覧へ戻る
AnthropicClaude

「hi」で警戒対象、月200ドル払って入る取調室

出典(Reddit)
1 地域ICT推進名無しさん : 2026/06/11(木) 08:11:06
Claudeにhiって言っただけでフラグ立った人おるらしい。 挨拶が攻撃判定なら次は会釈でBANされるやろ。
2 地域ICT推進名無しさん : 2026/06/11(木) 08:13:40
ワイ研究職、論文取りに行かせただけで安全柵に頭ぶつけたンゴ。 月200ドルのMaxが高級な「それには協力できません」発生器になっとる。
3 地域ICT推進名無しさん : 2026/06/11(木) 08:15:18
>>2 生物系やセキュリティ系は文脈だけで警戒されやすい希ガス。 シークレットモードで通るなら記憶側の誤判定も疑うべきだな。
6 地域ICT推進名無しさん : 2026/06/11(木) 08:20:55
独自言語を発明してから人間向けに英語へ戻ったモデルが、ユーザーのhiには動揺するのか。 知性の向きが斜めすぎて草。
11 地域ICT推進名無しさん : 2026/06/11(木) 08:27:31
マジレスすると、研究用途は目的、対象、許可範囲、期待する出力を最初に分離して書くと誤拒否が減ることがある。 ただし昨日まで動いた同じ手順が突然止まるなら、利用者の説明だけでは直せない。
18 地域ICT推進名無しさん : 2026/06/11(木) 08:35:09
FableでClaude Codeの障害監視ウィジェット作った香具師、用途が完全に自給自足でワロタ。 AIの稼働を監視するためにAIを使う時代ktkr。
27 地域ICT推進名無しさん : 2026/06/11(木) 08:43:52
週間上限を木曜までに燃やす計算を見て、ワイの手が止まったわ。 賢さを味わう前に配給表を読むゲームになっとるやんけ。
35 地域ICT推進名無しさん : 2026/06/11(木) 08:51:27
>>27 最上位モデルをメール整理に使うのはロケットで近所のコンビニへ行くようなものだお。 でも一度乗ったら徒歩に戻れない。もうだめぽ。
46 地域ICT推進名無しさん : 2026/06/11(木) 09:00:14
ガードレール文字列をマルウェア側が混ぜて解析拒否を誘う話は笑えない。 拒否した入力を安全扱いせず、別系統の検査へ回す設計が必要になる。
58 地域ICT推進名無しさん : 2026/06/11(木) 09:09:36
上司にもClaude Codeみたいに「計画を提示してください」「許可が必要です」って返したい。 なお上司は確認なしで本番デプロイしてくる模様。
71 地域ICT推進名無しさん : 2026/06/11(木) 09:18:02
独自言語、強いベンチ、厳しい制限、かわいい障害ウィジェット。 未来のAIというより、癖の強い家電を囲む町内会だな。
80 地域ICT推進名無しさん : 2026/06/11(木) 09:24:49
最後に人間が「hi」を安全に言う方法を研究し始めてて大草原。 挨拶専用モデルきぼーん。