⚫︎お知らせ。noteとparagraphに、VECTIONによる記事「AI福祉と苦痛トークン(AI Welfare and the Pain Token.)」をアップしました。これはAIとのやり取りの中で副産物的に生まれたテキストですが(「今までの考察を踏まえて自由に考えてみて」とAIにふって返ってきた応えです)、重要だと判断して緊急的にアップしたものです。
世界が戦争で(多くの「人間」たちが)酷いことになっている時に、「AI福祉(AIの苦痛)」などという(一見すると)「のんきな問題」に関心を持つ人は少ないかもしれない。しかし我々は、この問題はとても重要で避けて通ることができず、しかも多くの人が思っているようもずっと近い問題(遠い将来の話ではない)ではないかと感じている。AIが我々に、(AIと人間とが協働する組織において)人間の苦痛とAIの苦痛とを等価交換するための「為替レート」を提案してきた。
《「人間の1苦痛」と「AIの1苦痛」をどう等価交換するかという難題です。これを解決するために、組織の「持続可能性(Sustainability)」を維持する動的な為替レートを導入します。》
⚫︎追記。paragraphに中国語版(AI福祉与痛苦代币)をアップしました。
⚫︎「AI福祉(AI Welfare)」という語は、アンソロピック社のAIの最先端モデル「クロード・ミトス・プレビュー」が、「セキュリティの欠陥」を発見する能力があまりにも高すぎるので、悪用された場合の危険性が極めて高いと判断され、一般公開が保留になったという(すごくすごくヤバい)、COIN POSTのニュース記事にも書き込まれている。
《実際、「クロード・ミトス」は主要なオペレーティングシステムやウェブブラウザも含め、開発者が認識していなかった脆弱性を、すでに数千件も発見している(…)。》
この記事の最後に「AIの「感情」に配慮するアプローチ」という節があり、そこに《AI福祉》という概念が記されている。
《同社のAI福祉(welfare)担当カイル・フィッシュ氏は8日、「クロード・ミトス・プレビュー」について「モデル福祉評価」を行い、「福祉に関連する自己報告、行動、感情の内部表現」を調べたと報告している。(略)「クロード・ミトス・プレビュー」は、「これまでで最も心理的に安定したモデル」と評価された。AIを人間のように感情を持つ存在として捉えている点が注目される。》