EPISODE · Aug 4, 2025 · 6 MIN
AIの“性格”を可視化/制御、「ペルソナベクトル」で暴走やゴマすりを監視 #79
from CC AI Lab|コンタクトセンター×AI · host 千葉貴史/Edge Works
AIに「性格」があるとしたら、あなたはどんな性格を望みますか?今回は、大規模言語モデル(LLM)が持つパーソナリティ特性を制御・監視する画期的手法「ペルソナベクトル」をご紹介します。ペルソナベクトルとは、モデル内部の表現空間に存在する特定の方向性を示すもので、「悪意」「お世辞」「幻覚」といった、AIが示す様々な性質を自動的に抽出・可視化できます。この技術により、モデルの問題行動をリアルタイムで監視したり、望ましくない振る舞いを事前に防いだりすることが可能になります。さらに、この手法を用いることで、問題のあるトレーニングデータの特定や、将来起こり得るモデルの性格変化の予測も可能になるとのこと。AIの暴走やゴマすりを防ぐ新たな一歩を詳しく掘り下げていきます。▼参照https://www.anthropic.com/research/persona-vectors▼運営Edge Works株式会社https://edge-works.ai
Embed this episode
Ready to play
AIの“性格”を可視化/制御、「ペルソナベクトル」で暴走やゴマすりを監視 #79
No transcript for this episode yet
Similar Episodes
No similar episodes found.