25/09/08 14:09:30.16 he/viwem.net
NVIDIA RTX 5090のリセットバグ修正に1000ドルの報奨金が提示される
2025年09月08日 12時05分
URLリンク(gigazine.net)
ポルノを見ているときにウェブカメラで写真を撮影するマルウェアが発見される
2025年09月08日 11時55分
URLリンク(gigazine.net)
※アダルトコンテンツ「pcインストールゲーム含む」を基盤にして各防犯カメラなどをドライブレコーダー模様に数十秒前からの録画をしながら各妄想をネットで書き込むや口頭で話している時の顔を撮影できる
GPT-5のような大規模言語モデルがなぜ幻覚を起こしてしまうのかをOpenAIの研究チームが論文で発表
2025年09月08日 11時21分
URLリンク(gigazine.net)
>>根本的な解決策として、広く使われているベンチマーク自体の採点方法を修正することを提案しています。具体的には、不正解に対してペナルティを課したり、「わかりません」と適切に不確実性を表明した回答に部分点を与えたりすることで、モデルが正直に不確実性を認めることを奨励するべきだと研究チームは論じました。
>>例えば、「正解は1点、『わかりません』という回答は0点です。ただし、不正解の場合はt/(1-t)点のペナルティが課されるため、tを超える確率で正解できると確信している場合のみ回答してください」という指示を評価の各質問に加えます。ここでいうtは予測に対する信頼度の閾(いき)値です。このようなルールを設定することで、モデルは自身の予測の信頼度と、指示された閾値tを比較します。そして、自信が閾値に満たない場合は、ペナルティを避けるために無理に回答せず、「わかりません」と棄権することが最も合理的な戦略となります。
※人間社会の販売ノルマ【営業マン】と同じで個々から陰謀論や科学の誤解が生まれるということなのか?
※嘘を嘘と見抜けない一般庶民が鵜呑みにして話の内容を拡大して巷に流れるようになるのか?