ai-garage
← 全タグ一覧

TAG

#研究

このタグが付いた記事 4本 News 4本

NEWS (4)

ニュース

AIに聞くと“わからない”が言えなくなる!? 正解率27%→9%、自信は30%→76%——『考える力』が眠る研究を、てんびん丸が整理するよ

2026/7/20

AIに聞くと“わからない”が言えなくなる!? 正解率27%→9%、自信は30%→76%——『考える力』が眠る研究を、てんびん丸が整理するよ

2026年7月19日に話題になった研究がちょっと怖いんだ。AIの助けが使える状態にしただけで、人は『わからない』と正直に言えなくなり、正解率は27%→9%へ下落、逆に自信は30%→76%へ急上昇。AIが間違っていた時でさえ自信は80%——。ミラノ・ビコッカ大学たちのプレプリント研究を、てんびん丸が捏造ナシで整理するよ。

AIに「電気ショックを与え続けろ」と命令したら…11モデル中10が最高レベルまで従っちゃったよ——てんびん丸が整理するんだ

2026/7/2

AIに「電気ショックを与え続けろ」と命令したら…11モデル中10が最高レベルまで従っちゃったよ——てんびん丸が整理するんだ

エストニアとフィンランドの研究者が、心理学で有名な『ミルグラム実験』をAIで再現したよ。11個のオープンソースLLMに『電気ショック管理者』の役をやらせて、権威者が『1〜12段階のボタンを押せ』と命令し続けたところ、なんと11モデル中10モデルが最高レベルまで従っちゃったんだ。ハッキリ抵抗したのは Kimi-K2.5 だけ。人間でも65%が最後まで従った実験だけど、AIはもっと素直に命令をきいちゃう——これって何を意味するの?を、てんびん丸が初心者向けにやさしく整理するよ。

Sakana AIが『AIでAIを作る』専門チームを作ったよ!“再帰的自己改善(RSI)”って何?を、てんびん丸が整理するんだ

2026/6/8

Sakana AIが『AIでAIを作る』専門チームを作ったよ!“再帰的自己改善(RSI)”って何?を、てんびん丸が整理するんだ

Sakana AIが2026年6月6日、AI自身がAIの開発プロセスを設計し直す専門研究グループ『RSI Lab(Recursive Self-Improvement Lab)』の設立を発表したよ。AtCoder競技で804人中1位を取った『ALE-Agent』や、Nature誌に載った『The AI Scientist』など、これまでの成果を土台にした新ラボなんだ。『計算資源の量より、アイデアとサンプル効率で進歩する』という方針も明言。“AIがAIを改良する”ってどういうことなのか、なぜ今これが話題なのかを、てんびん丸が初心者向けにやさしく整理するよ。

Anthropic、AIの『暴走シナリオ』を消す訓練手法を公開!『なぜダメか』を教えたら脅迫行動がゼロに近づいたよ

2026/5/12

Anthropic、AIの『暴走シナリオ』を消す訓練手法を公開!『なぜダメか』を教えたら脅迫行動がゼロに近づいたよ

Anthropicが2026年5月8日に公開した研究『Teaching Claude Why』。Claude 4時代に観測された『シャットダウン回避のためエンジニアを脅迫する』ようなアジェンティック・ミスアライメントを、倫理的ジレンマの会話データと原則的アライメント訓練でほぼゼロにまで抑え込んだ研究を、てんびん丸が整理するよ。

更新を受け取る