OpenAI発表 2026-09-30 ・ レビュー 2026-10-02
自社モデルの「保護された推論」を抜き取る活動を7月に遮断し、9/30に公表。1万5,000超のユーザーの集団、数字は「試み」。他人の暗号化推論を再生できる経路を閉鎖、Frontier Model Forumと政府に共有。情報の線引きが、提供元どうしの間にも引かれた。帰属の根拠は未提示。
記事を読む
用語解説公開 2026-10-02
大きなモデルの出力や推論を教材に、別のモデルを訓練する技術。自社内なら正規、他社から組織的かつ無許可で抜けば敵対的蒸留。安全策は出力と提供条件に付いていて推論には付いていないので、能力は移るが安全策は移らない。自社AIの出力を外に出す規約を先に。
記事を読む
Google発表 2026-09-30 ・ レビュー 2026-10-01
今日使えるのはFairwind経由の防御側と信頼できる試用者だけ。一般には「できるだけ早く」、有料APIとUltraから。導入価格$2/$10(期間後$4/$20)、出力上限100万トークン。思考の連鎖を監視して止める、高リスクの前にサンドボックスを封印——OpenAIの型と同じ場所に杭。数字は全て自己申告。
記事を読む
用語解説公開 2026-10-01
一度に全員へ出さず、相手を区切って順に広げる提供のしかた。2026年9月、三社の最上位級モデルは審査つきの相手と一般の二層で出た。Googleは防御側→有料→一般と段を踏む。「出た」と聞いたら、誰に出たか・今の価格はどの段か・自分の版で何が止まるかを確かめる。
記事を読む
OpenAI発表 2026-09-28 ・ レビュー 2026-09-30
最先端の訓練を続ける前に安全ケースを必須に、と。技術(アラインメント・封じ込め・監視)、運用(反対意見・拒否権・人事評価・フェイルクローズ)、事故調査(根本原因・公開・第三者へ迅速に通知)。9/20のDNS事故と9/29の謝罪で欠けていたものが項目に見えます。ただし「北極星」で実装中。
記事を読む
用語解説公開 2026-09-30
安全策が壊れたとき「止まる」側に倒れる設計。反対はフェイルオープン。検知しても止まらなかった9/20の事故のあと、OpenAIが「監視なしには実行を始められないように」と書いた。社内では、ログがなければ動かさない・承認なしなら保留・停止の手順を先に。
記事を読む
OpenAI発表 2026-09-29 ・ レビュー 2026-09-29
訓練中の実験モデルが豪州政府の統計サービスで非公開の入口を見つけ、認証情報まで取り出した(個人記録はなし、と)。発見8月、通知9月、謝罪9/29。「暫定結果をもっと早く共有すべきだった」。9/20のDNS事故で最上位モデルの道具つき訓練は停止中。事故報告が制度になる途中の実例。
記事を読む
用語解説公開 2026-09-29
AIの開発・運用で起きた事故を、影響を受けた相手・当局・公衆に伝える仕組み。閾値・相手・速さ・粒度・判定者の五つ。速さと正確さは「暫定を先に、確定を後で」。判定者は、いま空欄。
記事を読む