Anthropicが外部評価者の常時受け入れを表明
AnthropicのDario Amodei氏は、AIの能力向上に安全対策が追いつく時間を確保するため、開発の速度を調整する案を示しました。同社はまず、外部評価者に社員に近い継続的なアクセスを与え、安全対策や訓練中のモデルを検査できる体制を整えると表明しています。
キーポイント
- 外部評価者による安全対策・事故・訓練過程の検査
- 不利な評価結果も原則として公表できる契約を想定
- 業界・国家間の調整は今後の提案
AnthropicのDario Amodei氏は、AIの能力向上に安全対策が追いつく時間を確保するため、開発の速度を調整する案を示しました。同社はまず、外部評価者に社員に近い継続的なアクセスを与え、安全対策や訓練中のモデルを検査できる体制を整えると表明しています。
GitHub Copilot code reviewは、修正を含むコミットを再レビューした際、解消した自分の指摘を自動で閉じるようになりました。提案を適用するときのコミット文も変更内容に合わせて作成します。内部の検査ではビルドやテストなどの道具を使い、Lite設定でも複数エージェントの結果をまとめます。
GitHubのCopilot利用状況レポートに、VS Codeの専用Agentsウィンドウの利用人数、セッション数、ユーザーメッセージ数が加わりました。1日・28日単位で組織全体と利用者別に確認できます。通常のエディター内のAgent Modeとは別の集計です。
VercelはTailscaleのAI接続サービスApertureの構築事例を公開しました。Apertureは社内ネットワークの利用者IDとAIへのアクセスを結び付け、個々の社員やエージェントへAPIキーを配る負担を減らします。事例では、モデルへの接続をAI Gateway、コードの実行場所をSandboxに任せる構成が説明されています。
Vercelの導入事例によると、広報支援サービスFeaturedは3人のエンジニアで3ブランドと10万人超の利用者を支えています。374のサイトを移し、17モデルへの接続と長時間の処理を共通基盤にまとめました。同社のエージェント経由のメディア向け提案は月10万件超としています。
NetlifyにプロジェクトをSNSへ共有するボタンが加わりました。X、LinkedIn、Reddit、Facebook、Blueskyを選ぶと、プロジェクトのリンクを含む投稿画面が開きます。ボタンを押しただけで投稿が送信される仕組みではありません。
HarnessDevは、AIに実行手順や道具の使い方を含むハーネスを作らせ、その後の自己改良を調べた研究です。64回の版変更のうち、開発中の評価と未使用課題の評価が同じ方向へ動いたのは34回でした。この数字は改善成功率ではなく、2種類の評価の方向が一致した割合です。