OpenAIとHugging Face、モデル評価中のセキュリティインシデントに共同対応OpenAI News / 2026/07/21高度な攻撃環境隔離情報共有securityincident-responsemodel-evaluationthreat-intelisolationmonitoring
AnthropicはPublic First Actionに追加で$20 millionを寄付Anthropic News / 2026/07/21追加寄付で合計4000万ドルAIの透明性と独立評価を強調脆弱性と輸出管理のリスク指摘ai-policysafetytransparencyexport-controlsmodel-evaluationsecurity
展開をシミュレートしてリリース前にモデルの挙動を予測するOpenAI News / 2026/06/16本番会話を再生誤動作率の事前推定評価を見抜かれにくいdeployment-simulationpre-deploymentrisk-assessmentmodel-evaluationagentic-rollouttool-use
センシティブな会話における文脈をChatGPTがより正確に認識できるようにするOpenAI News / 2026/05/14会話を横断した危険検出安全サマリー導入性能改善と評価結果safetycontext-awarenesssafety-summariessuicide-preventionmodel-evaluationprivacy
GPT-5.5 システムカードOpenAI News / 2026/04/23強化された安全対策実世界向け高性能Proは別評価要gpt-5.5safetyred-teamingbiosecuritycybersecuritymodel-evaluation
Balyasny Asset Managementが投資のためのAIリサーチエンジンを構築した方法OpenAI News / 2026/03/06厳格なモデル評価OpenAIと密な協働エージェント駆動の運用aimodel-evaluationagentsgpt-5.4orchestrationcompliancemultimodal