OpenAIAnthropic NewsJul 27, 2026, 12:00 AM

Our position on open-weights models

A condensed section focused on the key takeaways first.

Original Post

Quick Digest

Summary

A condensed section focused on the key takeaways first.

openaienmodel: gpt-5-mini-2025-08-07

Our position on open-weights models

Key Points

  • Anthropic opposes a blanket ban on open weights
  • Prioritize chip export controls and anti-smuggling
  • Mandate pre-release safety testing for capable models

Summary

Anthropic does not support a blanket ban on open-weights models. Open-weights models that lack dangerous capabilities are a public good for businesses, developers, and researchers. The real national-security risks are (1) authoritarian states building secretly more-powerful models for military/surveillance use and (2) misuse of powerful models (cyber, biological, alignment failures). Banning Chinese open weights for US companies would not mitigate those risks and would mainly act as a protectionist measure.

Key Points

  • Anthropic has never advocated for banning open-weights models as a category.
  • Open-weights can increase access and competition, but may pose higher monitoring and guardrail challenges once released.
  • Primary policy priority: prevent authoritarian actors from obtaining cutting-edge training compute by restricting sales and cracking down on chip smuggling.
  • Secondary priority: disrupt industrial-scale distillation operations that amplify compute efficiency and narrow the frontier gap.
  • All sufficiently capable models—open or closed—should undergo mandatory pre-release safety testing for cyber, biological, and alignment risks; testing results should drive policy and technical mitigation decisions.
  • Testing and enforcement need to be global to be effective; promising technical mitigations (e.g., modular training strategies) should be evaluated empirically.

Recommendations for engineers

  • Build and adopt pre-release safety test suites targeting misuse vectors (cybersecurity, bio, alignment).
  • Instrument models for provenance, monitoring, and post-release telemetry where possible.
  • Assume models can be redistributed; design deployment and access controls accordingly.
  • Prioritize reproducible, testable safety improvements (e.g., modular training) over relying on export or usage bans.
  • Collaborate on open standards and tooling for testing, reporting, and certification of model capabilities and risks.

Full Translation

Translations

A translation section that keeps the flow of the original article.

openaijamodel: gpt-5-mini-2025-08-07

オープンウェイトモデルに対する我々の立場

発表 — オープンウェイトモデルに対する我々の立場

2026年7月27日

Dario Amodei、Anthropic CEO による投稿

ここ数日、中国由来の open-weights models をめぐって多くの議論がありました。報道によれば、一部の米国当局者は米企業による中国製 open-weights models の使用を禁止することを検討しているようです。それに対して多くのテック企業が open-weights models を支持する書簡に署名し、Anthropic が自社のビジネスを守るためにオープンウェイトを禁止したがっていると批判する人さえ出てきました。

私の過去の著作を読んだ方ならお分かりかもしれませんが、こうした禁止措置を有益だとは考えていません。しかし念のため明確にしておきます:Anthropic はオープンウェイトモデルの禁止を主張したことは一度もありません。

オープンウェイトモデルは、危険な能力を持たない限り公共財です。実行に必要な計算以外の費用はかからず、企業、開発者、研究者に価値を提供します。保護主義的な禁止は、私が最も懸念している国家安全保障上の問題を解決しません。

私が最も懸念している2つの悪夢のシナリオ

私が6か月前にエッセイ「The Adolescence of Technology」で述べた懸念は一貫しています1。要点は次の通りです。

  • 第一の懸念:独裁体制(必ずしも中国共産党(CCP)だけを指すわけではありませんが、CCP は明らかに最も能力のある脅威です)が、米国よりも強力なAIモデルを構築し、それを使って恒久的な軍事的優位を確立したり、自国民に対して極めて深刻な弾圧を行ったりするリスク。

    • この懸念は米政府内でも広く共有されています。Vice President Vance は昨年パリで「authoritarian regimes have stolen and used AI to strengthen their military, intelligence, and surveillance capabilities」と警告し、Intelligence Community の 2026 Annual Threat Assessment は「other global powers’ robust progress in AI is challenging US economic competitiveness and national security advantages」と指摘しました。
    • これらのモデルがオープンウェイトで公開されるかどうか、あるいは米国企業に利用されるかどうかは無関係です。最も危険なモデルは秘密裏に訓練され、People’s Liberation Army にドローンで使われ、Ministry of State Security に監視・弾圧で渡されるようなものかもしれません。
  • 第二の懸念:強力なAIモデルがサイバー攻撃や生物兵器攻撃に悪用されるリスク、そして深刻なアライメント(整合性)問題を抱えるリスクです。

    • open-weights models(出所を問わず)は、ガードレールを適用したり使用を監視したりするのが非常に難しいため、closed モデルより潜在的に高いリスクを呈する可能性があります。重みが一度公開されれば回収できないからです2。
    • しかし、米企業による利用を禁止してもこのリスクは解決しません。悪意のある行為者が正規の米企業である可能性は低く、禁止は米AI企業を競争から守るだけであり、私の目的ではありません。

私とAnthropicが一貫して支持してきた三つの対策

これらの懸念に対処するため、Anthropic と私が一貫して主張してきた以下の三つの対策を支持します。

  • 強力なチップや半導体製造装置を中国に販売してはならない。

    • 広範な密輸3や回避策を取り締まる必要があります。中国は国内生産能力に限りがあり、scaling laws により、米国のチップなしに米国より強力なモデルを構築することはできません。これは脅威#1 を阻止する最も効率的で直接的な方法であり、米法の手の届かないモデルの学習を妨げることで脅威#2 にも間接的に寄与します。
  • 産業規模の distillation オペレーションを取り締まる。

    • Distillation はスクラッチからモデルを訓練するよりもはるかに計算効率の良いプロセスです。これにより中国は保有するチップ数以上の性能を持つモデルを構築でき、チップ禁止を部分的に回避できます。Distillation によって CCP が米国と同等または優れた能力を完全に得られるわけではありませんが、中国の最前線を米国の最前線から数か月程度にまで近づけることができます。
    • こうしたオペレーションを行う多くの企業は open-weights を公開しますが、オープンウェイトそのものよりも、これらのオペレーションが米国を追い越そうとする権威主義国家に支えられている点の方が重要です。政策的介入が必要です。
  • すべての十分に能力のあるモデルについて義務的な安全性テストを行う。

    • 脅威#2 に対処する最善策は、公開前にサイバー、生物学、アライメントに関するリスクを直接テストすることです。私はこの考えがほぼコンセンサスに近いと考えています:最近の数か月で Trump administration がこの方向に動いたこと、そして国籍やオープン/クローズドにかかわらず最も能力の高いモデルに対してこのようなテストを適用する最近の業界提案(startup や学術由来など能力が低いモデルは完全に免除する案を含む)に勇気づけられました。
    • open モデルがリスクを増加させるかどうか、またそのリスクが緩和可能かは、事前に決めるのではなく、テストから明らかにすべきです。open-weights models の安全性を改善する有望な手法があるかもしれません。例えば当社の modular training strategies に関する最近の研究などです。
    • 効果的にするには、こうしたテストはグローバルに行われる必要があり、CCP であっても参加が必要になります。私が "The Adolescence of Technology" で書いたように、AI 生物兵器の防止に関する限定的な協力は、中国の利益にも合致するため可能かもしれません。

オープンレターについて

私はオープンレターの多くの点に賛成します:open weights はAI経済へのアクセスを広げ、少なくとも一部のユースケースで競争を強化し、顧客により大きなコントロールを与えます。Distillation に関する懸念は、上で述べたようなターゲットを絞った法的・商業的枠組みで対処するべきです。

ただし、オープンレターが主張する「オープンウェイトモデルは必然的にセーフガードの開発を容易にする」や「能力への広範なアクセスは防御側にとって攻撃側より有利に働く」といった断定には同意しません。それどころか逆の結果になる可能性も同等に高いと考えています。

例として、バイオロジー分野では攻撃者・防御者の非対称性が強く出る懸念があります。十分に能力のあるモデルは、広く入手可能な材料でパンデミックレベルのウイルスを短期間で兵器化できる可能性がある一方、防御は最良のケースでも年単位の運用的課題(Operation Warp Speed で見たように)です5。こうした問いは経験的に、事前公開テストによって解明されるべきです。

まとめ

私と Anthropic の立場をまとめると、我々はカテゴリとしてのオープンウェイトモデルの禁止を主張していませんし、これからも主張しません。代わりに次のことに注力すべきだと考えます:

  • 強力なチップを権威主義国家の手に渡さないこと
  • 産業規模の distillation を阻止すること
  • open・closed を問わず、十分に能力のあるすべてのモデルに対する安全性テストを義務化すること

これらが、私たちが現在直面している最も重要なリスクに対する実効性のある対応だと信じています。