GPT-5.6:あなたの志に応じて拡張するフロンティア・インテリジェンスOpenAI News / 2026/07/09トークン効率向上コスト当たり性能改善オンデマンド能力強化gpt-5.6tokenscost-performancescalabilityapiinference
OpenAIとBroadcomがLLMに最適化された推論チップを発表OpenAI News / 2026/06/24LLM専用アクセラレータ発表設計から9か月でテープアウト初期で高いperf/watt示唆inferencellmasicperf-wattdatacenternetworking
Ensemble AIの人材を迎えてCloudflareのAIチームを拡大Cloudflare / 2026/06/15NdLinearで構造を保った圧縮Workers AIでサーバレスGPU推論推論コストとGPU利用率の改善model-compressionndlinearworkers-aiinferencegpuserverlessoptimization
I/O 2026: エージェント化された Gemini の時代へようこそGemini / 2026/05/19gemini 3.5 flash 高速かつ低コストgemini omni flash 公開とAPI展開synthid と Content Credentials 拡張geminitpussynthidomniagentsmultimodalinference
CloudflareのAIプラットフォーム:エージェント向けに設計された推論レイヤーCloudflare / 2026/04/16単一APIで複数プロバイダ自前モデルをWorkers AIへデプロイ自動フェイルオーバーと再接続ai-gatewayworkers-aiinferencelatencyfailoverreplicatecog
AIの基礎OpenAI News / 2026/04/10パターン認識ソフトLLMは次語予測用途でモデル選択aillmmachine-learningprompt-engineeringsafetyinferencemodels