AI Newsハイライト

8件 — 重要 5件

元記事を読む →
|
|
|
|
|
|
●重要PRODUCT

OpenAIとAnthropicがエージェント製品を大幅拡張

OpenAIはChatGPT WorkのApple Messagesプラグイン、ChatGPT Sitesの共同編集、GPT-Image-2の透明背景プレビューなど複数の機能を一斉リリース。AnthropicはClaudeプラットフォームでコンピューター使用、ブラウザツール、Skills API、Files APIを正式提供開始した。Skills APIはバージョン管理された再利用可能な手順を追加し、Files APIはレート制限を5倍の500RPMに引き上げ、1TB/orgをサポート。

●重要OTHER

AT&T、社内AI利用の40%をオープンモデルにルーティング——コスト56%削減

AT&Tの社内AI展開では、従業員のAI利用の40%がすでにオープンモデルにルーティングされており、目標は60〜70%。コーディングコストは品質わずか2%低下で56%削減され、1日あたり450億トークンを処理している。これはフロンティアモデルのエンタープライズ市場における優位性に対する警告として広く受け止められている。

●重要MODEL

Gemini 3.7 Flash、ARC-AGI-2で84.6%を低コストで達成

Googleのコスト効率重視モデルGemini 3.7 FlashがARC-AGI-2で84.6%(タスクあたり0.25ドル)、ARC-AGI-1で95.5%(タスクあたり0.12ドル)を記録した。コスト調整済み推論性能で際立った結果を示し、エージェント型ビジョンタスクでも優秀との評価を得ている。

MODEL

Meta Muse Spark 1.2、マルチモーダル・エージェント評価で好成績

MetaのMuse Spark 1.2がAgent Arenaで+2.1%の改善(v1.1の0.9%から向上)を記録し、Bash Recoveryで+11.4%の特に強い結果を示した。Design ArenaではVideo-to-Website部門で1位、Image-to-HTML部門で2位を獲得し、価格対性能のパレートフロンティアに位置すると評価された。

OTHER

Cerebras CS-4、同一ウェハーで推論性能を約2倍に向上

CerebrasのCS-4は同じ5nmウェハー上で電力供給と冷却を再設計することで性能を約2倍に向上させた。WSE-3 Turboあたり250PFLOPs、メモリ帯域幅43.2PB/s、3ウェハーCS-4ラックで750PFLOPsを実現。GPT-OSS-120Bでユーザーあたり4,400トークン/秒以上を達成し、GPUベースシステムの最大30倍高速とされる。

MODEL

Gemma、累計ダウンロード数10億件を突破

GoogleのオープンモデルファミリーGemmaが累計10億ダウンロードを超えた。これに合わせてバリアント、デプロイガイド、ファインチューニングレシピをまとめたAwesome Gemmaリポジトリも公開された。オープンウェイトモデルの普及拡大を示す重要な指標となっている。