IBMがTogether AIと提携 2.4億ドルで推論基盤を増強
IBMがTogether AIと複数年提携し、2.4億ドルを投じてNVIDIA HGX B300クラスターをIBM Cloudに展開する。高性能なAI処理とオープンモデルの推論に向ける。推論基盤の増強競争が続く。
29件の記事
IBMがTogether AIと複数年提携し、2.4億ドルを投じてNVIDIA HGX B300クラスターをIBM Cloudに展開する。高性能なAI処理とオープンモデルの推論に向ける。推論基盤の増強競争が続く。
SalesforceがNVIDIA Nemotronを土台にした自社推論モデルKoaをDreamforceで公開した。CRM業務で誤答が3分の1になり、顧客データを外に出さず自社内で推論する。10月に一部顧客へ提供する。
IBMとTogether AIは8月11日、2.4億ドル規模の複数年契約を結んだ。IBM CloudにNVIDIAのB300を約2000基並べ、オープンモデルの推論基盤を2027年初めに提供する。狙いは低いトークン単価。オープンモデルで費用を抑えたい企業に、選べる基盤が増える。
インドのL&Tが、Together AI向けに最大約1.57億ドル規模のAI基盤建設を受注した。チェンナイにNVIDIA B300を約1万基。インド最大級の単一クラスターとされる。計算資源の地理的な広がりと調達への示唆を整理する。
NVIDIAが8月11日、AIエージェントの各処理を最適なモデルへ自動で振り分けるオープンソースのNeMo Switchyardを公開した。LangChainは多段処理のコストを74%削減。エージェントの運用費を下げる実務的な選択肢が増えた。
Anthropicが8月4日、新興クラウドVolta Infraと6年で約100億ドルの計算契約を結んだ。ノルウェーのBitdeer拠点でNVIDIAの新型チップを使い、2026年末と2027年3月に順次供給する。AIの計算力確保が複数社に分散し、Claude利用の供給安定につながる。
NVIDIAはAIエージェント開発の道具立てに物理シミュレーションと高速計算のライブラリを加えた。エージェントの守備範囲が文章やコードの補助から、半導体や製品の設計・検証へ広がる。製造や設計の現場でAIが担う工程が増える動きだ。
NVIDIAは日本企業と組み、国家規模のAI計算基盤を築く計画を7月16日に示した。経産省が主導する5年で約1兆円の事業を支え、日本語に強い推論モデルからロボット向けAIまで段階的に開発する。国産のAI基盤づくりが具体化する動きだ。
NVIDIAと30社超が7月27日、自律型AIエージェントを守る共通の枠組み「Open Secure AI Alliance」を設立。OpenAIやGoogle、Anthropicは不在。エージェント導入時の安全設計に共通の指針ができる。
NVIDIAが韓国SKグループと、2GW超のAIデータセンター整備で協業を拡大した。SKハイニックスの広帯域メモリHBMの長期供給も狙う。AI基盤の最大の制約であるメモリ確保が競争の要になる動きを読む。
NVIDIAが、元OpenAI首席科学者Ilya SutskeverのSSIに数十億ドル規模で出資し複数年提携を結んだ。SSIの計算資源は約10倍に増え、GoogleのTPUからNVIDIA基盤へ移る。フロンティア開発の計算資源争奪が続く。
NVIDIAは韓国のNaverに10億ドルを出資し、株式の4.5%を取得すると発表された。両社は韓国のデータセンターを55メガワットから200メガワットへ拡張する。AI基盤をめぐる大手の囲い込みが続く。
NVIDIAとOpenAIが、最大2500億ドルの債務保証をめぐり協議していると報じられた。OpenAIが10ギガワット級のデータセンターを借りる資金の裏づけにする狙いで、計画全体は5000億ドルを超えうる。
NVIDIAは7月20日のSIGGRAPH関連発表で、生成AI・リアルタイムシミュレーション・物理AI・ロボティクスの進展を打ち出した。映像業界だけでなく、商品画像や動画広告、3Dプレビューなど制作現場の期待値を押し上げる動きだ。
NVIDIAがVera Rubin基盤を発表。エージェント型AI向けに7種の新チップが量産に入り、大規模AI工場の増強を狙う。株価は自社製チップとの競合で調整局面。AIインフラのコスト前提を見直す材料になる。
みずほフィナンシャルグループが7月16日、NVIDIAの技術を活用した金融機関向けAI基盤の高度化検討を始めたと発表した。生成AIとAIエージェントの安全な活用を目指す。
NVIDIAが新モデルCosmos 3 Edgeを公開し、トヨタとの提携拡大や国内企業連合との協業を発表した。日本の製造業でロボット活用が本格化する。
PerplexityがNvidiaの新型CPUを採用すると発表した。AIエージェントによるコーディング作業が従来比1.5倍速くなるといい、企業向けAIエージェントの実行基盤選びに影響する動きを解説する。
Palantirのカープ最高経営責任者がAIの従量課金を企業への富裕税と批判した。Nvidiaとの提携で外部接続なしの自社運用型AI基盤を投入し、トークン課金からの脱却を売り込んでいる。
NVIDIAは次世代AI基盤Vera Rubinを今秋から出荷すると示した。AWSやAzureなど8社のクラウドが最初に導入する。トークンあたりのコストを大幅に下げ、新メモリHBM4で帯域が広がる。AI計算の供給が増え、企業のAI利用コストを下げる方向に働く。
NVIDIAは6月1日のGTC Taipeiで、自律的に動くAIエージェントを企業が作るためのソフト群を発表した。安全に動かす実行基盤OpenShellをSAPやServiceNowが採用し、エージェントを業務で動かす土台が整う。
AWSは6月18日のニューヨークサミットで、NVIDIA RTX PRO 4500 Blackwellを載せたEC2 G7を発表した。前世代G6比でAI推論が最大4.6倍、グラフィックスが最大2.1倍。推論の処理が速く安くなり、自社運用のAI処理の費用対効果が改善する。
NVIDIAは6月18日、SKテレコムが同社のDSXでギガワット級のAIクラウドを韓国に建てると発表した。SKハイニックスとは次世代メモリの複数年提携も結んだ。各国が自国内に計算基盤を持つ動きが加速し、データの所在を選べる選択肢が増える。
NVIDIAが6月15日、250億ドルの投資適格社債を発行した。2021年以来で最大、注文は850億ドルに達した。30年物を含む長期の調達は、AIインフラへの巨額投資が数十年続くという賭けを映す。資金調達の過熱は導入企業のコスト感にも影響する。
NVIDIAのフアン氏と現代自動車のチョン会長がソウルで会い、移動・製造・ロボットでの協業を深めると合意した。Boston Dynamicsを通じ、物理AIを工場など実際の現場へ広げる。製造業のAI活用が次の段階へ進む。
ServiceNowとNVIDIAが、PCのファイルや端末、アプリを操作して複数手順の作業をこなす自律エージェント「Project Arc」を発表した。読み取ったファイルや実行コマンドを記録し、企業が統制下でデスクトップ自動化を進められるようにする。
Google DeepMindが拡散方式の言語モデルDiffusionGemmaを公開し、NVIDIAが即日でRTX対応の最適化を施した。256トークンを並列生成し、同条件の従来型より最大4倍速い。社外に出せない文書を手元のパソコンで処理する選択肢が広がる。
ドイツのNeura Roboticsは6月11日、最大14億ドルのシリーズC調達を発表した。AmazonやNVIDIA、Bosch、欧州投資銀行などが出資し、評価額は約70億ドル。2030年までに数百万台の生産を目指す。物理作業のAI化が投資の主戦場になってきた。
NVIDIAが2026年6月1日、ノートパソコン向けの新チップRTX Sparkを発表。1ペタフロップの性能と最大128GBの統合メモリを持ち、手元で1200億パラメータのモデルを動かせる。Dell、HP、Lenovo、Microsoftなどから今秋に登場する。