NVIDIA、巨大なAIモデルのロードを高速化する「ModelExpress」を発表 起動時間を大幅に短縮
- NVIDIAは、AIモデルの重みデータを効率よく配信・ロードするためのプラットフォーム「ModelExpress」を発表した。
1ページあたり 20 件ずつ表示します。
- NVIDIAは、AIモデルの重みデータを効率よく配信・ロードするためのプラットフォーム「ModelExpress」を発表した。
- GitHub Actionsの実行環境を悪用し、特定の管理サーバーを探索・攻撃する大規模なサイバー攻撃が確認されました。
- AWSが、Amazon Bedrockのナレッジベース向けに自律的な検索と推論を行う「Agentic retrieval(エージェント型検索)」を発表。
Amazon Bedrock AgentCore optimizationにて、AIエージェントの行動エラーを検出・分析する「インサイト」機能が紹介された。
- AWSは、BIサービス「Amazon QuickSight」にグラフ描画ライブラリ「Highcharts」を統合し、複数リージョンの複雑なデータを一元的に可視化する手法を公開した。
- OpenAIは、米ジョージア州エフィングハム郡で長期的なデータセンタープロジェクト「Project Camellia」を進めている。
- ルーター向けカスタムファームウェア「DD-WRT」の古いバージョンにおいて、リモートから任意のコード実行などが可能になる深刻なバッファオーバーフローの脆弱性が確認された。
- NVIDIAの最新AIシステム「GB300 NVL72」が、大規模言語モデル「DeepSeek-V3 671B」の事前学習において、GPU1基あたり1,648 TFLOPsという処理性能の世界記録を達成しました。
- NVIDIAは、自律的に動く「エージェント型AI」の処理に特化した次世代GPU「Rubin」のアーキテクチャを公表した。
- AIアプリケーション開発ツール「Langflow」の既知の脆弱性を悪用し、AI関連ファイルを狙う新しいランサムウェア「ENCFORGE」が確認された。
- 米NVIDIAは、AIファクトリー向けに設計された第6世代「NVLink」の技術的詳細を公開した。
- NGINXのワーカープロセスを強制終了させたり、特定の構成下で遠隔から任意のプログラムを実行されたりする深刻な脆弱性が判明した。
- 米国や英国などの西側諸国で、ドローンや人工衛星といった軍用自律システムの導入と投資が急速に加速している。
- Go言語製のボットネット「NadMesh」が、公開状態にあるAI関連サービスやワークフローツールを探索している。
- AWSが、Amazon Quickのフリーフォームダッシュボード向けに「モバイルレイアウト」機能の提供を開始した。
- AWSが、生成AIサービス「Amazon Bedrock」において、AIエージェント向けの検索システムを容易に構築できる「Managed Knowledge Base」の一般提供を開始した。
- エージェント型AIの普及に伴い、推論処理はGPU単体から、ネットワークやストレージなどインフラ全体を巻き込む分散ワークフローへと変化している。
- 複数アカウントやリージョンに分散した「Amazon SageMaker Pipelines」を一元的に監視するソリューションが発表された。
- 不動産金融ソフトウェア提供のBuilt Technologiesが、AWS上にAI駆動のドキュメント処理エンジンを構築した。
- ヘルスケアアプリ「Flo Health」が、Amazon Bedrock(複数の高性能なAIモデルをAPI経由で利用できるサービス)を活用したAI医療コンテンツレビュー・生成システムを本番稼働させた。