OpenRouter、ビジョンモデル向け画像送信APIの仕様ガイドを公開 共通構造で複数モデルを容易に比較可能
- OpenRouterが、画像認識対応のLLMへAPI経由で画像を送信する実装方法をまとめたガイドを公開した。
1ページあたり 20 件ずつ表示します。
- OpenRouterが、画像認識対応のLLMへAPI経由で画像を送信する実装方法をまとめたガイドを公開した。
- Dockerの公式イメージ「espressif/idf」を活用し、ESP32向けファームウェアのビルド環境を完全に統一・再現可能にする手法が公開された。
- 米Cloudflareは、サーバーレス実行基盤「Cloudflare Workers」にゼロトラスト認証機能「Cloudflare Access」を直接適用できる新機能を発表した。
- AWSは2026年8月14日、AIモデル「Amazon Nova」をマルチターン強化学習でカスタマイズするための報酬関数設計手法を公式ブログで公開した。
- GitHubは、xAIの最新推論モデル「Grok 4.6」をGitHub Copilot向けに順次提供開始した。
- AIコードエディタ「Cursor」に、クラウドエージェントの起動を高速化する新機能「ビルド」が導入された。
- OpenAIが「GPT-5.6 Sol」を従来の最大14倍の速度で実行できる新しいAPIサービス層「Ultrafast」のプレビューを発表した。
- OpenAIは、高性能なAIエージェントを低コストで構築するためのガイド「The builder's guide to GPT-5.6」を公開した。
- GitHubは、開発支援ツール「GitHub Copilot」において、Googleの最新AIモデル「Gemini 3.7 Flash」の提供を開始した。
- AWSが、任意のモデルやフレームワークでAIエージェントを大規模に構築・連携できるプラットフォーム「Amazon Bedrock AgentCore」を発表した。
- AWSは、AIエージェントを用いて企業の古いWebアプリケーションの操作を自動化する「Amazon Bedrock AgentCore Browser Tool」を発表した。
- Googleは、ソフトウェア開発やAIエージェントの処理能力を強化した新モデル「Gemini 3.7 Flash」を発表した。
- 米AIスタートアップのAnthropicが、Slack上でデータ分析を実行できるエージェント「Claude Tag」の社内導入におけるベストプラクティスを公表した。
- Sakana AIが同社のAIチャットサービス「Sakana Chat」をアップデートし、新たにオーケストレーターモデル「Sakana Fugu」を導入した。
- OpenRouterは、AIモデルとWeb検索エンジンの組み合わせによる精度・コスト・速度を評価するライブベンチマークを公開した。
- OpenAIは、企業におけるAI利用の実態を分析した2つの調査レポート「Enterprise Signals」とワーキングペーパーを公開した。
- Amazon Web Services(AWS)が、Amazon SageMaker HyperPodと分散キャッシュ「Curvine」を組み合わせた大規模言語モデル(LLM)向けの階層型KVキャッシュアーキテクチャを公開した。
- Liquid AIは、ユーザー自身のハードウェア上で高速に動作する軽量な視覚言語モデル「LFM2.5-VL-3B」を発表した。
- NVIDIAは、AIファクトリー向けにコンピュートからネットワーク、推論サービスまでを包括するフルスタック可観測性(オブザーバビリティ)の設計指針を公開した。
- 米アレン人工知能研究所(Ai2)は、地球観測モデル構築プラットフォーム「OlmoEarth Studio」において、オープンソース基盤モデル「OlmoEarth」による埋め込みベクトルの計算および書き出し機能の提供を開始した。