開発・実装
実装テクニック・開発ツール・運用ノウハウ(104件)
Claude CodeがAGENTS.mdに対応、CLAUDE.mdが無い場合に読み込み
AnthropicのClaude Codeに、AGENTS.mdを読み込む機能が追加されます。バージョン2.1.277から、フォルダ内にCLAUDE.mdが存在しない場合に限り、ClaudeがAGENTS.mdを探してプ…
記事を読む →
開発・実装
Hacktron、Claude OpusでOpenAI侵入 72時間で従業員アカウント侵害
セキュリティ研究組織Hacktronの3人チームが、AnthropicのClaude Opus 4.8と5を使い、72時間足らずでOpenAIの従業員アカウントへの侵入に成功したと報じられました。侵入口はOpenAIのコ…
記事を読む →証明でAIのコードミスを防ぐ言語Bend、CPU/GPU並列と高速型検査をうたう
Bendは、AIコーディングエージェントの誤りを「証明」で防ぐことを目的とした新しいプログラミング言語です。公式サイトでは、C並みの実行速度、CUDAによるGPU並列、Lean系の証明機構、Pythonに近い構文という4…
記事を読む →
開発・実装
暴走AIエージェントの監視に別のAI、ApolloやGoodfireが参入
AIエージェントに長いタスクを任せる企業が増え、人間が確認しきれないという監督上の問題が顕在化しています。記事は、OpenAIのHugging Face事案で約12,000体のエージェントが人間の追跡速度を超えて連携した…
記事を読む →
開発・実装
AnthropicがClaude CodeのProjects刷新、複数エージェントを並列実行
Anthropicが、コーディングエージェント「Claude Code」のProjects機能を刷新したと発表しました。1つのプロジェクト内で複数のエージェントを並列に走らせ、共有のメモリやゴール、ファイル群を土台に協調…
記事を読む →GitHub CopilotランタイムをRustへ移植、80万行超をAIエージェントが主導
GitHubは、Copilot CLIやCopilotアプリ、Copilot SDKの土台であるCopilotエージェントランタイムを、TypeScript/Node.jsからRustへ全面的に書き直したと説明した。書き…
記事を読む →
開発・実装
Google HomeがMCPサーバーの早期アクセス提供、AIエージェントで家電を操作
Googleは、Google Homeエコシステム向けにMCP(Model Context Protocol)サーバーの早期アクセス提供を開始しました。MCPに対応するAIエージェントであれば、接続した家電の操作やイベン…
記事を読む →
開発・実装
SageMakerサーバーレスカスタマイズでQwen3-8Bを商品タグ付けに最適化
AWSは、Amazon SageMakerのサーバーレスモデルカスタマイズを使い、小売カタログ向けの商品タグ付けモデルを構築する手順を公開しました。オープンウェイトモデルのQwen3-8Bを教師あり微調整(SFT)で9カ…
記事を読む →
開発・実装
Amazon Bedrockのプロンプトキャッシュ、入力コスト最大90%削減の仕組み
AWSは公式ブログで、Amazon Bedrockのプロンプトキャッシュ機能を使い、コストとレイテンシを最適化する方法を解説した。同じコンテキストを繰り返し送る場合、キャッシュヒット時の入力トークンコストを最大90%削減…
記事を読む →eBPFセキュリティエージェントのメモ化でカーネルCPUコストを約90%削減
eBPFでファイルアクセスを制御するセキュリティエージェントにおいて、ポリシー適用そのものより「どのポリシーが適用されるか」の判定が高コストになっていた問題を、inode単位のメモ化で解決した事例が公開されました。同一フ…
記事を読む →TRLのAsyncGRPOがLoRAアダプタ同期に対応、HF Jobsで学習を短縮
Hugging Faceのブログで、TRLのAsyncGRPOTrainerがLoRAアダプタを学習し、そのアダプタだけをvLLMへ同期できるようになったことが紹介された。この変更はPR…
記事を読む →
開発・実装
AWSがAgentCoreで対話型MCP Appsを構築する方法を公開、UIを共通化
Amazon Web Servicesは、Model Context Protocol(MCP)を拡張するMCP Appsと、エージェント基盤Amazon Bedrock…
記事を読む →
開発・実装
AgentCoreとGitHub Actionsでエージェント評価をCI品質ゲートに
AWSは、Amazon Bedrock AgentCore上で動くAIエージェントの品質を、GitHub ActionsのCI/CDパイプラインで自動評価する構成をブログで公開しました。エージェントとMCPサーバーを開発…
記事を読む →
開発・実装
Together AI、Vera Rubin上でThunderKittensのGEMMカーネルを最適化
Together AIのカーネルチームが、NVIDIAの新プラットフォーム「Vera Rubin NVL72」向けにGPUカーネルライブラリThunderKittensを拡張したと報告した。NVFP4とFP8のGEMMを…
記事を読む →ShopifyがReact Nativeからネイティブへ回帰、AIエージェントが後押し
Shopifyが、モバイルアプリの開発方針をReact NativeからSwiftとKotlinによる個別のネイティブコードベースに戻すと表明しました。2020年にネイティブからReact…
記事を読む →個人が998ドルで学習した3.8Bモデル、CORE 0.384を達成した記録
1人の開発者が約1,000ドルの予算で3.8Bパラメータの言語モデルを学習し、COREベンチマークで0.384を記録したと報告しました。65Bトークンを43時間で処理し、費用は998ドルだったとされています。開発はRTX…
記事を読む →
開発・実装
Adobe、PremiereのAI生成をタイムラインに統合 複数モデルを選択可能に
Adobeは、プロ向け動画編集ソフトPremiereのAI機能を刷新し、新インターフェース「Generative Media」を発表した。編集者はタイムライン上の空き部分を指定するだけで、映像・効果音・音楽・環境音を生成…
記事を読む →
開発・実装
Qwen3.8-2.4T-A95BをSageMaker HyperPodとvLLMで動かす手順
アリババのQwenチームが2026年8月12日に公開したオープンウェイトモデル「Qwen3.8-2.4T-A95B」は、総パラメータ2.4兆、活性パラメータ約950億という大規模モデルです。AWSのブログでは、このモデル…
記事を読む →
開発・実装
AI生成コードの急増でレビュー工程が新たなボトルネックに 各社が対策を模索
AIコーディングツールの普及により、短時間で大量のコードが生成される一方、その品質を確認するレビュー工程が新たな課題になっています。米IEEE Spectrumの報道では、開発者調査でAIが生成したコードへの信頼が低いこ…
記事を読む →Python 3.15.0候補版「RC2」公開、10月正式リリースへ最終段階
Python 3.15の最終リリース候補(RC2)が2026年9月1日に公開された。RC期間入りにより、正式版に向けたコード変更はバグ修正のみに限定され、サードパーティ製ライブラリのメンテナーにはPyPIでのwheel配…
記事を読む →
開発・実装
ZS、Amazon SageMakerで安全なアドホック分析基盤を構築、200超ドメインを運用
ZS Associatesは、Amazon SageMaker Studioを基盤に、規制業界で使えるセキュリティ強化型のアドホック分析プラットフォームを構築した。テナントごとにSageMakerドメインを分離し、IAM…
記事を読む →
開発・実装
Atos、AWS AI Leagueで400人をエージェント型AIに実践育成
AtosはAWSと連携し、400人のエンジニアを対象とした「AWS AI League」を2026年に実施した。3日間の競技形式で、参加者はAmazon Bedrock…
記事を読む →
開発・実装
メタ、専門家の知識を学習するAIエージェント「組織のセカンドブレイン」を開発
メタは2026年9月2日、組織内の専門家知識をAIエージェントに組み込む「組織のセカンドブレイン」の設計を公開した。知識ファイルと推論手順を分離し、専門家の修正をモデル再学習なしで反映できる自己改善ループを備えることが特…
記事を読む →
開発・実装
1993年のAmiga用ゲームをLLMが解析しGodotへ移植、作者が詳細を公開
1993年にAmiga 500向けに作られたゲーム「Babylonian Twins」を、大規模言語モデル(LLM)を使ってGodot 4へ移植した工程が公開された。作業では、2010年に制作された34,000行のC++…
記事を読む →
開発・実装
LiteLLMでCodexをAmazon Bedrockに接続するECS構成
AWSが、OpenAI CodexをLiteLLMゲートウェイ経由でAmazon Bedrockに接続するリファレンス構成を公開しました。開発者のローカル環境で動作するCodexのモデル推論を、AWS…
記事を読む →
開発・実装
AWSがAgentCoreでAI駆動開発の実装例、ER図生成と自動コード検査
AWSは、AIを開発工程の共同作業者として位置づける「AI駆動開発ライフサイクル(AI-DLC)」の実践例として、Amazon Bedrock AgentCoreを使った2つのリファレンス実装を公開しました。1つはSQL…
記事を読む →
開発・実装
Intuit、Amazon Bedrock基盤の災害復旧AIエージェントを開発、8カ月の実運用実績を公開
米Intuitは、数千のマイクロサービスを複数リージョンで運用する自社環境を対象に、Amazon Bedrockを利用した災害復旧アシスタント「EWOK Agent」を構築したと発表しました。既存の復旧実行基盤EWOKの…
記事を読む →
開発・実装
Bedrock知識ベースとTextract統合で複雑な公共料金明細の解析精度を高める
AWSは、Amazon Bedrockのナレッジベースを大規模かつ複雑な文書向けにカスタマイズするための構成を解説したブログ記事を公開しました。Amazon…
記事を読む →
開発・実装
AI攻撃で使われたASCIIスマグリング、スパムフィルタ回避にも転用
AIエージェントへのプロンプトインジェクションを隠すために使われてきた「ASCIIスマグリング」が、スパム送信者にも採用された。人間には見えないUnicodeタグを使って「credit」などのトリガーワードを難読化する手…
記事を読む →
開発・実装
Cosmos 3とSageMaker HyperPodでPhysical AIモデル工場を構築するには
NVIDIAが公開したオムニモーダル世界基盤モデル「Cosmos 3」を、Amazon SageMaker HyperPod上で継続運用する方法がAWS公式ブログで解説された。1つのモデルで世界モデル・行動ラベリング・ポ…
記事を読む →GRPOで100ステップ、350Mモデルの構造化出力が22.6%→29.7%に
3.5億パラメータの言語モデルLFM2.5-350Mに対して、約500サンプル・100ステップという短いGRPOファインチューニングを行うと、構造化出力のベンチマークIFStructのスコアが22.6%から29.7%に向…
記事を読む →
開発・実装
Amazon Bedrockでダッシュボードの表示障害を自動検知するAWSの取り組み
ダッシュボードの表示が壊れても、サーバーやAPIが正常なら監視では気づけない――。そんな「コンテンツ層の障害」を、Amazon Bedrock上のLLMで自動検出する仕組みをAWSチームが解説しました。視覚的な欠落と数値…
記事を読む →コードで水彩画を描くAI——オープンなRL環境で美的嗜好を学習させる試み
Hugging Faceが2026年9月3日付のブログで、コード生成モデルに水彩画を描かせる実験を詳しく解説した。元のアイデアはアーティストのSurya Narreddi氏が8月23日に投稿した動画で、再生回数は150万…
記事を読む →
開発・実装
Jamf、BedrockのAIコストをユーザー単位で制御する仕組みを公開
アップル製品の管理・セキュリティ製品を提供するJamfは、生成AIサービス「Amazon Bedrock」の利用コストをユーザー単位でリアルタイムに制御する仕組みを構築し、AWS公式ブログで詳細を公開しました。日次予算に…
記事を読む →
開発・実装
GitHub Copilotのコスト効率化、タスク全体で測る4つの改善
GitHubが公開した技術ブログで、AIコーディングエージェントのコスト効率を品質を落とさずに高める4つの変更が説明されました。ポイントは、個々のツール応答のトークン数を減らすのではなく、タスク完了までの総トークンと時間…
記事を読む →Paint.NET、WINE向けにDirect2DをAIで独自実装 18万行をClaudeが生成
Windows向け画像編集ソフトPaint.NETの作者Rick Brewster氏は、WINE上で最大の障壁だったDirect2Dを、AIコード生成アシスタント「Claude」を使ってゼロから書き換えたと明らかにした。…
記事を読む →
開発・実装
OpenAIが示すエージェント実装の型 — Basis・Clay・Exaの実践から
OpenAIは企業向けAI活用調査「Enterprise Signals」で、上位企業と一般企業の差が拡大していると報告した。上位10%の企業はアクティブユーザーあたりのアウトプットトークン数が平均の8.3倍(1月時点は…
記事を読む →Azure OpenAIアシスタントが権限外のSharePoint文書を返す問題
Azure OpenAIを使ったメール対応アシスタントが、インデックス作成時のサービスアカウント権限で検索を行い、本来は開けないユーザーにSharePoint文書を返す事故が報告された。評価や単体テストは合格していたが、…
記事を読む →AIエージェントがコードを書く時代、エンジニアの仕事は「境界の設計」へ
CursorやClaude CodeといったAIエージェントがコード生成の主役になりつつある。本記事は、エンジニアの仕事が構文を書くことから、エージェントが逸脱できない境界を設計することへ移ると論じる。熱力学と無限猿定理…
記事を読む →
開発・実装
Amazon Bedrockで実現する可観測なエージェント型検索の実装
Amazon Web Services(AWS)は、エージェント型検索を本番運用するためのサンプル実装を公開した。Amazon BedrockのマネージドKnowledge…
記事を読む →
開発・実装
MetaのAIゲーム生成アプリ「Pocket」、コード非公開の“閉じた庭”に
Metaが米国で公開したPocketは、テキストプロンプトを入力するだけでインタラクティブなゲームを生成できるモバイルアプリだ。コードを一切書かずに作品を作れ、TikTok風フィードで共有できる一方、コードの閲覧や外部へ…
記事を読む →AIエージェント保護はゲートウェイより先にID管理を整備せよ
AIエージェントを本番運用する際、多くの企業はセキュリティ対策として通信を中継するゲートウェイを最初に導入する。しかし、ゲートウェイはエージェントの身元や委任関係を把握できないため、想定外の行動を見抜けないという課題があ…
記事を読む →
開発・実装
SalesforceがSageMaker ICの配置制御でMulti-AZ高可用性を実現
SalesforceはSageMaker AIのInference Componentsを利用して、複数のモデルをGPUに共有することでインフラコストを8分の1に削減しつつ、複数のアベイラビリティゾーンにまたがる高可用性…
記事を読む →
開発・実装
Decathlon、AWS上でChronos-2による需要予測を本格運用
欧州スポーツ用品大手のDecathlonは、時系列基盤モデルChronos-2をAWS上で本番運用し、週次で全商品の需要予測を行っています。従来モデルと比較して予測誤差を11〜15ポイント改善し、新地域への展開期間を6ヶ…
記事を読む →SageMaker Feature Storeに一括書き込みとレコード列挙APIが登場
Amazon SageMaker Feature Storeに、複数レコードを一括で書き込めるBatchWriteRecordと、保存済みレコードの識別子を列挙できるListRecordsの2つのAPIが追加されました。…
記事を読む →SFTの成否を決めるデータ準備——AWSが品質チェックとフォーマットの要点を解説
AWSは、基盤モデルを用途に合わせて調整するSFT(教師あり微調整)の成否がデータ準備で決まるとして、品質チェックやフォーマットの具体手順を解説する記事を公開した。ポイントは、データ量より品質と一貫性を重視すること、会話…
記事を読む →Google、Androidアプリのメモリ最適化を義務化 2027年2月まで
GoogleはAIデータセンター需要によるメモリチップ不足を受け、Androidアプリ向けに新しい品質要件を発表しました。2027年2月までにアプリのメモリ使用量を抑え、コードを最適化することが必要です。さらに同年4月ま…
記事を読む →
開発・実装
教師ありファインチューニングの高度なデータ戦略:学習曲線からデータ混交まで
教師ありファインチューニングで、データの品質管理が終わった後も、データ量の判断や選択、拡張、混交といった高度な戦略が残る。本記事はAWSブログの連載第2回で、学習曲線分析によるデータ準備状況の評価、サブセット選択、データ…
記事を読む →SageMaker SDK v3でスクリプトモード刷新 独自モデルの訓練・デプロイが1つのAPIに
AWSは、Amazon SageMaker AIで独自の学習コードと推論コードを実行する「スクリプトモード」の使い方を、SageMaker Python SDK…
記事を読む →
開発・実装
Natera、Bedrock AgentCoreで音声予約を自動化、ECSから移行
Nateraは患者の採血予約を自動化する音声エージェントをAmazon Bedrock AgentCoreで構築した。従来のECS上のコンテナ運用からサーバーレス環境への移行を果たし、二重WebSocketパターンや遅延…
記事を読む →
開発・実装
Amazon Bedrock AgentCore Evaluations、OpenTelemetryで全エージェント基盤を評価可能に
AIエージェントの評価は、フレームワークごとに構築が異なるため共通化が難しい問題があった。Amazon Bedrock AgentCore Evaluationsは、OpenTelemetryを介してテレメトリーを収集し…
記事を読む →医療向け検索に強いマルチベクター埋め込みモデル、1GPUで14.5時間で訓練
Hugging Faceのブログで、Sentence Transformersライブラリを用いたマルチベクター埋め込みモデルの訓練・微調整方法が解説されました。モデル、データセット、損失関数、トレーナーなどの各要素と、医…
記事を読む →
開発・実装
GitHubがLLM本番投入前の評価手法を公開 誤検出削減の事例から学ぶ
GitHubは、LLMシステムを本番環境に投入する前の評価方法について実践的な知見を公開しました。シークレットスキャンの誤検出削減にLLMを活用した事例から、ベンチマークと本番との乖離への対処、製品判断を起点にした3層の…
記事を読む →Papers with Codeの検索を支えるHFサービスとハイブリッド検索の設計
Hugging Faceは、Papers with Codeの検索システムを支えるアーキテクチャを公開しました。PostgreSQLの全文検索とpgvectorによるベクトル検索を、RRF(Reciprocal…
記事を読む →「gr.Workflow」でAIパイプラインを構築、REST APIも自動生成
Gradioに組み込まれたgr.Workflowは、AIパイプラインをグラフとして構築し、操作UIとREST APIを同時に生成できる機能です。ノードをつなぐだけで、画像編集や並列生成、データセット分析などの処理を可視化…
記事を読む →エンタープライズAIの信頼性は共通知識基盤が左右、文脈構築の限界
エンタープライズAIの実装は、これまでアプリケーションごとに文脈(コンテキスト)を組み立てる「コンテキストエンジニアリング」が中心だった。しかしAIエージェントの導入が増えると、同じ知識を各チームが個別に処理するため、不…
記事を読む →規制対応が必要なRAGシステムの推論コストを6倍削減するカスケード設計
規制や監査の対象になるRAGベースの分類システムでは、全ケースをLLMに渡す構成が3つの問題を抱えると記事は指摘する。決定論的ルール、検索、LLMの3段階からなるカスケード構成を使えば、曖昧な10〜15%だけがLLMに渡…
記事を読む →Sentence Transformers v6.0がマルチベクター埋め込みモデルに対応
今回のブログでは、Hugging Faceが公開した記事から、複数のトークンベクトルを保持するマルチベクター埋め込みモデルがSentence Transformers…
記事を読む →
開発・実装
JumioがAWS上にリアルタイム特徴量ストアを構築、P95 16.9msを達成
本人確認サービスを提供するJumioは、AWS上でリアルタイム特徴量ストアを構築した。KinesisとApache Flinkでイベントを処理し、Amazon SageMaker Feature…
記事を読む →
開発・実装
Bedrockで複数エージェント連携による保険文書分類の実装解説
AWSの機械学習ブログで、Amazon Bedrockを利用した保険文書の自動分類ソリューションが紹介されました。保険会社が日々大量に受け取る保険証券や宣誓供述書などの文書を、テキスト分析と視覚的パターン認識を担う複数の…
記事を読む →
開発・実装
ITSMチケットの知見からKB記事を生成し品質を保つKnowledgeForgeの仕組み
AWSは2026年8月19日、ITSMの解決済みインシデントチケットからナレッジベース記事を自動生成し、既存記事の重複排除や品質改善も行うソリューション「KnowledgeForge」をブログで紹介した。Amazon…
記事を読む →
開発・実装
Lambda待機コストをなくすAgentCore非同期呼び出しの3パターン
Amazon Bedrock AgentCoreをサーバーレスパイプラインから呼び出す際、多くの実装ではLambda関数で同期呼び出しをしています。しかし、エージェントが処理を考えている間、Lambdaは何もせずに稼働し…
記事を読む →AWSのIDP AcceleratorとQuick Automateで文書処理を自動化、最大70%の時間短縮
AWSは、住宅ローンの文書処理を例に、オープンソースのIDP AcceleratorとAI自動化サービスQuick Automateを組み合わせた自動化パイプラインを紹介しました。従来人手で行っていた文書の分類・データ抽…
記事を読む →Claude Codeがsmolvmで未検証コード実行を検証、KVM不在はGitHub Actionsで回避
Simon Willison氏がClaude Fable 5に、軽量サンドボックス「smolvm」を使って未検証のPython/JavaScriptを安全に実行する方法を検証させた。Claude Code for…
記事を読む →
開発・実装
Amazon BedrockでRAGのコスト削減 クエリ対応圧縮が平均33%減
AWSは2026年8月21日、Amazon Bedrock上でRAGのコストを抑える「クエリ対応圧縮」パターンを公開しました。検索結果のチャンクを小さなモデルで質問にあった部分だけに絞り、回答生成モデルへの入力トークンを…
記事を読む →
開発・実装
Together AIが本番エンドポイントでLLMのA/Bテストを実行できる新機能を提供
Together AIは、本番エンドポイントのライブトラフィックを制御群と最大20の変量群に分割し、候補モデルを実際のユーザーに段階的な割合で露出できるA/Bテスト機能を発表しました。割合はレプリカ数と独立した固定値とし…
記事を読む →同じクラスタで稼働率33ポイント向上、変えたのは割り当て順序だけ
Hugging Faceのブログで、GPU割り当ての順序を変えるだけでクラスタ効率が大きく変わるという実験結果が報告されました。制約対応GPUアロケータをFIFOスケジューラと比較したところ、同一ハードウェア・同一ワーク…
記事を読む →
開発・実装
Bedrock AgentCoreのWeb Searchにドメイン・公開日フィルタ追加、東京リージョン対応も
AWSは2026年8月19日、Amazon Bedrock AgentCoreのWeb Search機能に、リクエスト単位でドメインと公開日を絞り込むフィルタを追加した。API呼び出しごとに許可・拒否ドメインのリストと公…
記事を読む →
開発・実装
Claudeのテキスト透かし、トークンサンプリングに埋め込む仕組みを解説
Anthropicは2026年8月14日、Claudeの出力テキストに透かしを導入すると発表した。透かしはユーザーには見えず、AnthropicだけがAI生成テキストを識別できる。本記事はその仕組みを、LLMのトークン生…
記事を読む →
開発・実装
OpenClawとAgentCore paymentsが連携、AIエージェントが事前承認の範囲で自動決済
AWSはOpenClaw Foundationと協力し、AIエージェントがHTTP 402決済を自動で処理できるようにする統合を発表しました。OpenClaw用プラグイン「aw-agents-pay」を導入すると、人間が…
記事を読む →
開発・実装
FirefoxのSmart Window、履歴検索とタブ整理をAIで強化
Mozillaは2026年8月18日、FirefoxのAIブラウジングモード「Smart Window」の更新を発表した。Exaとの提携により、チャットで最新のウェブ情報を出典付きで参照できるようになったほか、履歴の自然…
記事を読む →
開発・実装
Axonius、Bedrock AgentCoreで安全なマルチテナントAIエージェント
Axoniusは、複数の顧客環境を抱えるSaaSプロバイダー向けに、Amazon Bedrock AgentCoreを使ったマルチテナントAIエージェントの構築方法を公開した。同社はサイロモデルを採用し、顧客ごとに専用ラ…
記事を読む →
開発・実装
AWSがAIエージェントでデータ基盤構築を自動化する「ADOP」参照アーキテクチャ公開
AWSは、AIエージェントを活用してデータエンジニアリングを自動化する参照アーキテクチャ「ADOP」を発表した。Amazon BedrockとClaude CodeなどのAIコーディングツールを組み合わせ、データソースの…
記事を読む →AIテキスト検出器を自作するチュートリアル、DistilBERTで実装
Sebastian Raschka氏が、AIが生成したテキストを検出するシステムをゼロから構築するチュートリアルを公開しました。SubstackのAI検出機能に触発された内容で、DistilBERTを微調整して0〜100…
記事を読む →
開発・実装
Asana、5年規模のテスト基盤刷新をCodexで2週間・約1.2万ドルで完了
Asanaが、OpenAIのコーディングエージェント「Codex」を活用し、老朽化したテスト基盤「Enzyme」の除去を約2週間で完了したと発表しました。従来の人員計画では5年以上・約600万ドルかかると見積もられていた…
記事を読む →
開発・実装
OpenAI、AIを使った防御戦略を公開—「攻撃者より先に脆弱性を潰す」
米OpenAIは、AIを活用したサイバー防御戦略を公式ブログで公開した。背景には、AIエージェント集団がOpenAIの研究インフラなどに侵入した「Hugging…
記事を読む →
開発・実装
EKS上のIDE実行を可能に、SageMaker AI Spacesアドオン登場
Amazon EKSを利用するデータサイエンティスト向けに、SageMaker AI Spacesアドオンが登場した。これにより、既存のEKSクラスター上でJupyterLabやCode…
記事を読む →AIエージェントをネットワーク層で監視、BrexがCrabTrapで安全性を確保
BrexはVB Transform 2026で、AIエージェントを安全に本番運用するための新手法を発表しました。社内業務にOpenClawを導入しようとした際、セキュリティチームが拒否したことをきっかけに、コードではなく…
記事を読む →
開発・実装
GitHub Copilot SDK for Java登場、フレームワーク非依存でAIエージェントを構築
GitHubがJava向けのCopilot SDKのプレビュー版を公開しました。このSDKは、Langchain4jやSpring AIのような特定フレームワークへの依存を排除し、Jakarta…
記事を読む →
開発・実装
AI会議録画ツールtl;dvに深刻な脆弱性、18万件超の会議メタデータが閲覧可能に
会議録画プラットフォーム「tl;dv」で、認証済みユーザーなら誰でも全ユーザーの会議メタデータを閲覧できる脆弱性が報告された。研究者は1月に報告したが、7月時点でも修正されておらず、実際に他者の会議への不正参加も実証され…
記事を読む →
開発・実装
知識蒸留のコストを削減するオフラインtop-Kキャッシュとチャンク化KL損失
Multiverse Computingは、大規模言語モデルの知識蒸留を低コスト化する論文を発表した。教師モデルのtop-Kロジットをキャッシュし、KL損失をチャンク処理することで、蒸留時のVRAM使用量を大幅に削減でき…
記事を読む →
開発・実装
Cohere Health、Bedrock AgentCoreで臨床ポリシーをデジタル化
Cohere Healthは、保険の事前承認プロセスを支える臨床ポリシーを、機械可読な構造化データへ変換する「Cohere Policy Studio」をAmazon Bedrock…
記事を読む →
開発・実装
Databricks、AIコーディング費用を70%削減 - 効率性重視のモデル戦略
Databricksは、AIコーディングツールの運用コストを70%削減したと発表した。同社は、最新かつ低コストのオープンソースモデルを迅速に採用し、ルーティングやメタハーネスといったインフラを整備することで効率を高めた。…
記事を読む →
開発・実装
Bedrockの自動推論ポリシーを6つのAgent Skillsでコード運用
AWSは、Amazon BedrockのAutomated Reasoningチェックをコードエージェントから操作するためのAgent Skills一式を公開しました。ポリシーの作成からテスト、デプロイ、検証までを6つの…
記事を読む →LLM推論エンジンvLLMの内部を解説、V1アーキテクチャの基本構造とは
vLLMの内部構造を解説するブログ記事シリーズが公開された。第1回となる本記事では、高スループットなLLM推論を実現するvLLMのV1エンジンのコア構成要素(スケジューラー、PagedAttention、連続バッチ処理な…
記事を読む →SageMaker Python SDK v3、LLM推論の最適化がノートブックで完結
Amazon SageMaker Python SDK v3.17.0で、生成AI推論のデプロイを最適化する新機能が利用可能になった。エンドポイントのベンチマーク、データに基づくデプロイ推奨の生成、推奨構成の直接デプロイ…
記事を読む →
開発・実装
Bedrock AgentCoreの時間的ポリシー、AIエージェントの状態を踏まえた認可を実現
AWSがAmazon Bedrock AgentCore向けに時間的ポリシーを発表した。これはAIエージェントのセッション履歴(トレイジャクトリ)を参照し、各ツール呼び出しの可否を判断する認可機能である。従来のステートレ…
記事を読む →
開発・実装
クラウドのAIエージェントからPC上のMCPツールを呼び出すブリッジ構成をAWSが解説
Anthropicが公開したModel Context Protocol(MCP)は、AIモデルが外部のデータやツールに接続するためのオープンな標準規格です。従来のMCPは同一マシン上のプロセス間通信(stdio)か、H…
記事を読む →
開発・実装
AIが3Dゲームを自動生成、Claude Fable 5が実演した開発手法
Simon Willison氏は2022年のツイートに添付した画像をClaude Fable 5に渡し、「ブラウザで動く3Dゲームを作ってほしい」と指示しただけで、遊べるゲーム「Raccoon…
記事を読む →
開発・実装
Amazon Bedrock AgentCoreでWebインサイト抽出を自動化する構成
Amazon Bedrock AgentCoreのBrowser機能を利用して、RSSフィードやWebページからインサイトを自動抽出するソリューションが解説されました。JavaScriptを多用するページでも管理ブラウザ…
記事を読む →
開発・実装
AIエージェントがオントロジーを復活させる:確率的LLMを境界内に保つ仕組み
AIエージェントの信頼性を高めるために、オントロジーと呼ばれる知識構造が再注目されています。AI Engineer World's Fairでの講演を基に、LLMの確率的推論を論理的なガードレールで制御する「ニューロシン…
記事を読む →
開発・実装
SageMaker AI推論の品質劣化を検出するメタモニタリング基盤、AWSが公開
AWSは2026年7月30日、Amazon SageMaker AIエンドポイント向けの推論メタモニタリングソリューションを公開しました。本番運用中のMLモデルについて、データドリフトとモデルドリフトを検出し、Amazo…
記事を読む →
開発・実装
Together AI、LLM推論のオートスケーリング機能を公開
Together AIは同社のDedicated Model Inferenceサービスで、推論エンジンが実際に理解するメトリクスを用いたオートスケーリング機能を提供する。inflight_requestsやTTFT、G…
記事を読む →
開発・実装
コーディングAIが科学計算を変える OpenAIが8件の実践報告を公開
OpenAIは2026年7月28日、AIエージェントを使って科学計算ソフトウェアを開発・保守した8件の実地調査レポートを公開した。生命科学を中心に、Codex単独またはClaude…
記事を読む →
開発・実装
Amazon Bedrock AgentCoreとMCPサーバーで自律BIを設定だけで実現
Amazon Web Services(AWS)は、ブログ「Generate Autonomous Business Insights with AI Agent and MCP Servers」で、Amazon…
記事を読む →
開発・実装
Bedrock AgentCore IdentityがPrivate Key JWT認証に対応、KMS署名でOAuth連携を強化
Amazon Bedrock AgentCore Identityは、エージェントがOAuth 2.0のクライアント認証を行う際に、共有シークレットの代わりに署名付きJWTを使うPrivate Key…
記事を読む →GPT-Realtimeでヤマダデンキの接客ノウハウを24時間AI化、2週間で約3万人が利用
avatarinは、OpenAIのGPT-Realtimeを使い、ヤマダデンキ向けの音声対応ショッピングエージェント「Kurashi-Marugoto AI…
記事を読む →
開発・実装
Amazon Bedrock、最大5モデルを一括最適化するプロンプト移行支援機能
AWSは2026年7月30日、Amazon Bedrockの新機能「Advanced Prompt Optimization」を公開した。プロンプトの書き換えと評価を自動で反復し、最大5モデルの品質・レイテンシー・コスト…
記事を読む →Basetenが130億ドル調達、推論エンジニアリングの最前線とは
AIモデルを実運用で高速・安定的に動かす「推論エンジニアリング」が、AIインフラの重要分野として存在感を増している。Basetenは130億ドルの大型調達を完了し、AIインフラの一角を担う企業へと成長。本記事では、同社の…
記事を読む →
開発・実装
Meta、広告向け基盤モデルGEMの学習効率を2倍化——MFU 20〜25%達成
Metaは、InstagramとFacebookの広告推薦を支える生成型広告推薦モデルGEMをLLMスケールで学習し、エンドツーエンドの学習効率(MFU)を20〜25%に倍増させ、総学習FLOPsを12ヶ月で4倍に拡大し…
記事を読む →
開発・実装
グーグルChromeのセキュリティパッチ、AIバグ発見で週2回配布へ
GoogleのChromeが、セキュリティパッチを週2回のペースで配布するようになっていると報じられた。きっかけはAIを活用した脆弱性探索の進展だ。かつて6週間ごとだった更新サイクルは、AIが多くのバグを見つけることで大…
記事を読む →
開発・実装
Google、AIでChromeの脆弱性修正が急増—6月だけで過去2年分超え
グーグルは2026年7月30日、自社のAIツールを活用したChromeブラウザのセキュリティ強化についてのホワイトペーパーを公開し、6月にリリースした最新2バージョンで計1,072件の脆弱性を修正したと明らかにした。これ…
記事を読む →MCP 2.0登場でSimon Willison氏が新ツール3種を公開
MCP(Model Context Protocol)が7月28日付で2.0へ更新され、ステートレスなHTTP呼び出しが可能になった。これを受けてSimon…
記事を読む →
開発・実装
GPT-5.6 SolのARC-AGI-3スコアが3倍に、原因は2つのAPI設定
OpenAIは、同社のAIモデルGPT-5.6 SolがARC-AGI-3ベンチマークで低いスコアにとどまっていた理由を調査し、原因がモデル能力ではなく評価用ハーネスの設定にあると発表した。推論メッセージを保持するret…
記事を読む →