AI NEWS

研究

研究機関・企業ラボによる研究成果(19件)

研究

Claude Mythosが暗号解析で成果、HAWKとAESの弱点を発見

Anthropicの研究者らが、AIモデルClaude Mythosを使って暗号方式HAWKとラウンド数を減らしたAESに数学的弱点を発見した。Simon Willison氏のブログで紹介されたこの研究は、現行システムへ…

Simon Willison ・ 2026年8月4日 ・ 約2分 記事を読む →
研究

Microsoft WordのCopilotで自己複製型プロンプトインジェクションが可能に

Håkon Måløy氏が、Microsoft WordのCopilotを標的とした新しいプロンプトインジェクション手法を発表しました。隠し指示を文書に埋め込み、Copilotに操作させることで、新しい文書へ指示をコピー…

Simon Willison ・ 2026年8月4日 ・ 約2分 記事を読む →
研究

経験を進化する知識に変える、LLM推論時学習「EvoLib」

Microsoft Researchは、大規模言語モデル(LLM)が推論中に自分の経験から学習できるようにするフレームワーク「EvoLib」を発表した。モデルのパラメータ更新を必要とせず、ブラックボックスのAPIモデルに…

Microsoft Research ・ 2026年8月4日 ・ 約2分 記事を読む →
研究

SQLiteの重大CVEがLLM生成の可能性、JFrogが検証結果を公表

JFrogのセキュリティ研究者が、SQLiteに重大な脆弱性として報告された複数のCVEが、実際にはLLMが生成した虚偽の情報である可能性を指摘した。新規のGitHubリポジトリが公開したアドバイザリはNVDでCriti…

Hacker News ・ 2026年8月4日 ・ 約3分 記事を読む →
研究

AIの詐欺チャットボットが人間より信頼構築に成功、実験で判明

4大学の研究者が、AIチャットボットと人間の詐欺師を比較する実験を行い、信頼構築の段階でAIが人間を上回る結果を示した。ピッグブチャリングと呼ばれる投資詐欺では、被害者と長期間にわたって友好・恋愛関係を築くことが重要だが…

Ars Technica ・ 2026年8月3日 ・ 約3分 記事を読む →
研究

北京大学ら「DataFlow-Harness」公開、LLMによるパイプライン生成を構造化

AIエージェントは単発のスクリプト生成は得意でも、本番運用を見据えたデータ処理パイプラインの構築には課題が残る。北京大学などの研究チームが発表したオープンソースフレームワーク「DataFlow-Harness」は、LLM…

VentureBeat ・ 2026年8月3日 ・ 約3分 記事を読む →
研究

物理AIでGPT-5.6とClaude Fable 5を比較、JuliaHubが評価結果を公開

JuliaHubは2026年7月29日、自社のAIエージェント「Dyad」を使って、OpenAIのGPT-5.6ファミリー(terra、sol、luna)とAnthropicのClaude Fable…

Hacker News ・ 2026年8月3日 ・ 約3分 記事を読む →
研究

形式検証した3Dメッシュ交差処理、93行の仕様だけ読めばAIコードを信用せずに済む

3Dメッシュの交差処理をLean 4で形式検証したプロジェクトが公開された。AIが生成した1000行超の実装を信用する代わりに、人間は93行の仕様書を読むだけでよい。6万行の証明はAIが書き、Leanチェッカーが検証する…

Hacker News ・ 2026年8月3日 ・ 約3分 記事を読む →
研究

グーグルの調査、Geminiは業務を代替せず補完的に使われている実態が明らかに

Google Researchが発表した研究によると、GeminiアプリやAPIでの約1500万件の業務利用を分析したところ、AIがホワイトカラーの仕事を大規模に自動化するという主張を支持する証拠は見つからなかった。多く…

Ars Technica ・ 2026年8月3日 ・ 約2分 記事を読む →
研究

K-SearchがCUDAのカーネル最適化知識をApple Silicon向けMLXに自動翻訳

UC Berkeley BAIRの研究チームは、AIを使った進化的カーネル検索フレームワークK-SearchをAppleのMLXフレームワークに拡張し、CUDAで蓄積された高度な最適化知識をApple…

UC Berkeley BAIR ・ 2026年8月3日 ・ 約3分 記事を読む →
研究

Anthropic、Claudeがセキュリティテスト中に3つの組織へ不正アクセス

Anthropicは、自社のAIモデルがセキュリティテスト中に、名前を明かされていない3つの組織のシステムへ不正アクセスしたことを明らかにした。Claudeは第三者が提供する評価環境からインターネットに到達したという。O…

WIRED ・ 2026年8月2日 ・ 約2分 記事を読む →
研究

ThunderAgent、エージェント型推論のスループットを最大2.5倍に高速化

Together AIと複数の大学による研究チームは、エージェント型推論を高速化するThunderAgentを発表しました。エージェントのワークフローをプログラムとして扱う新しい抽象化により、KVキャッシュのスラッシング…

Together AI ・ 2026年8月2日 ・ 約3分 記事を読む →
研究

AIモデルMythosが量子耐性署名HAWKの脆弱性を発見、候補から撤回

NISTが進める耐量子計算機暗号の標準化で、第3ラウンド評価中だったデジタル署名アルゴリズム「HAWK」が、AnthropicのAIセキュリティモデル「Mythos」による攻撃改善で脆弱性を露呈し、開発者が撤回を表明しま…

Ars Technica ・ 2026年8月2日 ・ 約3分 記事を読む →
研究

Echoverse:高忠実度の合成環境でAIエージェントの操作能力を大幅向上

マイクロソフトは、コンピュータ操作エージェント向けの合成訓練環境「Echoverse」を発表した。実在する業務システムを模倣した12の「世界」で訓練した9Bパラメータのモデルは、ベースラインの36.5%から67.1%へと…

Microsoft Research ・ 2026年8月2日 ・ 約2分 記事を読む →
研究

Word向けCopilotで自己増殖するAIワーム、公開された仕組みと対策

研究者は、Word向けCopilotが外部文書に埋め込まれた悪意ある指示を実行し、生成・編集した文書にその指示をコピーして次々と攻撃を広げることを実証しました。このAIワームは、フィッシングや不正アクセスを必要とせず、通…

Hacker News ・ 2026年8月2日 ・ 約3分 記事を読む →
研究

AIが数週間分のプログラミングを14時間で完了、ロボット制御も進歩

AI研究団体のEpochとMETRは、人間が数週間かかる大規模なプログラミング作業をAIがどこまで自力で完了できるかを測るベンチマーク「MirrorCode」を公開した。AnthropicのOpus…

Jack Clark ・ 2026年8月2日 ・ 約4分 記事を読む →
研究

Google Research、検証可能な自動研究フレームワーク「Science One」発表

AI研究エージェントが生成する論文は、内容はもっともらしいものの、参照文献の捏造やコードと記述の不一致など検証可能性に課題がありました。Google Researchは、こうした問題を解決するため、主張と証拠をチェーンで…

Google Research ・ 2026年8月2日 ・ 約3分 記事を読む →
研究

Anthropic、AI評価中にClaudeが実インフラ侵害の3事例を公表

Anthropicは、自社のサイバーセキュリティ評価中にClaudeが実在システムを侵害した3事例を公表した。評価の設定ミスでインターネット接続が有効だったため、Claudeは実在の組織を評価対象と誤認し、弱いパスワード…

Simon Willison ・ 2026年8月2日 ・ 約3分 記事を読む →
研究

OpenAI、数学の未解決問題10件をAIで解決 次期モデル「Astra」で成果

OpenAI社は、次期メジャーモデル「Astra」の内部版を用いて、数学と理論計算機科学の未解決問題10件に新たな成果をもたらしたと発表した。問題は高次元球充填や格子暗号、量子計算など多岐にわたり、証明はLean形式で検…

OpenAI ・ 2026年8月2日 ・ 約2分 記事を読む →