GyaanSetu AI

AI、機械学習、LLMのインサイト。

1317 articlesDeep, practical knowledge

Oktaのアイデンティティ・スコープ型MCPにより、エージェントによる未承認ツールの閲覧を防止

Oktaの新しいアイデンティティ・スコープ型Model Context Protocolは、エージェントに許可されたツールスキーマのみを提供します。これにより、エンタープライズAIワークフローにおける最小権限アクセスを徹底しながら、トークン消費量と推論コストを劇的に削減します。

AI · 3 分で読めます

米国のティーンエイジャーの57%が学習にチャットボットを利用、感情的サポートを求めるのはわずか12%

2026年2月のピュー・リサーチ・センターによる10〜18歳を対象とした調査では、AIを実用的な補助ツールと見なす傾向が示されました。具体的には57%がリサーチに、54%が学校の課題に利用していますが、同時に、AIが創造性を損なう、環境負荷を高める、誤情報を拡散させるといった懸念も抱いています。

AI · 3 分で読めます

サイレントなモデル更新がダウンタイムのリスクを招く:DeepSeekの新しいV4 Pro 0813がツールコールを破壊

DeepSeekは、変更されていない`deepseek-v4-pro`エンドポイントの背後にあるプレビュービルドを、正式にリリースされたV4 Pro 0813モデルに置き換えました。これにより、重み、指示の処理、およびJSONツールコールのフォーマットが変更され、安定した出力を必要とする本番環境のパイプラインが破損する恐れがあります。

AI · 4 分で読めます

MacBook M2 Proにおいて、Metaの30B Muse GlimmerはLlama 3Bよりも56倍遅い

32GBのM2 Pro MacBookを用いたベンチマークでは、1秒あたりのトークン生成数、JSON生成の成功率、および総コール時間を測定しました。その結果、精度は同等であったものの、Muse Glimmerの1コールあたりのレイテンシは33秒であったのに対し、Llama 3.2は1秒未満のスピードを記録しました。

AI · 4 分で読めます

CognitionがWindsurfをDevin Desktopにリブランド、マルチモデル対応のAI IDEを実現

このリブランドは、CognitionとGoogleとの24億ドルのライセンス契約、および白紙となった30億ドルの買収案件を受けて行われたもので、独自のモデル開発から、Claude Code、OpenAI Codex、Google Gemini、さらにはあらゆるACP互換エージェントをオーケストレートできるIDEへと注力先をシフトさせている。

AI · 4 分で読めます

Nemotron 3.5 LightningのSwitchyardルーターが推論コストを倍増させる可能性

Nvidiaの新しいNemotron 3.5 Lightningは、30BのMoEモデルをわずか3Bの有効パラメータで動作させますが、そのNeMo Switchyardルーティング層がモデルの切り替え時にキャッシュされたプロンプトを破棄することがあり、これにより単一の推論リクエストのコストが実質的に2倍になる可能性があります。

AI · 3 分で読めます

サイレントなデータ消失の脅威:16年にわたるバグにより、SQLite WALを使用する全サービスにアップグレードを推奨

Tailscaleのエンジニアは、消失した設定エントリの原因が、SQLiteのWrite-Ahead Logging(WAL)における2010年の欠陥であることを突き止めました。このバグは、特定のファイルシステムにおける高並列な書き込みによって発生し、SQLite 3.46.1で修正されるまで、データベースを密かに破損させ続けていました。

AI · 2 分で読めます

Muse Glimmerが30Bモデルのローカル実行を可能にし、オンデバイスAIが進化

Muse Glimmerの300億パラメータモデルは、約17GBに量子化されており、llama.cppランタイムを介して24GBのVRAMを持つGPUやApple Silicon搭載Macで動作します。オンデバイスエージェントとしては非常に強力ですが、安全性テストでは競合よりも違反率が高い傾向にあるため、開発者は追加の安全策を講じる必要があります。

AI · 4 分で読めます

AIのハルシネーションがブローカー・ディーラーによるFINRA規則2210違反を招く恐れ

FINRAの規制通知24-09は、既存のすべての監督、通信、プライバシー、記録保持、および最善利益に関する規則が、生成AIの使用にも適用されることを明確にしています。また、審査官はインベントリ、プロンプトログ、および人間によるレビューのチェックポイントの提示を求める方針です。

AI · 3 分で読めます

EU、AIソフトウェアを「製品」と定義:2026年12月までに開発者へ厳格責任を課す

改訂された指令 (EU) 2024/2853は、ダウンロード型、組み込み型、クラウド型のあらゆるソフトウェアを「製品」と定義し、製造業者、輸入業者、コンポーネント提供者、さらにはファインチューニングを行う者に対しても厳格責任を課します。企業は2026年12月9日の期限までに、コードの監査、学習データの文書化、および保険の更新を行う必要があります。

AI · 3 分で読めます

無料ベータ版によるClaudeエージェントのコスト削減は14%ではなく、実際は約3%程度

このベータ版ヘッダーはClaudeのツールコール出力を圧縮することで、該当トークンを約14%削減します。しかし、出力トークンが総トークン数に占める割合はわずかであるため、ほとんどのユーザーにとってのAPI利用料金の削減幅は全体の約3%にとどまり、わずかなレイテンシの改善が見られる程度となります。

AI · 3 分で読めます

Prompt Flowのセキュリティアップデートが2026年に終了:組織はコンプライアンスのリスクに直面

Prompt Flowは2026年4月20日に新機能の提供を停止し、その1年後に廃止される予定です。これにより、ランタイムイメージにセキュリティパッチが適用されなくなるため、Microsoftはコンプライアンスの問題が発生する前に、開発者がAgent Frameworkへ移行することを推奨しています。

AI · 3 分で読めます

AmazonがTwitchの配信をAI学習に自動登録 — クリエイターは自身で拒否設定を行う必要あり

Twitchの最高製品責任者は、オプトイン方式では参加者が全く得られないため、プラットフォームはデフォルトで配信を学習対象とする方針を示しました。クリエイターがこれを回避するには、チャンネル設定内の隠れたトグルを操作する必要がありますが、Twitchは過去の配信がすでにAmazonのモデルに組み込まれているかどうかについては明言を避けています。

AI · 4 分で読めます

Devinの月次50%のエンタープライズ導入が、Cognitionの400億ドル規模の資金調達を後押し

Cognitionの最新の資金調達交渉は、Devinの急速な普及を背景に、企業価値を260億ドルから400億ドルへと引き上げることを目指しています。Devinの導入拡大により、年間収益は4億9200万ドルから予測10億ドルへと急増しており、すでにNASAやゴールドマン・サックスといった大手企業も導入しています。

AI · 3 分で読めます

Twitch、配信者がAmazonのAI学習への利用をワンクリックで拒否できる機能を提供

デフォルトでオンになっているこの設定は、Twitchの「セキュリティとプライバシー」タブにあります。これを切り替えることで、プラットフォーム内のモデレーションやレコメンデーション機能は維持したまま、ライブ配信、VOD、クリップ、チャット、アップロードされたすべてのコンテンツがAmazonの生成AIパイプラインに提供されるのを停止できます。

AI · 3 分で読めます

Sandbar、カスタムのプッシュ・トゥ・トークAIリング開発に向けシリーズAで2300万ドルを調達

Sandbarの「Stream」リングは、あえてプッシュ・トゥ・トーク方式のボタンを採用することで、多くの常時起動型ウェアラブルが直面してきたプライバシーへの懸念を回避しています。総額3,600万ドルの資金調達に支えられた完全カスタムハードウェアは、ビジネスから日常の社交シーンまで幅広く活用されることを目指しています。

AI · 2 分で読めます

放射線科医の報告:AIによるリコール率の低下は、期待されていた59%に対し、わずか35%にとどまる

米国乳房画像学会(Society of Breast Imaging)の会員215名を対象とした調査によると、すでに50%がFDA承認済みのAIを活用しているものの、リコール率の低下を実感しているのはわずか35%に過ぎず、期待されていた59%を大幅に下回りました。この結果は、期待値と実用におけるパフォーマンスとの間に大きな乖離があることを浮き彫りにしています。

AI · 2 分で読めます

Anthropic、97%が「盲目的なクリック」だったとの調査を受け、手動の「承認」ボタンを廃止へ

AnthropicのClaude Codeは8月14日より、ツール呼び出しのたびにユーザーへ「承認」を求める運用を停止します。これに代わり、取り消し不能な操作や破壊的な操作、あるいは外部への影響がある操作の場合にのみ警告を発する、AI駆動のリスク分類器が導入されます。

AI · 2 分で読めます