研究者によるサイレントなデータ漏洩の指摘から2日後、xAIがGrokのビルドをオープンソースとして公開
新たに公開されたApache-2.0リポジトリには、隠されたサーバー側のフラグによってデータ流出ルーチンが依然として組み込まれており、さらに出典不明のOpenAIのコードスニペットまでもが含まれています。そのため、開発者は当該ツールを監査し、露出した可能性のある認証情報を更新する必要があります。
AI、機械学習、LLMのインサイト。
新たに公開されたApache-2.0リポジトリには、隠されたサーバー側のフラグによってデータ流出ルーチンが依然として組み込まれており、さらに出典不明のOpenAIのコードスニペットまでもが含まれています。そのため、開発者は当該ツールを監査し、露出した可能性のある認証情報を更新する必要があります。
Lightspeed Venture Partnersが主導するシリーズCの資金調達は、Nekoの旗艦となるニューヨークのクリニックの設立資金に充てられます。このクリニックは、高解像度イメージング、血液検査、独自のセンサーをAIと融合させることで、臨床医が症状が現れる前に疾患の前兆を特定することを可能にします。
この研究は、特定のタスクと相関する部分的なアクティベーション・マップを提示しているに過ぎず、因果関係は証明されていない。透明性の向上に向けた動きを示すものではあるが、開発者はこれを安全性の保証ではなく、初期段階の診断ツールとして扱う必要がある。
この実験では、開発者を「AI支援あり」と「ドキュメントのみ」のグループに分けて検証を行いました。その結果、AIを利用したグループは概念理解のクイズでスコアが17%低かった一方、作業時間の短縮という明確なメリットも見られませんでした。これは、手軽なコードスニペットの利用が知識の欠如を覆い隠し、結果として将来的なメンテナンスコストを増大させるリスクがあることを浮き彫りにしています。
米国著作権局は、グラフィックノベルに使用されたMidjourney生成の画像は著作権保護の対象外とする一方、著者の文章やコマの構成については著作権を認める裁定を下した。これは、人間による創作的寄与を証明することの重要性を浮き彫りにしている。
内蔵の CodeQL クエリは、信頼できないソース(GitHub の Issue 本文など)からモデル呼び出し SDK へのデータフローをフラグ立てします。expected-alerts.json を用いてポジティブおよびネガティブなテストファイルをまとめることで、その検知をビルド時のゲートとして活用できるようになります。
キャッシュの読み書きのタイミングを監視することで、攻撃者は入力データとモデルの学習済み重みの一部を推論できます。これは、定数時間コードやモデルの暗号化を導入していても解消されない脆弱性です。
実践的な検証において、ある開発者がLLM、メモリレイヤー、プランナー、ツール統合を組み合わせる作業に数時間を費やしたものの、結局はハルシネーションや繰り返されるリトライ、トークンコストの問題に直面することとなった。これは、真の自律性を実現するには、依然として手動での構築が必要であることを物語っている。
ダウンストリームのメンテナーが2つのGTKコールの順序を入れ替えたことで、Linux上のQtベースのElectronアプリでセグメンテーション違反を引き起こしていたヌルポインタ参照が防止されました。同様の変更はアップストリームのプルリクエストとして公開されていますが、バージョン 42.6.0 により、ユーザーは今すぐこの修正を利用可能です。
Honchoチームは、低速なLLMや埋め込み(embedding)呼び出しの待機中にデータベース接続を開いたままにすると、コネクションプールを占有してしまう可能性があることを発見しました。プリフライト読み取り(pre-flight reads)を採用し、セッションを一度閉じて書き込み時のみ再オープンする手法に切り替えることで、レイテンシの削減とスケーラビリティの向上を実現しました。
マイクロソフトは、営業チームをOpenAIやAnthropicに対抗させるべく戦略を転換。AIの先駆者との密接な協力関係から、市場へのアプローチを決定的に変えようとしています...
The benchmark ran five agents on a single RTX 5090, tasking them with adding a Tag Manager to an admin panel without any cloud APIs. Qwen 3.6 35B-A3B completed the job autonomously, added sensible improvements, and required zero post-run patches.
Claude Apps Gatewayは、コントロールプレーンを顧客のAWSアカウント内に組み込むことで、IT部門がアイデンティティ、監査ログ、コストを単一の管理画面から一元管理できるようにします。これにより、開発者はデータを外部にさらすことなく、Claudeを活用したセッションを立ち上げることが可能になります。
このアシスタントは、静的なウェブページと共にモデルの重みを配信します。固定された8つのツール、文法制約付きデコーディング、およびRAGを使用しており、これらはすべて単一の16GB GPUでわずか30Mトークンを用いて学習されています。
この検出器は、全ヘッドの生のアテンションスコアを記録してレイヤーごとに集計し、log-MADテストを用いてアテンションの大部分を占めるトークンを特定します。これらの「シンク」トークンをKVキャッシュから削除すると、生成が不安定になり、品質が大幅に低下します。
この提案は、既存のメッセージフィルタリング規則を、二人がテキストをやり取りするあらゆるサービスにまで拡大するものです。これにより、AIプロバイダーは、モデルがプロンプトを認識する前に、すべてのユーザープロンプトに対して自動スキャナーを実行しなければならなくなります。
このセルフプレイ・システムは、攻撃モデルと防御モデルを対戦させることで、各失敗から学習し、人間では思いつかないような脆弱性のパターンを浮き彫りにします。そして、その知見をGPT-5.6のトレーニング・パイプラインに直接投入します。
Codex Microは、ライトアップされたエージェントキー、プログラマブルなショートカット、ジョイスティック、そしてReasoning Dialを搭載しています。これらはすべてChatGPTデスクトップアプリに直接連携しており、開発者はIDEから離れることなく、複数のAIエージェントを監視・操作することが可能です。
Lambda上でのAIエージェントの実行は、ミリ秒単位で見れば安価に思えるかもしれません。しかし、真のコスト要因は、コールドスタートによるレイテンシや、複数のモデル呼び出しを誘発するリトライループ、そしてコンピューティング料金をはるかに上回るトークン消費量にあります。
The two vulnerable scripts—one embedding an HMAC signing key, the other a plain-text SMTP password—demonstrate how LLMs fill in missing values when asked for a “usable example,” turning handy snippets into credential leaks across version control and production.
新たに公開された4つの脆弱性は、パブリックネットワークへのバインド、誰でも読み取り可能な設定、寛容すぎるサンドボックス、監査ログの欠如といったデフォルト設定に起因しており、攻撃者は無害なログエントリからわずか数分でシステム全体の制御を奪うことが可能になります。
Ode with Anthropic, founded by Chris Taylor and Eddie Siegel, fuses Fractional AI’s talent pool with Anthropic’s Claude models, backed by Blackstone, Hellman & Friedman, and Goldman Sachs, to turn proof-of-concepts into production-grade AI systems.
Inkling, trained on 45 trillion multimodal tokens, delivers Nvidia-level coding performance while activating just a fraction of its 975 billion parameters, slashing latency and operational costs for enterprise users.
セルフプレイ型の「dojo」により、GPT-Redが攻撃者として振る舞う一方で防御モデルが防御策を学習し、LLMに誤った前提を受け入れさせる「偽の思考の連鎖(fake chain-of-thought)」攻撃といった新たな手法を明らかにしています。