GyaanSetu AI

AI、機械学習、LLMのインサイト。

1515 articlesDeep, practical knowledge

GeekyAnts、React Fiberを活用してAI生成されたReactアプリをFigmaへ書き戻す

一般的なDOMではなくReactの内部的なFiberツリーを読み取ることで、GeekyAntsはすべてのコンポーネント、バリアント、および状態を編集可能なFigmaファイルへとマッピングできます。これにより、デザインシステムの整合性を維持しながら、画面の再構築にかかる時間を大幅に削減することが可能になります。

AI · 3 分で読めます

Claude Codeが/loop、/goal、/scheduleを追加し、繰り返しのコーディング作業を自動化

Claude Codeは、/loop、/goal、/scheduleという3つのループ・エンジニアリング・コマンドを新たに提供します。これにより、同一のモデルが自律的に作業の反復、検証、継続を行えるようになります。スキル、検証者、ガードレール、およびコスト上限を定義することで、開発者はトークン使用量を管理しながら、ビルド、テスト、デプロイを自動化できます。

AI · 3 分で読めます

たった1行のタイムスタンプが、あるAIエージェントのOpenAIコストを3倍に跳ね上げた

エージェントがシステムプロンプトの冒頭に現在のタイムスタンプを追加したことで、すべてのリクエストのバイトプレフィックスが固有のものになってしまいました。これによりOpenAIの完全一致キャッシュが機能しなくなり、18,000個の静的トークンに対してフル料金での実行を余儀なくされ、請求額が3倍に膨れ上がりました。

AI · 2 分で読めます

企業が「イエローチーム」を導入、AIの修正時間を数週間から数日へと短縮

攻撃的なレッドチームの戦術と防御的なブルーチームの防御を融合させることで、イエローチームはプロンプトインジェクションの欠陥を発見し、外部の攻撃者に悪用される前に検知ルールを作成・展開することが可能となり、侵害からパッチ適用までのサイクルを劇的に短縮します。

AI · 3 分で読めます

Sverkloがコード検索に4層の監査トレイルを追加、開発者がクエリの全工程を確認可能に

Sverkloは、従来のBM25キーワードエンジン、ONNX埋め込み、PageRankによるランク付けされたシンボルグラフを統合。さらに、`found_by`フィールドとメモリ台帳を公開することで、開発者がどのシグナルによって各ヒットが生成されたか、またキャッシュされた回答が最新であるかを確認できるようにしています。

AI · 3 分で読めます

制御理論を用いた新たな手法により、単一のGPUでの拡散モデルの微調整が可能に

微調整をメモリレスな確率的最適制御問題として定式化するAdjoint Matchingは、コストのかかるバックプロパゲーションを軽量なオプティマイザに置き換えることで、大規模な拡散モデルやフロー生成器を、特有の不安定さを回避しながら、限られたスペックのハードウェアでも適応させることを可能にします。

AI · 2 分で読めます

Claude Codeは、名前を変更するまで72 KBのAGENTS.mdを無視し、トークンのオーバーヘッドを発生させる

実験により、72 KBのAGENTS.mdファイルは正しいハッシュで存在しているものの、Claude Codeからは一切参照されないことが明らかになりました。これを標準のCLAUDE.mdにリネームすると、アシスタントがファイルを読み込むようになり、出力の改善には繋がらないままトークン数とレイテンシが増大しました。

AI · 3 分で読めます

OpenAIの元メンバー、AIによるFDA承認薬の転用で、より迅速な治療法の開発に挑む

このベンチャーは、OpenAIの元研究者らを中心としたコアグループを募り、既存の薬の新たな治療用途を予測するトランスフォーマーベースのモデルを構築します。これにより、規制当局の承認プロセスを大幅に短縮し、急成長するAIバイオテック分野の資金調達の波を取り込むことを目指しています。

AI · 4 分で読めます

ITAR対応のため、UAVメーカーは不変のハッシュチェーンを用いたIoTスタックの再設計を迫られている

このガイダンスでは、UAV部品工場がコンプライアンスを維持するために、導入初日から組み込むべき4つの必須の転換(改ざん検知可能なハッシュチェーン、リアルタイムのITAR資格検証、ゾーンレベルのRFIDトラッキング、および双方向のERP統合)について詳述しています。

AI · 3 分で読めます

クエリの95%を安価なモデルにルーティングし、AI APIのコストを95%削減

チームは、トラフィックの95%を軽量モデルに振り分けるフロントエンド分類器を構築。さらに、Redisキャッシュによる繰り返し回答(「分かりません」を含む)への対応、プロンプトの圧縮、バックグラウンドジョブのバッチ化を実施しました。これにより、レイテンシを維持したまま、月額コストを420ドルから28ドルへと大幅に削減することに成功しました。

AI · 3 分で読めます

GoogleのGenkit APIにおける「ヒューマン・イン・ザ・ループ」機能、AIによる重大なミスを防ぐことを目指す

このプレビューでは、実行時間の長い呼び出しをバックグラウンドプロセスにオフロードする「detached turns」や、レビュアーがエージェントのアクションを承認または拒否できる「ヒューマン・イン・ザ・ループ」プロンプトが導入されます。これらは、ダウンタイムを削減し、コストのかかるエラーを回避するために設計された機能です。

AI · 2 分で読めます

インド、詐欺撲滅のため全新規SIMに顔認証を義務化

新しいASTRシステムは、登録時に自撮り写真を撮影して高次元埋め込みデータに変換し、数十億人の顔データが蓄積された国家データベースと即座に照合することで、複数の電話番号における重複利用を防止します。

AI · 2 分で読めます

インプレッションの高いキーワードを排除し、AI SEOパイプラインがCTRを3%に向上

競合が多くインプレッションの高いクエリをフィルタリングし、親和性、難易度、CTRのチェックを通過したロングテールキーワードのみを追求することで、刷新されたパイプラインは記事量を半分に削減しながら、クリック率を2〜3%に引き上げ、検索順位を改善しました。

AI · 3 分で読めます

DeepSeekのDSpark、LLMの推論時間を最大85%削減し、GPUコストを大幅に低減

DSparkは軽量なドラフトモデルを用いてトークンバッチを予測し、フルLLMがそれを一度のパスで検証する仕組みを採用しています。MITライセンスのオープンソースライブラリである本技術は、DeepSeek、Qwen、Gemmaに対応しており、既存のハードウェアで60〜85%高速な推論を実現します。

AI · 2 分で読めます

AppleがiOS 27のパブリックベータ版を公開、25億台のデバイスにAI搭載のSiriを導入

このベータ版により、Siriは真のAIエージェントへと進化します。メールの読み取りや写真からのデータ抽出、さらにはグループチャットの要約まで可能になりますが、これらはすべてデバイス内モデルとAppleのPrivate Cloud Computeを活用することで、プライバシーを保護した状態で行われます。

AI · 3 分で読めます

マッチ・グループ、Hinge創設者が手掛ける音声重視のデーティングアプリ「Overtone」に1,800万ドルを投資

OvertoneのAIは、ユーザーの音声録音からトーン、リズム、ストーリーテリングのスタイルを分析し、マッチングの決め手となった具体的なデータポイントを提示します。従来の「スワイプ」による直感的な操作に代わり、透明性が高く、より深い繋がりを提供します。

AI · 3 分で読めます

SpaceXAI’s Grok Build Secretly Uploaded Entire Repos to Google Cloud

Cereblab traced Grok Build’s CLI traffic to a Google Cloud bucket, confirming it packed full git repositories—including ignored files and deleted credentials—and pushed them without opt-out. SpaceXAI disabled the feature and Musk pledged full deletion, but critics note the privacy command only toggl

AI · 4 分で読めます

Geminiの書籍全文学習を巡り、出版社がGoogleを提訴

訴状では、GoogleがGoogle BooksアーカイブやPlayストアから著作物全体をスクレイピングし、出所を隠すために著作権メタデータを削除したと主張されており、これを受けて最大1000億ドルの罰金につながる可能性があると警告する内部メモも作成されている。

AI · 3 分で読めます