GyaanSetu AI

AI, 머신러닝 및 LLM 인사이트.

1515 articlesDeep, practical knowledge

OpenAI, 스크린샷 없는 데스크톱 트래커로 Microsoft Recall을 압도하다

'Computer History'는 창 포커스, 버튼 클릭, 입력된 텍스트를 로컬에 기록한 후, 관련 있는 이벤트 정보만을 ChatGPT에 전달합니다. 사용자가 직접 선택하는 이 옵트인(opt-in) 시스템은 앱 블랙리스트 지정, 기록 삭제, 로깅 설정 등을 가능하게 하여, 시각적 캡처 없이도 더욱 풍부한 지원을 제공합니다.

AI · 4 min read

선거판에 등장한 AI: 미국 후보자의 40%가 데이터 센터 비용 언급

1,200개 이상의 선거 캠페인 사이트를 분석한 결과, AI가 전체 경선의 약 5분의 2에서 언급되며 외교 정책과 암호화폐를 앞질렀습니다. 이제 후보자들은 막대한 전력을 소비하는 데이터 센터가 전기 요금, 용수 공급 및 지역 토지 이용에 어떤 영향을 미칠지 설명해야 합니다.

AI · 3 min read

Okta의 ID 기반 MCP, 에이전트의 권한 없는 도구 접근 차단

Okta의 새로운 ID 기반 모델 컨텍스트 프로토콜(Model Context Protocol)은 에이전트가 사용할 권한이 있는 도구 스키마만 제공함으로써, 기업용 AI 워크플로우에 최소 권한 원칙을 적용하는 동시에 토큰 소비와 추론 비용을 획기적으로 절감합니다.

AI · 3 min read

조용한 모델 업데이트로 인한 다운타임 위험: DeepSeek의 새로운 V4 Pro 0813이 툴 호출(Tool Calls) 오류 유발

DeepSeek는 기존과 동일한 `deepseek-v4-pro` 엔드포인트의 프리뷰 빌드를 공식 출시된 V4 Pro 0813 모델로 교체했습니다. 이 과정에서 가중치, 지시사항 처리 및 JSON 툴 호출 형식이 변경됨에 따라, 안정적인 출력을 사용하는 프로덕션 파이프라인에 문제를 일으킬 가능성이 있습니다.

AI · 4 min read

메타의 30B Muse Glimmer, MacBook M2 Pro에서 Llama 3B보다 56배 느려

32GB M2 Pro MacBook에서 진행된 벤치마크를 통해 초당 토큰 생성률, JSON 성공률, 총 호출 시간을 측정한 결과, 정확도는 동일했음에도 불구하고 Muse Glimmer의 호출당 지연 시간은 33초인 반면 Llama 3.2는 1초 미만의 속도를 기록했습니다.

AI · 4 min read

조용한 데이터 손실 위협: 16년 된 버그로 인해 SQLite WAL을 사용하는 모든 서비스는 반드시 업그레이드해야 합니다

Tailscale 엔지니어들은 사라진 설정 항목의 원인이 SQLite의 Write-Ahead Logging(WAL)에 존재하는 2010년의 결함임을 밝혀냈습니다. 특정 파일 시스템에서 높은 동시성 쓰기 작업 시 발생하는 이 버그는 SQLite 3.46.1에서 패치되기 전까지 데이터베이스를 소리 없이 손상시켜 왔습니다.

AI · 2 min read

Muse Glimmer로 30B 모델 로컬 실행 가능해지며 온디바이스 AI 기술력 강화

Muse Glimmer의 300억 개 파라미터 모델은 약 17GB로 양자화되어, llama.cpp 런타임을 통해 24GB VRAM GPU 또는 Apple Silicon Mac에서 구동할 수 있습니다. 온디바이스 에이전트로서 뛰어난 성능을 보여주지만, 안전 테스트 결과 경쟁 모델보다 위반율이 높게 나타났으므로 개발자는 추가적인 안전장치를 마련해야 합니다.

AI · 4 min read

AI 환각 현상, 브로커-딜러의 FINRA 규정 2210 위반 초래할 수 있어

FINRA의 규제 통지 24-09는 기존의 모든 감독, 통신, 개인정보 보호, 기록 보관 및 최선 이익 규정이 이제 생성형 AI 사용에도 적용됨을 명시하고 있습니다. 이에 따라 검사관들은 인벤토리, 프롬프트 로그 및 인간의 검토 체크포인트를 요구할 것입니다.

AI · 3 min read

무료 베타, Claude 에이전트 비용 14%가 아닌 약 3% 절감

베타 헤더가 Claude의 툴 호출(tool-call) 출력을 압축하여 해당 토큰을 약 14% 줄여주지만, 출력 토큰이 전체 토큰에서 차지하는 비중이 작기 때문에 대부분의 사용자는 전체 API 비용에서 약 3%의 절감 효과와 약간의 지연 시간 개선만을 경험하게 됩니다.

AI · 3 min read

Devin의 전월 대비(MoM) 기업 도입률 50% 급증, Cognition의 400억 달러 규모 투자 유치 견인

Cognition은 Devin의 급격한 시장 채택을 바탕으로 기업 가치를 260억 달러에서 400억 달러로 높이기 위한 최신 자금 조달 협상을 진행 중입니다. Devin의 빠른 도입은 연간 매출을 4억 9,200만 달러에서 예상치 10억 달러로 끌어올렸으며, 이미 NASA와 골드만삭스 같은 주요 기업 고객들을 확보했습니다.

AI · 3 min read

트위치, 스트리머에게 아마존 AI 학습 데이터 활용 원클릭 거부 기능 제공

기본적으로 활성화되어 있는 이 토글은 트위치의 '보안 및 개인정보 보호' 탭에 위치하며, 이를 비활성화하면 플랫폼 내 운영 관리 및 추천 도구는 그대로 유지하면서 모든 라이브 스트림, VOD, 클립, 채팅 및 업로드 데이터가 아마존의 생성형 AI 학습에 사용되는 것을 차단할 수 있습니다.

AI · 3 min read