World Labs의 Atlas, 94%의 인간 선호도 테스트에서 주요 경쟁사들을 압도
Atlas는 공간 앵커링 기술을 사용하여 단 한 장에서 수십 장의 사진만으로 탐색 가능한 3D 세계를 구현하며, 최대 1분 분량의 1440p 영상을 렌더링하는 동시에 후속 로보틱스 및 콘텐츠 파이프라인을 위한 포인트 클라우드와 가우시안 스플래팅을 출력합니다.
AI, 머신러닝 및 LLM 인사이트.
Atlas는 공간 앵커링 기술을 사용하여 단 한 장에서 수십 장의 사진만으로 탐색 가능한 3D 세계를 구현하며, 최대 1분 분량의 1440p 영상을 렌더링하는 동시에 후속 로보틱스 및 콘텐츠 파이프라인을 위한 포인트 클라우드와 가우시안 스플래팅을 출력합니다.
아마존의 생성형 AI 엔진이 쇼핑용 알렉사에 적용되어, 수십억 개의 정상 메시지와 발신자 정보, 숨겨진 메타데이터, 전송 타이밍을 대조함으로써 쇼핑객이 의심스러운 이메일과 문자를 즉시 검증할 수 있도록 지원합니다.
Delta-v Capital이 주도하고 Microsoft의 M12와 Morgan Stanley가 참여한 이번 시리즈 B 투자는 HiddenLayer의 연간 반복 매출(ARR)이 수천만 달러 규모로 10배 급증함에 따라, 영업 확장, 멀티모달 공격에 대한 심층 연구 및 EMEA 시장 진출을 위한 자금으로 사용될 예정입니다.
The Israeli-Dutch startup has pivoted from multilingual customer-service bots to a model-agnostic AI operating system, deploying forward-deployed engineers on-site in 35+ countries. Backed by Insight Partners and a new stake from Salesforce, the $550M round will fund product development and global F
Anthropic은 시스템 프롬프트 규칙의 대부분을 제거해도 Claude Code의 결과물에 영향을 주지 않는다는 사실을 발견했습니다. 이는 현대의 LLM이 단 하나의 지시만으로도 스타일과 제약 사항을 추론할 수 있으며, 프롬프트 구조를 획기적으로 줄일 수 있음을 증명합니다.
사업개발국의 IBAS 시스템은 행동 분석, e-KYC 및 기관 간 데이터를 결합하여 고위험 실체를 식별함으로써, 조사관들이 유력 범죄자에 집중할 수 있도록 돕고 유령 회사 활동을 획기적으로 줄여줍니다.
Model Context Protocol(MCP)은 AI 에이전트가 데이터베이스, 모니터링 도구, 코드 저장소 등을 조회할 수 있는 통일된 인터페이스를 도입합니다. 리소스, 도구 및 프롬프트를 선언함으로써 단일 MCP 서버가 수십 개의 맞춤형 어댑터를 대체할 수 있으며, Claude 호환 클라이언트에 즉시 데이터를 제공할 수 있습니다.
Qwen 3.6 vs 3.5: 속도는 같지만 더 뛰어난 에이전트. Qwen 3.6이 3.5보다 느리다는 내용의 글을 거의 올릴 뻔했습니다. 첫 번째 테스트에서는 초당 12토큰이 나왔습니다. 이전 버전은 34...
사기꾼들은 온라인 게시물에서 피해자의 목소리를 단 몇 초간 수집한 뒤, 제로샷 합성 모델을 이용해 신부의 가족을 사칭했습니다. 이들은 사기가 발각되기 전 피해자를 속여 118만 루피를 송금하게 만들었습니다.
Claude Fable 5.1 벤치마크: 모든 수치 비교. Anthropic은 2026년 9월 1일에 Claude Fable 5.1을 출시했습니다. 수치상으로 특정 분야에서 엄청난 도약을 보여줍니다. 헤드라인은 Term...
Anthropic의 Fable 5.1은 캐시 읽기 비용을 75% 인하하여 전체 에이전트 운영 비용을 최대 45%까지 절감합니다. 이번 비용 인하로 자율 모델이 인간의 지속적인 감독 없이도 몇 시간 또는 며칠 동안 구동될 수 있게 되어, 새로운 프로덕션 활용 사례가 열릴 것으로 기대됩니다.
2026년 7월 사양은 MCP의 와이어 포맷에서 모든 형태의 세션 상태를 제거하여 모든 컨텍스트를 모델의 토큰 윈도우로 이동시킵니다. 이를 통해 어떤 서버든 모든 요청을 처리할 수 있게 되지만, 토큰 오버헤드 증가와 작업 재개 기능 상실이라는 대가를 치르게 됩니다.
이 오픈 소스 제품군은 버전 관리된 컨트랙트, 벤치마크 데이터, 재사용 가능한 셰이더 템플릿을 포함하고 있어, 앱이 네트워크 연결 없이도 추론을 수행할 수 있게 해줍니다. 사용자는 속도 향상과 데이터 주권을 확보할 수 있지만, 로컬 실행의 용이성은 새로운 멀웨어 보안 우려를 불러일으키기도 합니다.
이 업그레이드는 OpenRouter의 무료 모델에만 적용되며, 유료 모델은 여전히 토큰당 비용이 발생합니다. '평생 사용 규칙'에 따라 구매한 크레딧을 모두 소진하더라도 1,000회 요청 한도는 만료되지 않습니다.
SWE Prime: '통과(Pass)' 레이블은 형편없는 필터입니다. 대부분의 개발자는 데이터가 많아질수록 에이전트가 더 똑똑해진다고 생각합니다. 에이전트가 테스트를 통과하면 세션을 기록하고 이를 학습 세트에 추가하곤 하죠...
이 파일럿 프로그램은 Google Cloud의 Confidential Space 내에서 Gemini Flash Lite를 실행하며, 테스트 프롬프트와 모델 가중치를 모두 암호화된 박스에 봉인함으로써 모델이 질문을 전혀 보지 못했다는 증명을 생성합니다.
Beatport는 주로 AI로 생성된 업로드물을 자동으로 거부할 예정이지만, AI를 도구로 사용하고 이를 명확히 표시한 트랙은 허용할 방침입니다. 이번 결정은 사용자의 77%가 사람이 만든 음악을 선호한다는 설문 조사 결과에 따른 것입니다.
한 오피니언 기사에서 AI를 "논증을 위한 계산기"로 사용했다고 인정한 이후, 월스트리트저널(WSJ)은 오피니언 기사 내 AI 도구 사용 공개 요구를 중단했습니다. 이번 조치로 인해 편집 플랫폼 개발자들은 설정 가능한 정책, 역할 기반 권한, AI 기능 태깅, 그리고 감사 가능한 인간의 승인 절차를 추가해야 하는 상황에 놓였습니다.
2026년 8월 26일에 출시된 Claudeforce 파일럿은 37개의 사전 구축된 영업 기술을 탑재하여, 사용자가 Claude의 채팅창에서 바로 회의 일정을 잡고 파이프라인을 업데이트하는 등의 작업을 수행할 수 있게 합니다. 9월에는 더 광범위한 프리뷰가 제공될 예정입니다.
이 벤치마크는 27개의 합성 케이스를 실행하여 합격/불합격 여부를 기록함으로써 이슈 커버리지에 대한 빠른 검증을 제공하지만, 실행 시간, 컴퓨팅 비용, 언어의 다양성 및 실제 저장소 검증은 포함하지 않으므로 이 점수가 실제 운영 환경에서의 성능을 보장하지는 않습니다.
기업용 영업직을 잠시 거친 후 OpenAI를 떠난 배렛 조프가 구글의 연구 부사장으로 합류합니다. 그는 자신의 강화 학습 전문성을 활용해 제미나이의 정렬, 추론 및 안전성을 강화함으로써 OpenAI의 GPT 시리즈와의 격차를 줄이기 위한 직접적인 시도를 이어갈 예정입니다.
라이브 데모에서 구글 랩스의 편집 이사 스티븐 존슨은 마이클 폴란의 저서 *Food Rules*를 제미나이 노트북에 입력해 식료품 목록이 포함된 일주일 치 식단을 만들어냈으며, 킴 스콧의 *Radical Candor*를 활용해 단계별 성과 검토 스크립트를 생성하기도 했습니다. 이 모든 과정은 앱을 벗어나지 않고도 가능했습니다.
The flaw (CVE-2026-35603) lets a non-admin drop a malicious config file in C:\ProgramData, which Claude Code, Cursor, Codex CLI and Gemini CLI read on launch, executing the payload with full admin rights and giving attackers silent control.
새로운 GA 흐름은 바이너리 업그레이드와 데이터 형식 마이그레이션을 분리하여, 상태 메트릭을 모니터링하고 최종 데이터 변환 전까지 롤백이 가능한 설정 가능한 소크(soak) 기간을 제공합니다.