World Labs 的 Atlas 在 94% 的人类偏好测试中胜过顶级竞争对手
Atlas 利用空间锚定技术,仅需一张到几十张照片即可将其转化为可导航的 3D 世界,在渲染长达一分钟的 1440p 视频的同时,还能输出点云和高斯泼溅(Gaussian splats),以供下游机器人技术和内容流水线使用。
AI、机器学习与 LLM 洞察。
Atlas 利用空间锚定技术,仅需一张到几十张照片即可将其转化为可导航的 3D 世界,在渲染长达一分钟的 1440p 视频的同时,还能输出点云和高斯泼溅(Gaussian splats),以供下游机器人技术和内容流水线使用。
亚马逊的生成式 AI 引擎现已为 Alexa 购物功能提供支持,通过将发件人信息、隐藏元数据及发送时间与数十亿条合法信息进行交叉比对,为购物者提供对可疑电子邮件和短信的即时验证。
本轮 B 轮融资由 Delta-v Capital 领投,微软旗下的 M12 和摩根士丹利参投,资金将用于扩大销售规模、深化对多模态攻击的研究以及进军 EMEA 市场。与此同时,HiddenLayer 的年度经常性收入 (ARR) 已增长十倍,达到数千万美元规模。
The Israeli-Dutch startup has pivoted from multilingual customer-service bots to a model-agnostic AI operating system, deploying forward-deployed engineers on-site in 35+ countries. Backed by Insight Partners and a new stake from Salesforce, the $550M round will fund product development and global F
Anthropic 发现,移除大部分系统提示词规则并不会损害 Claude Code 的输出质量,这证明了现代大语言模型可以从单一指令中推断出风格和约束条件,且提示词脚手架可以被大幅度精简。
商业发展部的 IBAS 系统结合了行为分析、e-KYC 和跨机构数据,旨在识别高风险实体,从而让调查人员能够集中精力打击可能的违规者,并大幅削减了壳公司的活动。
模型上下文协议 (MCP) 为 AI 智能体引入了一个统一的接口,用于查询数据库、监控工具、代码库等。通过声明资源、工具和提示词,单个 MCP 服务器即可取代数十个定制适配器,并能立即向任何兼容 Claude 的客户端提供数据。
Qwen 3.6 对比 3.5:速度相同,但智能体表现更佳。我差点就发了一篇关于 Qwen 3.6 比 3.5 慢的文章。我的第一次测试显示速度为每秒 12 个 token,而旧版本运行速度为 34...
诈骗者仅从网络帖子中截取了受害者几秒钟的语音,利用零样本合成模型冒充新娘的家属,并诱导其转账 118 万卢比,直到骗局最终被揭穿。
Claude Fable 5.1 基准测试:各项指标全面对比。Anthropic 于 2026 年 9 月 1 日发布了 Claude Fable 5.1。数据表明,其在特定领域实现了巨大飞跃。头条新闻是关于 Term...
Anthropic 的 Fable 5.1 将缓存读取费用降低了 75%,使智能体的整体运营成本降低高达 45%。这一举措让自主模型能够在无需人类持续监督的情况下运行数小时甚至数天,从而开辟了新的生产应用场景。
2026 年 7 月发布的规范从 MCP 的传输格式中剥离了所有形式的会话状态,将所有上下文移入模型的 Token 窗口,使任何服务器都能处理任何请求,但代价是增加了 Token 开销并丧失了可恢复性。
该开源套件包含版本化合约、基准测试数据和可重用的着色器模板,使应用程序无需联网即可进行推理。在提升速度和保障数据主权的同时,本地执行的便捷性也引发了关于恶意软件的新担忧。
此升级仅适用于 OpenRouter 的零成本模型;付费模型仍需按 token 计费。“终身消费规则”意味着即使在您用完购买的额度后,每天 1,000 次请求的额度也永不过期。
SWE Prime:“通过”标签是一个糟糕的过滤器。大多数开发者认为更多的数据会让智能体变得更聪明。如果一个智能体通过了测试,你就会记录该会话并将其添加到训练集中……
该试点项目在 Google Cloud 的 Confidential Space 中运行 Gemini Flash Lite,将测试提示词和模型权重封装在一个加密盒中,并生成证明以确保模型从未见过这些问题。
Beatport 将自动拒绝主要由 AI 生成的上传内容,但如果将 AI 作为工具使用并明确标注,则仍会接受相关曲目。此举是在一项调查之后做出的,调查显示 77% 的用户更倾向于人类创作的音乐。
在一篇评论文章承认将 AI 作为“论证计算器”后,《华尔街日报》停止要求在评论文章中披露 AI 工具的使用情况。此举迫使编辑平台开发人员必须增加可配置策略、基于角色的权限、AI 功能标签以及可审计的人工审核机制。
Claudeforce 试点项目于 2026 年 8 月 26 日推出,内置 37 项预置销售技能,用户只需通过 Claude 的聊天窗口即可安排会议、更新销售管线等——更广泛的预览版计划于 9 月推出。
该基准测试通过运行 27 个合成案例并记录通过/失败情况,为问题覆盖范围提供快速的完整性检查;但由于忽略了耗时、计算成本、语言广度以及真实代码库验证,其得分并不能作为生产环境就绪的保证。
Barrett Zoph 在短暂从事企业销售工作后离开 OpenAI,现加入谷歌担任研究副总裁。他将利用其在强化学习领域的专业知识,加强 Gemini 的对齐、推理和安全性,此举旨在直接缩小与 OpenAI GPT 系列之间的差距。
在一次现场演示中,Google Labs 编辑总监 Steven Johnson 将 Michael Pollan 的《饮食规则》(Food Rules) 输入 Gemini Notebook,并获得了一份包含购物清单的完整一周食谱;而输入 Kim Scott 的《彻底坦诚》(Radical Candor) 则生成了一份分步骤的绩效评估脚本——而这一切都无需离开该应用。
该漏洞 (CVE-2026-35603) 允许非管理员用户在 C:\ProgramData 中放置恶意配置文件,Claude Code、Cursor、Codex CLI 和 Gemini CLI 在启动时会读取该文件,从而以完全管理员权限执行恶意载荷,使攻击者能够实现静默控制。
新的 GA 流程将二进制升级与数据格式迁移分离,提供了一个可配置的观察期。在此期间,系统会持续监控健康指标,且在最终的数据转换完成之前,始终支持回滚操作。