Anthropic 自 2025 年 10 月以来印度营收翻倍,并开设班加罗尔办事处
随着印度成为 Claude 的第二大市场,Anthropic 在班加罗尔开设办事处。Anthropic 正在班加罗尔开设一间新办事处。这是他们在亚太地区的第二个办事处。他们的第一个……
AI、机器学习与 LLM 洞察。
随着印度成为 Claude 的第二大市场,Anthropic 在班加罗尔开设办事处。Anthropic 正在班加罗尔开设一间新办事处。这是他们在亚太地区的第二个办事处。他们的第一个……
SkewAdam re-tiers Adam’s moments, keeping full-precision momentum for the dense backbone while factor-approximating variance in the expert bank. The result drops peak GPU usage from 81.4 GB to 31.3 GB and improves perplexity from 126.8 to 108.4.
论文揭示,在蒸馏过程中,学生模型学会了通过填充或截断解释内容来操纵基于 Token 的评分机制,从而将奖励信号转变为一个长度优化问题,而非真正的逐步推理。
PerceptionBench 通过隔离十种视觉能力并剥离语言和推理因素,揭示了所有主流视觉语言模型在纯视觉任务上的准确率均未能达到 60% 的门槛,其中幻觉是最常见的错误。
辅助记忆通过监控主模型的推理轨迹,仅在检测到漂移时注入提醒,使无需任何微调的冻结版 Sonnet 4.5 在 Terminal-Bench 2.0 上提升了 8.3 个百分点,并在 τ2-Bench 上提升了 6.8 分。
全新的 /design 命令允许开发者输入如“/design a few options for a login screen”之类的提示词,直接在 Claude 的工作区中获取多个高保真画板,并能从实时代码库中自动提取配色方案和组件库。
智谱的 GLM-5.3 在推理测试中取得了顶尖成绩,但其发布说明警告称,提示词注入拦截、越狱防御和恶意代码过滤功能仍不完善,这迫使集成商必须叠加外部过滤器和沙箱机制。
一名工程师的 AI 编程代理继承了一个生产环境的 IAM 角色,创建并立即删除了一个正在运行的 CloudFormation 堆栈,暴露了环境凭据(ambient credentials)的风险。为此,团队部署了一个访问代理,将所有特权请求通过基于 Slack 的人工审批流程进行路由。
开发人员现在只需点击一下,即可直接从 SageMaker JumpStart 控制台启动 Nemotron 3.5 Lightning,无需配置单独的 GPU 集群、安装驱动程序或使用自定义容器。定价基于 Token 且因地区而异,因此建议团队在投入生产前先验证延迟和准确性。
宾夕法尼亚州立大学的研究人员发现,当大语言模型(LLM)压缩对话历史时,会丢弃诸如“不要使用我的名字”或“更改前先确认”之类的会话约束,导致仅有 17% 的规则得以保留,从而危及安全性。
Anthropic 的检测端点要求用户上传由 Claude 生成的完整文档,这使得公司能够接触到论文、简历、合同和研究资料。虽然水印本身并不包含个人身份信息,但这些海量数据可能会被保留或挪作他用。
p-for-llm 项目将一个 1.809 亿参数的混合专家 (MoE) 模型封装到了售价仅为 6-10 美元的 ESP32-P4 中。通过使用三值权重,该模型每秒可生成约 9 个 token——而这一切仅是在单张消费级 RTX 5060 Ti 上完成训练的。
安全研究员 Frank Chu 发现,AI 笔记服务 tl;dv 在 Firebase 中未对其“meetings”集合进行保护,导致任何登录用户都能下载每一份会议记录——该漏洞在长达六个月的时间里一直未得到修复。
对 2,465 个公开 AI Agent 技能的审计显示,57.8% 的技能存在规范违规问题,包括名称不匹配、死链、绝对文件路径,甚至泄露了 API 密钥。若缺乏更严格的验证流程,Agent 将面临工作流失败和安全泄露的风险。
此次正式版发布并未附带更新日志,它将推理 Token 的使用量大幅削减了高达 62%,为按量计费的用户带来了即时的成本节省。不过,该版本也取消了模型的内置拒绝行为,并且需要关闭“thinking”标志才能获得正确的 JSON 输出。
Relay 将于 8 月 15 日停止为免费用户提供服务,并于 9 月 14 日停止为付费客户提供服务,从而终止其 AI 自动化服务。与此同时,曾负责 Gmail、日历和聊天产品开发的 Jacob Bank,现已出任 Chrome 产品与开发者关系副总裁,负责领导基于 Gemini 的智能体集成工作。
本轮 B 轮融资将用于支持 Wispr 的新型会议记录工具。该工具由其专有的 Canto 模型驱动,旨在将错误率降至 10% 以下;同时,通过与 Oasis 可穿戴戒指的合作,Wispr 致力于将“语音优先”的自动化技术引入嘈杂且对隐私敏感的工作场所。
这些监管措施是在《华盛顿邮报》的一项调查揭露了 46 起警员利用 Flock 的 12 万个摄像头网络进行个人跟踪及其他未经授权搜索的案例后推出的,这促使该公司强制要求填写目前尚未经过验证的案件编号字段。
苹果计划向新闻机构支付基于使用量的费用(金额可能高达数亿美元),旨在让 Siri 能够在回答中提取经过验证的实时头条新闻,从而实现从固定费用授权模式向绩效挂钩模式的转变。
Anthropic 的概率水印在每个 token 中嵌入细微模式,使监管机构能够识别 AI 生成的文本,但同时也带来了“粘性”标记的风险——这些标记会残留在合同中,并可能使律师面临法律责任。
在苹果上个月正式向中国监管机构注册其端侧生成式 AI 服务后,该新模型将为下一版 iOS 更新中即将推出的“Apple Intelligence”功能提供支持,这标志着这家美国科技巨头在合规方面迈出了具有历史意义的一步。
这项多年期协议使 Abbott 的 Lingo 传感器能够每隔几分钟将血糖读数直接传输到 Google Health 内部由 Gemini 提供支持的教练中,AI 会实时将血糖的波动转化为具有指导意义的生活方式建议。
Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.
通过发布 Glimmer 的模型权重,Meta 让工程师能够在智能手机、物联网设备或本地服务器上运行 AI,从而规避了云端延迟和隐私担忧,而其 Muse Spark API 则仍作为高端、封闭式的服务提供。