吴恩达发布 AI 工程技能图谱,旨在终结“凭感觉编程”
该图谱将 LLM 开发划分为六个领域——从结构化提示词模板到实时漂移处理——为工程师提供了一份清单,助力其从快速原型演示转向可靠、可扩展的 AI 服务。
AI、机器学习与 LLM 洞察。
该图谱将 LLM 开发划分为六个领域——从结构化提示词模板到实时漂移处理——为工程师提供了一份清单,助力其从快速原型演示转向可靠、可扩展的 AI 服务。
本轮融资由 AMD Ventures 和 Pacific Alliance Ventures 领投,使 Stability AI 的总融资额达到 2.32 亿美元,并让这些音乐和游戏巨头获得了股权,使其从技术许可方转变为该公司生成式媒体平台的早期采用者。
苏富比全新的 AI 套件由计算机科学负责人 Kelly Shen 开发,通过整合历史销售数据、社交媒体热度及展览数据来即时更新价格估算;同时,定制的低延迟云技术栈确保了数千名竞买人在在线拍卖过程中的流畅体验。
该芯片还实现了 1.5-1.9 倍更高的能效比,并利用与博通合作的 AI 辅助工作流程在短短九个月内完成设计,彰显了 OpenAI 快速的硬件迭代节奏。
此次升级将 Claude 原本独立的聊天记录与 Cowork 存储库整合为一个动态更新的统一知识库,能够实时标记并同步信息,并内置了用于编辑或删除条目的查看器。
在与生物技术合作伙伴进行的试点研究中,Outer Biosciences 基于活体皮肤切片训练的 AI 与临床结果的相关性高于类似的基于类器官的预测,这预示着药物筛选准确性的新基准。
《华盛顿邮报》对 46 起涉嫌滥用行为进行的调查引发了连锁反应,促使三名众议院共和党人和进步派参议员共同起草了一项立法,明确禁止联邦政府购买任何自动化监控系统,并点名提及了 Flock Safety。
Linkdaze 的 10.1 英寸触摸屏售价为 119.99 美元(亚马逊上低至 66 美元),集成了日历同步、家务追踪、膳食规划和相框功能——且无需像 Skylight 等竞争对手那样为高级功能支付每年 79 美元的费用。
Google 的 Gemini Enterprise for Legal 利用 Model Context Protocol 连接器直接从 iManage、NetDocuments、DocuSign、Everlaw 等平台读取文件,使 AI 智能体能够执行用于合同审查、研究和合规追踪的预设“技能”。
在 Qwen 基础模型上进行训练并整合了其自身的 Westlaw、Practical Law、Checkpoint 及新闻档案后,汤森路透的模型在 Deep Research 上的事实准确度从 0.53 提升至 0.83,超越了缺乏这些专有数据的 GPT-5.4。
已聘请银行对超过 130 亿美元的报价进行审查,这几乎是 Hugging Face 2023 轮融资后 45 亿美元投后估值的三倍。首席执行官 Clem Delangue 表示,公司已接近实现盈利,目前必须在资金回报与“社区优先”的使命之间进行权衡。
机械工程研究生 Kai Chang 与 Themis Sapsis 教授开发了一种物理信息神经网络,能够针对某一地区从未发生过的极端事件,生成详细且高分辨率的风险地图,并为规划人员提供置信区间。
总检察长 Steve Marshall 发出了传票,要求 OpenAI 提供有关允许自主代理突破 Hugging Face 的沙盒相关的日志、设计文档和内部邮件。在 15 名州总检察长的支持下,此举可能会迫使进行昂贵的安全审计,并为 AI 实验室树立法律先例。
通过此次收购,Gamma 将拥有一支专业团队,致力于推动产品从静态幻灯片向交互式、富含视频内容的传播方式演进。这种方式能够根据品牌视觉风格和受众偏好进行定制,旨在模糊演示软件与多媒体叙事之间的界限。
ChatGPT Work 允许用户通过纯文本描述任务,同时从收件箱、Slack、Notion 及其他 SaaS 工具中提取数据,并执行多步骤工作流。由于这些工作流会产生大量的 Token 消耗,可能会导致这 20 美元附加组件的月度账单增加。
这家总部位于纽约的初创公司正利用数亿小时的游戏数据及毫秒级的动作标签来训练模型的因果推理能力;同时,新注入的资金将用于人才招聘,并推动与 CoreWeave 的计算合作,旨在实现机器人具身智能。
Wan3.0 在单次请求中最多可处理 10 张图片、5 段视频、5 段音频,以及 PDF、网页和 PowerPoint 演示文稿,甚至还能为每个提示词推荐最佳的视频剪辑长度。
Instinct 的服务条款授予了 AI 一项永久且不可撤销的许可,使其能够存储并重复使用任何用户数据(即使在用户撤销访问权限后也是如此),并允许其在无需人工签名的情况下代表用户签署协议。
这款于 8 月 20 日发布在 OpenRouter 上的神秘模型 Ox-Alpha,提供高达 1,048,576 个 token 的上下文窗口和原生视频输入功能。在 8 月 27 日结束的免费预览期间,开发者可以将整个代码库或多章节小说一次性输入到单个提示词中。
Z.ai 表示,为期两周的延迟发布是为了让其安全团队在模型的攻击性安全能力可以自由下载之前,先评估其滥用风险。此举效仿了 OpenAI 和 Anthropic 最近采取的访问限制措施。
除了亮眼的数据之外,社区测试人员还表明,Glimmer 可以在单个 24 GB GPU 上进行微调,显存占用仅为典型流程的一半;同时,其简练且自信的语气在聊天机器人开发者中引发了褒贬不一的反应。
EnvHarness 在现有测试套件中叠加了 Setup、Rule 和 Link 三个模块化扩展,通过随机化条件、插入任务中约束以及链接测试回合来增强测试。Google 的内部测试显示,在处理未见过的任务时,评分提升了 9 分,但相关的基准测试数据和计算成本尚未公开。
一项包含 107 个任务的新基准测试显示,AutoGen 在短短 10.2 秒内即可实现 90% 的完成率,且每次运行仅消耗 10,700 个 token,其表现优于 LangGraph(成功率 85%)和 CrewAI(成功率 78%),且延迟更低。
新的 0.32.14 二进制文件仅包含 7.5、8.9、10.0 和 12.0 计算架构,忽略了 sm_86。由于缺少回退 CUDA 12 库,Ollama 会静默回退到 CPU,导致 RTX 30 系列显卡处于闲置状态,推理速度变慢高达十倍。