
英伟达技术博客给出的一组基准数据:在 4xB200、64K输入、76% KV复用、每用户 50 TPS的agentic负载下,开启NIM 2.0.12优化后系统吞吐从 718 tok/s升到 1997 tok/s,官方称这意味着同等交互性下可服务 2.5 倍以上并发用户。
阅读全文从新功能到新体验,发现 AI 正在怎样进入日常。

英伟达技术博客给出的一组基准数据:在 4xB200、64K输入、76% KV复用、每用户 50 TPS的agentic负载下,开启NIM 2.0.12优化后系统吞吐从 718 tok/s升到 1997 tok/s,官方称这意味着同等交互性下可服务 2.5 倍以上并发用户。
阅读全文J.S. Held《全球风险报告》数据显示,2025年供应链中断给企业造成约1840亿美元损失;FourKites与ABI Research报告称,仅27%的组织允许AI自主行动,52%仍将其限制在决策支持环节。
阅读全文AWS机器学习博客给出逐步教程:把多标签RFI Excel工作簿从Amazon S3读入,用自然语言描述处理逻辑生成工作流,人工对话式修正后输出CSV并跨区域导入导出。
阅读全文英伟达发布博客,介绍其面向Robotaxi的三计算机架构:DGX负责模型训练、Omniverse与Cosmos负责仿真验证、DRIVE Hyperion负责车载计算与传感器融合,并列出Uber、Wayve、Pony.ai、特斯拉等采用方。

AWS Machine Learning博客介绍Agent Evaluation Metric(AEM),将智能体正确性拆分为真实性与完整性两个子指标,逐轮评估并区分根因失败与级联失败。

AvioBook在AWS上用一周时间搭出多智能体概念验证:把AvioBook Connect里每架航班的聊天记录和事件日志,变成航空公司经理和签派员能用自然语言提问并拿到证据的答案,还能顺带检查延误代码填得对不对。

该平台允许用户基于环球音乐授权曲库制作混音、串烧和改编版本,艺术家可自行决定是否参与,并将与ElevenLabs现有音乐工具保持独立。

Arena.ai对数万条高推理Text Arena输出分析显示,Fable 5.1相比Fable 5少用破折号、认同式开头和"honestly""frankly"等措辞,但答案更长;中位回答 414 词,比Fable 5的 319 词多 30%,仍比Opus 5的 525 词少 21%。
The Verge记者上手体验Meta首款生产力AI代理Muse:它在云端虚拟电脑上执行任务,能清理数千封促销邮件、按尺码颜色买运动背心,但从Instagram API读出的兴趣清单比用户自己在设置里能看到的更细,令体验者感到不安。

英伟达技术博客介绍BioIR的端到端结构预测流程,支持串行与Ray两种执行后端;在 8 张H100上的 1000 个人类二聚体基准中,其残基归一化折叠吞吐量为开源实现的 2.90 倍,开源版有 29 个目标因显存不足失败。

研究者Chris Schmitz在 11 个司法辖区追踪到 84 起“agentic flooding”案例,投诉和申请量多在 2022 年后加速上升,且尚未放缓。

在9月的Decoder听众来信特辑中,主持人Nilay Patel回应了听众对“软件大脑”与“人们并不渴望自动化”的批评,重申AI的可验证性在软件之外会迅速失效,并解释为什么自然语言无法成为通用界面。

d-Matrix宣布将用NVLink Fusion把下一代Raptor XPU连接到NVIDIA的AI基础设施平台,包括NVLink scale-up、Spectrum-X scale-out网络和MGX机架架构。

Muse运行在独立云端虚拟机中,可代用户预订行程、购物、发电邮并议价;支付经Stripe的Link完成,操作前需用户批准,另设Sentinel代理审查联网行为。

首个部署目标是英伟达自身供应链,覆盖数百万零部件、数千供应商,单个Vera Rubin机架含130万个组件。
Cursor发布Projects测试版,通过协调器代理管理跨云和本地的子代理,维持数月上下文,支持无提示触发。官方称新用户合并PR数增加 30%,主要使用Projects的用户合并量达 6 倍。

这是ElevenLabs与大型唱片公司的首份协议,涵盖授权与产品开发;首个产品是一个基于授权音乐、需艺人参与的全新粉丝共创平台,与ElevenLabs现有音乐产品分开提供。
京东在JDDiscovery 2026上发布物理AI加速计划,重申五年采购300万台机器人、100万辆无人车和10万架配送无人机的目标;京东物流同时发布工业级狼族机器人系列,并披露Meta Brain 3.0、十万卡GPU集群计划等细节。

大晓机器人联合南洋理工大学S-Lab、上海人工智能实验室发布人–场景交互重建框架HSImul3R,团队称其为首个面向非标定稀疏视角输入、实现稳定可仿真重建的框架。在HSIBench三档任务中,其交互稳定率为53.68%、30.56%、13.92%,人–场景三维穿模率从HSfM的69.51%降至22.90%。
新模型最高仍为3840px,新增xhigh和max质量档位;OpenAI同时推出GPT-Image-2.5 Flare与Sunburst两个API模型,文本输入5美元/百万tokens、图像输出30美元/百万tokens。
双方称将把跨国达人合作从人工搜索、邮件和表格推进,转为由AI智能体承接匹配、议价、交付跟踪与跨境结算的业务流程。
Credit Genie的AI与ML工程团队把LangChain开源仓库文档代理OpenWiki接入开发流程,文档存放在各仓库的openwiki/文件夹,每天夜间检查提交差异并自动提交PR,再由自动批准合并任务消除人工瓶颈。团队称早期收益包括跨仓库上下文获取更快、减少“部落知识”,并让编码代理在改代码前先读openwiki/文件夹。

Workflow1111把stable-diffusion-webui的大部分功能重建为一张工作流画布,每个输出节点自动变成REST端点,同时也能作为MCP工具供AI助手调用。
Meshy称 7.1 是目前唯一达到 4096³ 几何分辨率的 3D生成模型;自研Detail Richness基准显示其在 1K、2K、4K渲染分辨率下均排名第一,该版本自 2026 年 9 月 10 日起逐步推送。
该工具支持通过CORS可访问的文件链接或GitHub仓库链接,在浏览器中渲染Blender 5.x文件的网格几何体,并带材质、光照和可选的已保存相机位置。

Qwen3.8-2.4T-A95B是首个开放权重的Qwen-Max级模型,总参数2.4万亿、每token激活950亿。AWS官方博客详细演示如何在8卡B300实例上以NVFP4量化、约1.2TB权重完成部署。

州长莫拉·希利的行政令要求大型数据中心自行提供清洁电力,否则须资助附近新建发电设施或向电费保护基金缴费;该州同时暂停上月生效的数据中心销售税豁免申请。

苹果声称Audio Intelligence的原始音频仅在S11芯片的Secure Exclave中处理,不保存为文件,苹果、操作系统和应用均无法访问。

在9月9日的“Surprise and Shine”发布会上,苹果推出Apple Watch新AI功能,可实时转录语音并生成对话摘要,引发关于持续监听与隐私的讨论。

苹果在秋季发布会上推出首款折叠屏手机iPhone Duo、iPhone 18 Pro系列、Apple Watch Series 12/Ultra 4及AirPods 5,并更新健康应用。
