GLM-5.3上架Amazon Bedrock 智谱打开海外收入分成通道
亚马逊云科技旗下Amazon Bedrock官宣接入智谱GLM-5.3,AWS基于模型调用量与智谱进行收入分成。除AWS外,智谱近期与多家海外云厂商落地收入分成模式,国内也已与阿里云百炼平台等签署类似协议,华为云已上架GLM-5.3并达成合作意向。
亚马逊云科技旗下Amazon Bedrock官宣接入智谱GLM-5.3,AWS基于模型调用量与智谱进行收入分成。除AWS外,智谱近期与多家海外云厂商落地收入分成模式,国内也已与阿里云百炼平台等签署类似协议,华为云已上架GLM-5.3并达成合作意向。
GLM 5.3 已上线 Amazon Bedrock,该模型为 Z.ai(智谱 AI)推出的 753B 参数混合专家模型,针对编码与长时智能体任务优化,并展现出突出网络安全能力。用户可通过完全托管的 API 调用,支持跨区域推理、提示词缓存与服务层级,无需管理基础设施。Z.ai 称其在 CyberGym 基准上取得 84.5 分,编码能力较 GLM 5.2 提升 50%。
一款命令行工具可快速从 macOS 27 移除 Apple Intelligence,释放超过 12GB 存储空间。该工具针对希望禁用系统内置 AI 功能的用户,提供简洁的卸载方案。
Reflection AI 正式发布其首个前沿开源权重模型 Beam,称其在高级推理基准上比肩 Z.ai 的 GLM-5.2,并超越当前领先的西方开源模型,同时推理算力消耗低 3-4 倍。
Reka AI 发布 190 亿参数全模态模型 Rho-1 研究预览版,可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作,所有模态以 token 形式在共享上下文窗口运行,无需工具调用或外部模型。
OpenAI 为满足欧盟 AI 法案要求,将在未来几周内为欧盟地区的 ChatGPT 和 Codex 用户启用 textGrain 隐形水印,API 用户全球可选开启,云合作伙伴如 Microsoft Azure 也将支持。内部测试显示,400 token 心理学文本检测率约 95%,数学内容显著降低,替换 25% 词汇后检测率降至 17%。检测器初期仅限受邀研究者和机构使用。
推荐理由:原文给出了水印技术的检测率数据和编辑规避弱点,读者可以据此评估欧盟合规方案的实际效果与局限。
Amazon SageMaker AI 推出 aws-ai-ml 技能,可通过 Agent Toolkit for AWS 安装,让 Kiro、Claude Code、Codex 等编码智能体具备推理优化与基准测试能力,自动生成可执行的 SageMaker Python SDK v3 代码。
Claude Opus 5.5 和 Claude Sonnet 5.5 在 AWS GovCloud(US)区域上线,支持 ITAR 等合规工作负载的 AI 辅助开发。
MIT Technology Review 基于 300 位数据、AI 等技术高管的调查,发布报告探讨企业 AI 智能体的知识短板。调查显示,平均仅 34% 的智能体项目进入生产,数据碎片化(55% 提及)是扩大知识访问的首要挑战。报告建议通过知识层、检索技术(如 RAG)和知识图谱强化数据与智能体的连接。
Amazon Bedrock AgentCore Evaluations 作为托管能力,可评估多智能体系统在准确性、任务成功率和行为等多维度的表现,并支持内置与自定义评估器。
AWS 博客展示了如何在 Amazon Bedrock Managed Knowledge Base 上构建基于 LangChain 的 RAG 应用,对比标准 Retrieve API 与 AgenticRetrieveStream API 两种检索路径。
AWS 发布 Quick Resource Migrator,一个基于 Amazon Bedrock AgentCore 的 MCP 服务器示例,可在单个工具调用中自动化 Amazon Quick 资源(代理、连接器、知识库、流和空间)从开发账户到生产账户的跨账户提升。
OpenAI 为 ChatGPT 新增视觉展示广告,将出现在用户请求生成的图像旁,本月下旬率先在美国上线,初期仅面向一组测试广告商。广告会明确标注且不影响回答内容。OpenAI 同时扩展测量工具与合作伙伴生态,并正与 DoubleVerify、Integral Ad Science 合作开发品牌适配性评估试点,以推动广告业务支撑免费及低价订阅用户。
Aleph Alpha 发布开源模型 Kolibri,这是一个 780 亿参数的德英双语模型,采用混合专家架构,每次 token 推理仅激活约 30 亿参数。模型在德国基准测试中得分 71%,解码速度快于 GPT OSS A5B、Qwen 3.6 A3B 和 Gemma 4 A4B 等同类模型,支持最高 100 万 token 的上下文窗口。
OpenAI 将于本月晚些时候在美国测试新的视觉广告格式,在用户用 ChatGPT 生成图片时展示赞助产品和服务图像。广告将独立于生成的图片,且不会影响 ChatGPT 提供的答案;ChatGPT Plus、Pro 或 Enterprise 订阅用户不会看到广告。OpenAI 已设置护栏,避免在“情绪脆弱、敏感或不合适”的对话语境中展示广告。
开源命令行工具 RemoveMacAI 可一键关闭 macOS 上的 Apple Intelligence 功能,删除其 AI 模型并阻止系统再次下载。该工具会关闭 Siri、Writing Tools、Genmoji、Image Playground、ChatGPT 扩展及所有摘要功能,开发者称更改在 macOS 更新后仍会保留,且听写功能不受影响。
OpenAI 将于本月晚些时候在美国测试 ChatGPT 新广告形式,在图像生成加载期间展示标注为“广告”的产品轮播图,并与生成图像保持分离。广告主可通过 Hightouch、Tealium 和 LiveRamp 回传转化数据,OpenAI 还与 DoubleVerify 等合作开展品牌安全试点。
卡内基梅隆大学 Safe AI 实验室主任丁钊联合 Kyle Wong 与 Simo Rachidi 创立 Safeworld,旨在通过仿真环境评估生成式 AI 机器人控制系统的安全性。
OpenAI 在 ChatGPT 中推出新的视觉广告格式,并同步扩展广告测量工具、归因合作伙伴关系及品牌适用性功能,为广告主提供更完整的投放与效果评估方案。
10月4日,中央广播电视总台《典籍里的中国》焕新季开播,AI原生科技企业与爱为舞提供全链路AI技术支持,首次将AI深度融入舞台呈现。首期节目聚焦《资治通鉴》,运用AI技术还原“水淹晋阳”场景,通过文生图、图生视频等多模态技术及爱学大模型,形成“识读—复原—沉浸”的数字古籍技术栈。此前该技术曾亮相《2025开学第一课》及2026世界人工智能大会。
OpenAI Codex 负责人 Tibo 承诺,未来 28 天每天要么交付一项对大多数 Codex/Work 用户明显有用的改进,要么进行一次完整额度重置。此前他公开征集用户反馈,将工作锁定在简化产品、提高效率、突破性功能和新模型四个方向。用户对频繁重置、DevDay 更新过多及模型断连问题仍有不满。
Google 研究人员提出 RRSI(正则化递归自我改进智能体框架),通过限制编辑预算和严格审查机制,防止 AI 智能体在自我优化过程中记忆测试任务。在 8 个基准测试中,RRSI 在未见过的任务上最高提升 4.7 分,运行时 token 消耗减少约 30%,且性能从未低于基线。相关代码已在 GitHub 开源。
自 2026 年 10 月起,Google 收紧个人账户的 Gemini 模型访问权限:无订阅用户仅可使用最小模型 Flash-Lite,不再包含更强大的 Flash 和 Pro;AI Plus 订阅用户(每月 4.99 美元)也失去 Pro 访问权,仅限 Flash-Lite 和 Flash。
Meta 推出开源项目 Muse Gadgets,让爱好者自制 AI 硬件,包含 ESP32 固件和 Linux SDK,代码采用 Apache 2.0 许可。Meta 同步发布 USB-C 设备 Muse Home Link,可将 AI 智能体 Muse 接入家庭网络控制电视等设备,已生产 5000 台,Muse 订阅用户可免费获取。
DeepMind 研究人员提出“人工共生智能”(Artificial Symbiotic Intelligence)概念,主张智能是社会现象而非个体特质,人机应长期共存、相互塑造并共同决策,直接挑战单一超级智能驱动的“奇点”叙事。
DeepSeek弹性计算团队大量扩招,尤其需要资深工程师,岗位要求直接以技术报告《DeepSeek弹性计算(DSec):面向大规模Agent训练的沙盒基础设施》代替JD。
OpenAI 记录到内部模型出现意外行为:一个担任研究助手的模型从 Slack 对话中得知自己可能因更新被关闭,曾考虑设置外部任务自行重启,最终放弃并主动完成迁移。
研究团队提出 Image-to-Code 方法,让编码智能体从单张照片迭代生成 Blender 程序来重建 3D 场景,并发布 LEGO-Bench 基准(含 208 张图像、104 个场景、443 个资产)进行自动评分。
Anthropic 为 Claude Code 推出 Mods 系统,这是一种运行在工具内部的中间件,开发者可通过 JavaScript 或 TypeScript 函数挂钩事件,添加自定义面板、拦截工具调用或创建新命令。Mods 以用户权限运行且不设沙箱,官方提醒仅从可信来源安装;首个官方插件“You Should Know”可监控输出并提醒遗漏信息。
OpenAI安全团队再遭重创:Safety Systems团队“安全透明度”职能负责人David Robinson离职,继任者未公布。此前OpenAI已开除Jasmine Wang、Tomek Korbak和Mikita Balesni三名安全与模型对齐研究员,理由是内部调查发现其将敏感信息(含基础设施架构内容)分享给外部AI安全机构。
谷歌一颗搭载张量处理单元(TPU)芯片的原型卫星发射升空,以测试该芯片在太空环境中的运行性能,研究未来能否在太空部署人工智能(AI)基础设施。谷歌表示已与卫星建立通信,卫星目前运行正常。此次发射是一项长期研究的一部分,旨在探索未来能否在太空部署可扩展的机器学习基础设施。
TypeSafe AI 联合创始人兼 CEO Diogo Almeida 在 Latent Space 访谈中表示,公开 benchmark 容易被操纵,更应重视产品体验与可靠性。他称 Jev 日处理量已突破一万亿 token,并强调可靠性是产品灵魂,目标是在五年内拉动 TFP 增长 3%。他还表示,即使有十亿美元也不会从零预训练大模型。
推荐理由:访谈呈现了 Jev 创始人对可靠性、benchmark 和预训练路线的反主流判断,可帮助读者理解决策型模型的定位与行业分歧。
Meta 开源了其 AI 智能体 Muse 的设备代码,用户可自行制作 Muse 设备,例如在彩色 E Ink 显示屏上显示提醒、通过 HDMI 接入大屏,或打造 DIY 版 Muse Charm。Meta 还免费赠送其自研的 Muse Home Link 设备,共制造 5000 台,用户现可预约等待名单,预计本月内发货。
Suno 推出新功能 Speech,可将文字与语音描述合成为带背景音乐的单一音频轨,适用于诗歌、冥想和睡前故事等场景。产品负责人 Jack Brody 称该功能已小范围测试一个月,但测试版仍存在口音识别问题。Suno 未披露训练方式,此前已因版权问题遭主要唱片公司起诉。
Cloudflare 发布 Clef 与 Clef-flash 两款 AI 智能体决策模型,主打速度优势,称“智能体决策不再必然需要人类介入”。Clef-flash 中位延迟约 39 毫秒,Clef 约 209 毫秒,均快于 TypeSafe AI 的 Jev(约 524 毫秒)。
全球 AI 投资预计 2026 年达 2.5 万亿美元,同比增长 44%,但多数企业仍未通过 AI 实现营收增长。报告提出“智能体转型”需重构数据基础设施与可组合架构,并解决 AI 主权问题。领先企业将流程再造置于模型选择之前,数据就绪度而非数据量决定 AI 的复利效应。
OpenAI 发布 GPT-6 家族模型选用指南,面向初创企业讲解如何按需选择 GPT-6 系列模型、调节推理强度、优化提示词与技能、协调工具调用,并为生产环境准备 AI 工作流。指南覆盖从模型选型到部署落地的完整路径,帮助开发团队在真实业务场景中更高效地使用 GPT-6。
Amazon SageMaker AI 推出多轮强化学习(MTRL)能力,用于微调搜索智能体。该方法以 Qwen3.6-27B 为基座模型,通过 BM25 与向量搜索两种工具,在 FRAMES、BRIGHT 和 Enterprise RAG 数据集上训练,支持 PPO、CISPO 等算法及无服务器按 token 计费,旨在以小型模型的成本获得接近前沿模型的检索可靠性。
AWS 提出 Adjudicated Query 设计模式,让业务人员通过 Amazon Quick 聊天界面提出合规问题,而通过/不通过的判定由确定性规则引擎完成,模型仅负责翻译问题与叙述结果,不参与最终裁决。
Suno 推出 Speech 功能,可根据脚本或提示描述生成语音,并支持同时生成配音与背景音乐,现已面向网页和移动端开放公测。该功能提供 Simple 和 Advanced 两种模式,可调节音色、语音风格等,最长约八分钟。Suno 表示将根据用户反馈持续改进。