GLM 5.3 登陆 Amazon Bedrock
GLM 5.3 已上线 Amazon Bedrock,该模型为 Z.ai(智谱 AI)推出的 753B 参数混合专家模型,针对编码与长时智能体任务优化,并展现出突出网络安全能力。用户可通过完全托管的 API 调用,支持跨区域推理、提示词缓存与服务层级,无需管理基础设施。Z.ai 称其在 CyberGym 基准上取得 84.5 分,编码能力较 GLM 5.2 提升 50%。
GLM 5.3 已上线 Amazon Bedrock,该模型为 Z.ai(智谱 AI)推出的 753B 参数混合专家模型,针对编码与长时智能体任务优化,并展现出突出网络安全能力。用户可通过完全托管的 API 调用,支持跨区域推理、提示词缓存与服务层级,无需管理基础设施。Z.ai 称其在 CyberGym 基准上取得 84.5 分,编码能力较 GLM 5.2 提升 50%。
Amazon SageMaker AI 推出 aws-ai-ml 技能,可通过 Agent Toolkit for AWS 安装,让 Kiro、Claude Code、Codex 等编码智能体具备推理优化与基准测试能力,自动生成可执行的 SageMaker Python SDK v3 代码。
Claude Opus 5.5 和 Claude Sonnet 5.5 在 AWS GovCloud(US)区域上线,支持 ITAR 等合规工作负载的 AI 辅助开发。
Amazon Bedrock AgentCore Evaluations 作为托管能力,可评估多智能体系统在准确性、任务成功率和行为等多维度的表现,并支持内置与自定义评估器。
AWS 发布 Quick Resource Migrator,一个基于 Amazon Bedrock AgentCore 的 MCP 服务器示例,可在单个工具调用中自动化 Amazon Quick 资源(代理、连接器、知识库、流和空间)从开发账户到生产账户的跨账户提升。
OpenAI 在 ChatGPT 中推出新的视觉广告格式,并同步扩展广告测量工具、归因合作伙伴关系及品牌适用性功能,为广告主提供更完整的投放与效果评估方案。
OpenAI 发布 GPT-6 家族模型选用指南,面向初创企业讲解如何按需选择 GPT-6 系列模型、调节推理强度、优化提示词与技能、协调工具调用,并为生产环境准备 AI 工作流。指南覆盖从模型选型到部署落地的完整路径,帮助开发团队在真实业务场景中更高效地使用 GPT-6。
Amazon Bedrock AgentCore 推出 AgentCore Gateway,可将 Claude Desktop 接入其 Web Search 能力,弥补模型训练知识截止带来的信息缺口。
AWS 提出 Adjudicated Query 设计模式,让业务人员通过 Amazon Quick 聊天界面提出合规问题,而通过/不通过的判定由确定性规则引擎完成,模型仅负责翻译问题与叙述结果,不参与最终裁决。
NVIDIA 将于 10 月 23 日通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等合作伙伴推出 64GB 统一内存版 DGX Spark,起售价 $4,999。
GPT-6 Astra Ultrafast 已上线 OpenAI API,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU 上。
AWS 在 Amazon Bedrock AgentCore 上提出四智能体模式,将云迁移中基础设施即代码(IaC)开发时间从每应用 3-4 周缩短至分钟级。该模式与 AWS Transform 及 AWS DMS 协同,通过 MCP 工具连接内部系统,覆盖迁移与运维两大流程,适用于 300+ 应用的大型迁移项目。
Amazon Quick 推出 Live Data in Apps 功能,使 AI 构建的 Quick Apps 能实时查询受管 QuickSight 数据集,取代发布时冻结的静态快照。应用每次打开都会重新执行 SQL,查询以查看者身份运行,并自动沿用行级与列级安全规则。支持 SPICE 和 Direct Query 数据集,查看者需为已认证 Quick 用户,且首次使用需按数据集同意。
Amazon Bedrock AgentCore 提供构建环境智能体的平台,其 Runtime 支持容器化代理托管、长时运行工作负载和会话隔离。环境智能体监听事件流(如 S3 文件上传)而非等待用户提示,通过单个 ask_human 工具暂停等待人工审批后继续执行。
台湾统一企业集团旗下数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并辅以提示词级输出优化,使其适配涵盖九类行为与三类主体的零售内容审核策略。
xAI 的 Grok 4.7 现已上线 Amazon Bedrock,支持 500K token 上下文窗口,并提供低、中、高、超高四档可配置推理强度。该模型通过跨区域推理配置提供服务,兼容 Responses、Chat Completions 和 Converse API。据 xAI 称,Grok 4.7 是其最强的编码与知识工作模型,在困难任务上能更持久地工作并更仔细地自我验证输出。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,在保留蛋白质生物功能的同时嵌入不可见签名,并可在物理蛋白质上验证。实验显示,水印设计在结合亲和力、命中率和序列多样性上与未水印版本相当,首次实现了带水印且功能正常的蛋白质结合剂。
推荐理由:原文给出了水印技术的原理、实验验证和开放计划,读者可以据此判断它在生物安全与科研诚信中的实际作用。
CoreWeave 在 Fully Connected 大会上宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网可用,Cognition 成为首个在 Vera Rubin 上运行生产负载的客户,其 SWE-2 推理工作负载的 token 总吞吐量较 GB200 NVL72 提升最高 4.8 倍。
Amazon Bedrock AgentCore 新增 Runtime Instances 计算选项,支持最长 14 天的多智能体会话、GPU 访问与持久存储,区别于 MicroVM 的 8 小时上限。
Amazon Bedrock 宣布 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 在印度可用,通过地理跨区域推理在印度区域(仅限 ap-south-1 和 ap-south-2 之间)处理数据,满足本地数据处理要求。
Amazon Bedrock 现已在首尔和新加坡区域支持区域内推理,提供 Claude Opus 5 和 Claude Sonnet 5 模型,满足金融、医疗和公共部门的数据本地化需求。
GPT-6.1 Sol 现已在 Amazon Bedrock 上正式可用,为编码、计算机使用和专业工作负载带来更强的推理能力。据 OpenAI 称,GPT-6.1 Sol 在 DeepSWE v1.1 上以约五分之一的任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
AWS 发布基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台参考架构。该平台用 AI 智能体从合同 PDF 中提取八类关键字段,并由独立验证智能体复核,签名分歧由 Amazon Textract 以计算机视觉裁决,结果存入 Amazon Aurora PostgreSQL。
Claude Sonnet 5.5 已在 Amazon Bedrock 和 Claude Platform on AWS 上正式可用,面向聚焦编码与知识工作,以更快速度实现大多数任务更低的单任务成本。
AWS 提出用 Amazon Nova Act 与 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,替代 Selenium、Playwright 等依赖 DOM 选择器的脆弱脚本。
AWS 提出一种结合 Amazon EKS、EFA 与 DeepEP 的架构,用于加速 MoE 模型的大规模强化学习后训练,吞吐量提升 40%。该方案通过 DeepEP 优化 EFA 上的专家并行通信,并协调 rollout 生成与策略训练的异构算力需求,应对 RLHF 与 GRPO 训练中的通信瓶颈。
AWS 在 SageMaker HyperPod 上演示了如何用开源强化学习框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型。通过 GRPO 算法,模型在 64 个迷宫测试集上的解决率从 43.75% 提升至 95% 以上。该方案利用 HyperPod 的集群弹性、Ray 集成和 Amazon Managed Grafana 监控,支持多节点长时间训练。
Qwen3-TTS-12Hz-1.7B-Base 现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点,实现基于数秒参考音频的语音克隆,无需重新训练模型。该模型支持 10 种语言及跨语言克隆,输出 24 kHz 音频,适用于教育、媒体等场景,并支持流式生成。部署后数据保留在 AWS 环境中,可通过 CloudWatch 监控端点规模。
Google 宣布为 Private AI Compute 平台新增私有服务器端记忆层,实现跨设备持久AI记忆。该方案通过硬件安全飞地、加密通道和设备派生密钥,确保数据在云端处理时仍保持设备级隐私,即使 Google 也无法访问。同时发布防篡改软件记录及独立网络安全审计结果,邀请社区验证其保护机制。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持通过自然语言提示从零创建角色声音,并可在 Google AI Studio、Gemini API 等平台使用。
NVIDIA 推出 DSX Ready 认证计划,面向符合 NVIDIA DSX AI 工厂参考设计要求的合作伙伴产品与解决方案,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
ABI Research 预测到 2035 年将有 4900 万辆 L3-L5 自动驾驶汽车,Omdia 估计 2026 至 2035 年间将部署约 6000 万台工业机器人。
OpenAI Academy 推出面向员工、开发者、领导者、教育工作者和学生的全新学习路径,帮助各群体构建并展示实用 AI 技能。新路径覆盖从基础到进阶的实践内容,支持学习者通过动手项目验证能力,并面向不同角色提供针对性课程设计。
在 Salesforce Dreamforce 大会上,NVIDIA CEO 黄仁勋与 Salesforce CEO Marc Benioff 共同宣布 Salesforce 首个 CRM 推理模型 Koa 发布。
推荐理由:原文给出了 Salesforce 首个 CRM 推理模型 Koa 的技术底座、训练方式与落地时间表,读者可据此判断企业级 AI 应用的新进展。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款语音模型,前者面向规模化与成本效率,后者面向高复杂度任务。
推荐理由:原文给出了两款新模型的定位差异、评测成绩和开放入口,读者可以据此判断它们适合哪些语音交互场景。
OpenAI 发布 Agents API,这是一项托管服务,由 Codex harness 驱动,支持编排、长时间运行会话和工具调用,用于构建和部署云端 AI 智能体。该 API 面向开发者,提供开箱即用的基础设施,简化智能体的开发与上线流程。
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款模型。3.8 Flash 在 DeepSWE v1.1 等基准上超越多数更大规模前沿模型,HLE-Verified 得分 54.9%,定价为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元。
微软研究院推出 GigaPath-Flash 与 GigaTIME-Flash,通过知识蒸馏将十亿参数模型压缩至 22M 参数的 ViT-S 骨干,在 PANDA 和 EBRAINS 基准上以约 50 倍更低的算力实现与原版相差 3% 以内的性能。GigaTIME-Flash 在脑、乳腺、结肠和肺癌的内外分布队列中匹配或超越原版预测质量,两者均以 Apache 2.0 协议开源,仅限研究用途。
Google DeepMind 推出全球首个针对专有前沿 AI 模型的双盲评测,将外部评测置于加密环境中,防止模型提前看到测试题导致基准污染。该评测与新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons 合作,使用 Gemini Flash Lite 模型在隐私保护环境中测试机密基准。
Google DeepMind 推出 Gemini 3.5 Transcribe,提供更智能的语音转文字转录能力。该功能基于 Gemini 3.5 模型,旨在提升转录的准确性与智能化水平,适用于教育等场景中的音频内容处理。