GLM 5.3 登陆 Amazon Bedrock
GLM 5.3 已上线 Amazon Bedrock,该模型为 Z.ai(智谱 AI)推出的 753B 参数混合专家模型,针对编码与长时智能体任务优化,并展现出突出网络安全能力。用户可通过完全托管的 API 调用,支持跨区域推理、提示词缓存与服务层级,无需管理基础设施。Z.ai 称其在 CyberGym 基准上取得 84.5 分,编码能力较 GLM 5.2 提升 50%。
GLM 5.3 已上线 Amazon Bedrock,该模型为 Z.ai(智谱 AI)推出的 753B 参数混合专家模型,针对编码与长时智能体任务优化,并展现出突出网络安全能力。用户可通过完全托管的 API 调用,支持跨区域推理、提示词缓存与服务层级,无需管理基础设施。Z.ai 称其在 CyberGym 基准上取得 84.5 分,编码能力较 GLM 5.2 提升 50%。
Reflection AI 正式发布其首个前沿开源权重模型 Beam,称其在高级推理基准上比肩 Z.ai 的 GLM-5.2,并超越当前领先的西方开源模型,同时推理算力消耗低 3-4 倍。
TikTok 推出 AI 购物助手和全新应用内结账功能,用户可直接在“为你推荐”信息流中一键购买品牌商品。该助手为对话式 AI 智能体,可提供产品详情、尺码、库存等实时购物指导。新功能与 Salesforce、Shopify、Shoplazza、Stripe 等平台合作构建,旨在让用户留在应用内完成购物。
估值达 100 亿美元的 AI 智能体公司 Instinct 宣布将智能体扩展至群聊场景,即使用户好友未注册 Instinct 也可参与。该功能面向早期用户开放,可用于旅行规划、抢票、梦幻体育联赛等场景。创始人 Noah Shinn 表示,个人智能体在连接群聊智能体前会征询用户许可,且群聊智能体与个人账户相互隔离。
OpenAI 宣布在 ChatGPT 和 Codex 中推出文本水印功能,初期仅面向欧盟用户,并计划在未来几周内向所有计划的合格用户开放。API 客户即日起可全球选择启用该功能,研究人员和专家组织也可申请检测器访问权限。
推荐理由:原文给出了文本水印的适用范围、API 开放和检测器限制,读者可以据此判断它对内容溯源与透明度的影响。
OpenAI 为满足欧盟 AI 法案要求,将在未来几周内为欧盟地区的 ChatGPT 和 Codex 用户启用 textGrain 隐形水印,API 用户全球可选开启,云合作伙伴如 Microsoft Azure 也将支持。内部测试显示,400 token 心理学文本检测率约 95%,数学内容显著降低,替换 25% 词汇后检测率降至 17%。检测器初期仅限受邀研究者和机构使用。
推荐理由:原文给出了水印技术的检测率数据和编辑规避弱点,读者可以据此评估欧盟合规方案的实际效果与局限。
两姐妹创立 Hot Girl Hotline,为年轻女性提供基于行为科学的 AI 恋爱与关系建议,采用苏格拉底式提问引导用户自行得出结论,并内置安全机制,在对话出现风险时引导用户联系 988 危机热线。应用不销售或训练用户数据,采用订阅制,每月 9.99 美元,已有数百名活跃用户付费,目前可在 iOS 和网页端使用。
Amazon SageMaker AI 推出 aws-ai-ml 技能,可通过 Agent Toolkit for AWS 安装,让 Kiro、Claude Code、Codex 等编码智能体具备推理优化与基准测试能力,自动生成可执行的 SageMaker Python SDK v3 代码。
Claude Opus 5.5 和 Claude Sonnet 5.5 在 AWS GovCloud(US)区域上线,支持 ITAR 等合规工作负载的 AI 辅助开发。
HackerRank 于周一正式发布 AI 面试官 Chakra,该 AI 智能体在测试期间已执行超过 50 万场面试,Snowflake、Snorkel 和 Capgemini 等公司参与了试用。
推荐理由:原文给出了 Chakra 的开放时间、测试数据和面试流程变化,读者可以据此判断 AI 面试官对招聘评估的实际影响。
Amazon Bedrock AgentCore Evaluations 作为托管能力,可评估多智能体系统在准确性、任务成功率和行为等多维度的表现,并支持内置与自定义评估器。
AWS 发布 Quick Resource Migrator,一个基于 Amazon Bedrock AgentCore 的 MCP 服务器示例,可在单个工具调用中自动化 Amazon Quick 资源(代理、连接器、知识库、流和空间)从开发账户到生产账户的跨账户提升。
OpenAI 为 ChatGPT 新增视觉展示广告,将出现在用户请求生成的图像旁,本月下旬率先在美国上线,初期仅面向一组测试广告商。广告会明确标注且不影响回答内容。OpenAI 同时扩展测量工具与合作伙伴生态,并正与 DoubleVerify、Integral Ad Science 合作开发品牌适配性评估试点,以推动广告业务支撑免费及低价订阅用户。
Aleph Alpha 发布开源模型 Kolibri,这是一个 780 亿参数的德英双语模型,采用混合专家架构,每次 token 推理仅激活约 30 亿参数。模型在德国基准测试中得分 71%,解码速度快于 GPT OSS A5B、Qwen 3.6 A3B 和 Gemma 4 A4B 等同类模型,支持最高 100 万 token 的上下文窗口。
卡内基梅隆大学 Safe AI 实验室主任丁钊联合 Kyle Wong 与 Simo Rachidi 创立 Safeworld,旨在通过仿真环境评估生成式 AI 机器人控制系统的安全性。
OpenAI 在 ChatGPT 中推出新的视觉广告格式,并同步扩展广告测量工具、归因合作伙伴关系及品牌适用性功能,为广告主提供更完整的投放与效果评估方案。
10月4日,中央广播电视总台《典籍里的中国》焕新季开播,AI原生科技企业与爱为舞提供全链路AI技术支持,首次将AI深度融入舞台呈现。首期节目聚焦《资治通鉴》,运用AI技术还原“水淹晋阳”场景,通过文生图、图生视频等多模态技术及爱学大模型,形成“识读—复原—沉浸”的数字古籍技术栈。此前该技术曾亮相《2025开学第一课》及2026世界人工智能大会。
Meta 推出开源项目 Muse Gadgets,让爱好者自制 AI 硬件,包含 ESP32 固件和 Linux SDK,代码采用 Apache 2.0 许可。Meta 同步发布 USB-C 设备 Muse Home Link,可将 AI 智能体 Muse 接入家庭网络控制电视等设备,已生产 5000 台,Muse 订阅用户可免费获取。
TechCrunch 盘点了多款可通过短信或 iMessage 等消息应用交互的 AI 智能体,包括通用助手 Instinct、家庭助手 Fambot、旅行助手 Miso 等。
Anthropic 为 Claude Code 推出 Mods 系统,这是一种运行在工具内部的中间件,开发者可通过 JavaScript 或 TypeScript 函数挂钩事件,添加自定义面板、拦截工具调用或创建新命令。Mods 以用户权限运行且不设沙箱,官方提醒仅从可信来源安装;首个官方插件“You Should Know”可监控输出并提醒遗漏信息。
Meta 开源了其 AI 智能体 Muse 的设备代码,用户可自行制作 Muse 设备,例如在彩色 E Ink 显示屏上显示提醒、通过 HDMI 接入大屏,或打造 DIY 版 Muse Charm。Meta 还免费赠送其自研的 Muse Home Link 设备,共制造 5000 台,用户现可预约等待名单,预计本月内发货。
Suno 推出新功能 Speech,可将文字与语音描述合成为带背景音乐的单一音频轨,适用于诗歌、冥想和睡前故事等场景。产品负责人 Jack Brody 称该功能已小范围测试一个月,但测试版仍存在口音识别问题。Suno 未披露训练方式,此前已因版权问题遭主要唱片公司起诉。
Cloudflare 发布 Clef 与 Clef-flash 两款 AI 智能体决策模型,主打速度优势,称“智能体决策不再必然需要人类介入”。Clef-flash 中位延迟约 39 毫秒,Clef 约 209 毫秒,均快于 TypeSafe AI 的 Jev(约 524 毫秒)。
The Verge 记者实测了 OpenAI 新发布的智能体平台 Dots。与 Meta Muse 等免费竞品不同,Dots 目前仅向最高档位用户开放,包括每月 100 美元的 Pro 账户。
OpenAI 发布 GPT-6 家族模型选用指南,面向初创企业讲解如何按需选择 GPT-6 系列模型、调节推理强度、优化提示词与技能、协调工具调用,并为生产环境准备 AI 工作流。指南覆盖从模型选型到部署落地的完整路径,帮助开发团队在真实业务场景中更高效地使用 GPT-6。
Amazon Bedrock AgentCore 推出 AgentCore Gateway,可将 Claude Desktop 接入其 Web Search 能力,弥补模型训练知识截止带来的信息缺口。
AWS 提出 Adjudicated Query 设计模式,让业务人员通过 Amazon Quick 聊天界面提出合规问题,而通过/不通过的判定由确定性规则引擎完成,模型仅负责翻译问题与叙述结果,不参与最终裁决。
Suno 推出 Speech 功能,可根据脚本或提示描述生成语音,并支持同时生成配音与背景音乐,现已面向网页和移动端开放公测。该功能提供 Simple 和 Advanced 两种模式,可调节音色、语音风格等,最长约八分钟。Suno 表示将根据用户反馈持续改进。
openJiuwen 团队发布 X-Router 自演进模型路由技术,通过动态选择模型降低 Agent 调用成本。
推荐理由:原文给出了实测数据与开源入口,读者可以据此判断智能路由对 Agent 成本与质量的实际影响。
Black Forest Labs 发布 Flux 3 模型家族的图像模型 Flux 3 Image,支持多步编辑且不改变图像其他部分,覆盖文生图、图生图、文本渲染和照片级真实感。用户可用边界框构图、最多引用十张参考图,输出最高 4K 分辨率。API 访问在 10 月 8 日前享五折优惠,商业权重可授权企业自建基础设施运行和微调,开源权重版本预计数周内推出。
GPT-6 Astra Ultrafast 已上线 OpenAI API,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU 上。
AWS 在 Amazon Bedrock AgentCore 上提出四智能体模式,将云迁移中基础设施即代码(IaC)开发时间从每应用 3-4 周缩短至分钟级。该模式与 AWS Transform 及 AWS DMS 协同,通过 MCP 工具连接内部系统,覆盖迁移与运维两大流程,适用于 300+ 应用的大型迁移项目。
Google 今日在兼容 Android 设备的 Gemini Live 中推出 Guided Vision,通过共享摄像头让 AI 实时语音描述画面,帮助阅读小字、识别物体与描述环境。该功能面向盲人、低视力用户及特定场景需求者,并可在 Google TalkBack 或 Android 9 及以上设备的辅助功能快捷方式中使用。Google 提醒用户勿将其用于导航、安全出行或障碍物检测。
Amazon Quick 推出 Live Data in Apps 功能,使 AI 构建的 Quick Apps 能实时查询受管 QuickSight 数据集,取代发布时冻结的静态快照。应用每次打开都会重新执行 SQL,查询以查看者身份运行,并自动沿用行级与列级安全规则。支持 SPICE 和 Direct Query 数据集,查看者需为已认证 Quick 用户,且首次使用需按数据集同意。
OpenAI 面向全球用户推出 ChatGPT 两项购物新功能:虚拟试衣和收藏(Favorites)。虚拟试衣基于新发布的 ChatGPT Images 2.5 模型,用户上传自拍或全身照即可预览服装与配饰上身效果,购物结果中新增“try on”按钮;收藏功能可将商品保存至应用内 Library 供后续查看。此前 OpenAI 曾放弃即时结账功能,而 Google 已于去年推出虚拟试衣。
Amazon Bedrock AgentCore 提供构建环境智能体的平台,其 Runtime 支持容器化代理托管、长时运行工作负载和会话隔离。环境智能体监听事件流(如 S3 文件上传)而非等待用户提示,通过单个 ask_human 工具暂停等待人工审批后继续执行。
Tavus 推出 Griffin,称其为首个“人类交互模型”(HIM),可实时理解并参与面对面视频对话。Tavus 研究中,48% 的参与者在 1 分钟视频通话后误以为 Griffin 是真人,而此前系统最高仅 2%。
Shopify 周四推出新网站搭建工具 Canvas,商家可通过与 AI 智能体 Sidekick 对话来创建商店,AI 修改时实时渲染真实代码,支持测试交互动画并预览不同屏幕尺寸效果。Canvas 初期不支持第三方主题、应用模块、市场、翻译及主题更新,且仅限桌面端,但 Shopify 表示后续将逐步完善。
谷歌发布新一代旗舰模型 Gemini 4 Argon,在 DeepSWE v1.1 上以 77.9% 超越 Claude Opus 5.5 与 GPT-6 Astra,CWE-bench v1 以 68% 并列第一,Vals Index 登顶。
台湾统一企业集团旗下数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并辅以提示词级输出优化,使其适配涵盖九类行为与三类主体的零售内容审核策略。