新技能发布:Amazon SageMaker AI 为编码智能体推出推理优化技能 aws-ai-ml
Amazon SageMaker AI 推出 aws-ai-ml 技能,可通过 Agent Toolkit for AWS 安装,让 Kiro、Claude Code、Codex 等编码智能体具备推理优化与基准测试能力,自动生成可执行的 SageMaker Python SDK v3 代码。
Amazon SageMaker AI 推出 aws-ai-ml 技能,可通过 Agent Toolkit for AWS 安装,让 Kiro、Claude Code、Codex 等编码智能体具备推理优化与基准测试能力,自动生成可执行的 SageMaker Python SDK v3 代码。
Claude Opus 5.5 和 Claude Sonnet 5.5 在 AWS GovCloud(US)区域上线,支持 ITAR 等合规工作负载的 AI 辅助开发。
Amazon Bedrock AgentCore Evaluations 作为托管能力,可评估多智能体系统在准确性、任务成功率和行为等多维度的表现,并支持内置与自定义评估器。
AWS 博客展示了如何在 Amazon Bedrock Managed Knowledge Base 上构建基于 LangChain 的 RAG 应用,对比标准 Retrieve API 与 AgenticRetrieveStream API 两种检索路径。
AWS 发布 Quick Resource Migrator,一个基于 Amazon Bedrock AgentCore 的 MCP 服务器示例,可在单个工具调用中自动化 Amazon Quick 资源(代理、连接器、知识库、流和空间)从开发账户到生产账户的跨账户提升。
Amazon Bedrock AgentCore 推出 AgentCore Gateway,可将 Claude Desktop 接入其 Web Search 能力,弥补模型训练知识截止带来的信息缺口。
AWS 提出 Adjudicated Query 设计模式,让业务人员通过 Amazon Quick 聊天界面提出合规问题,而通过/不通过的判定由确定性规则引擎完成,模型仅负责翻译问题与叙述结果,不参与最终裁决。
GitHub 发文指出,AI 正在改变开发者工作方式,开发者需学会指挥 AI、评估其输出并做出技术决策。文章建议三项技能:学会指挥 AI 智能体而非仅使用工具、不轻信 AI 首次回答(可用第二模型交叉评审)、利用 AI 节省的时间解决更大问题。文中提及 GitHub Copilot 内置 Rubber Duck 智能体可调用第二模型评审代码。
NVIDIA 将于 10 月 23 日通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等合作伙伴推出 64GB 统一内存版 DGX Spark,起售价 $4,999。
AWS 在 Amazon Bedrock AgentCore 上提出四智能体模式,将云迁移中基础设施即代码(IaC)开发时间从每应用 3-4 周缩短至分钟级。该模式与 AWS Transform 及 AWS DMS 协同,通过 MCP 工具连接内部系统,覆盖迁移与运维两大流程,适用于 300+ 应用的大型迁移项目。
社交俱乐部 The Den 在开设新地点时,借助 ChatGPT Work 将拨款申请准备时间从 3 天缩短至 2 小时,酒类许可证材料从 4 天缩短至 3 小时,每周节省 10-15 小时。该工具帮助团队更高效地处理行政工作,腾出时间用于业务增长。
AWS 机器学习博客发布分步指南,为 Claude Platform on AWS(CPonAWS)配置多环境访问。方案采用专用 AI Services 账户模式,通过跨账户 SigV4 支持 AWS 工作负载、工作区级 API 密钥供开发者本地使用、OIDC 联合认证支持外部环境,实现生产与开发流量隔离并共享单一订阅。
Amazon Bedrock AgentCore 提供构建环境智能体的平台,其 Runtime 支持容器化代理托管、长时运行工作负载和会话隔离。环境智能体监听事件流(如 S3 文件上传)而非等待用户提示,通过单个 ask_human 工具暂停等待人工审批后继续执行。
Amazon Payments 在 Amazon SageMaker AI 上采用多目标上下文多臂老虎机(MAB),为产品获客漏斗各阶段(申请开始、提交、审批)分别运行 LinUCB 模型并线性组合其 UCB 分数,以同时优化整个漏斗。
AWS 博客演示如何将 Amazon S3 Vectors 作为 NVIDIA NeMo Agent Toolkit(NAT)的持久化记忆层,部署于 Amazon EKS。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,在保留蛋白质生物功能的同时嵌入不可见签名,并可在物理蛋白质上验证。实验显示,水印设计在结合亲和力、命中率和序列多样性上与未水印版本相当,首次实现了带水印且功能正常的蛋白质结合剂。
推荐理由:原文给出了水印技术的原理、实验验证和开放计划,读者可以据此判断它在生物安全与科研诚信中的实际作用。
CoreWeave 在 Fully Connected 大会上宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网可用,Cognition 成为首个在 Vera Rubin 上运行生产负载的客户,其 SWE-2 推理工作负载的 token 总吞吐量较 GB200 NVL72 提升最高 4.8 倍。
Amazon Bedrock AgentCore 新增 Runtime Instances 计算选项,支持最长 14 天的多智能体会话、GPU 访问与持久存储,区别于 MicroVM 的 8 小时上限。
教育部等七部门经国务院同意印发《特殊教育发展提升“十五五”行动计划》,提出到2030年适龄残疾儿童义务教育入学率巩固在97%以上。行动计划将推进特殊教育学校标准化建设、课程教学改革、师资培养和经费保障,并探索建设特殊教育智能体,支持人工智能用于随班就读学生助教陪读和重度残疾学生送教上门。
推荐理由:文件同时部署特殊教育资源、教学、经费与数字化建设,尤其明确了人工智能助力助教陪读和送教上门的应用场景。
AWS 发布 Amazon Quick 提示词工程基础系列文章的第一部分,讲解跨平台 AI 功能通用的提示词原则与可复用框架。核心方法包括用具体细节消除歧义、提供业务上下文、以示例替代描述,以及采用 CRISPE 框架(上下文、角色、意图、步骤、范围等)组织复杂请求。系列第二部分将深入 Research 等各组件的专项技巧。
AWS 官方博客详解 Amazon Quick 各组件的提示词编写差异。Quick Research 需明确目标、受众与子问题,可调用 Quick Index、200+ 新闻源及 S&P Global、FactSet、PubMed 等数据源;Quick Flows 建议用编号步骤描述触发条件与分支逻辑;Quick Sight 查询需包含业务问题、指标与维度。
AWS 发布基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台参考架构。该平台用 AI 智能体从合同 PDF 中提取八类关键字段,并由独立验证智能体复核,签名分歧由 Amazon Textract 以计算机视觉裁决,结果存入 Amazon Aurora PostgreSQL。
微软亚洲研究院(新加坡)迎来成立一周年,该实验室于2025年7月24日启用,是微软在东南亚的首个研究实验室。一年来,实验室围绕下一代AI模型与智能体系统、领域特定AI、AI原生研究实践及生态与人才发展四大支柱开展工作,并与新加坡经济发展局(EDB)合作开展博士培养项目。其研究重点包括多模态医疗AI和自进化诊断智能体,旨在推动AI从实验室走向医疗、教育等领域的实际应用。
本教程展示如何在 Amazon SageMaker AI 上部署两个 vLLM-Omni 端点,实现从文本提示生成图像并进一步生成短视频。实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 将图像转为视频,输出 MP4 存储于 Amazon S3。
AWS 提出用 Amazon Nova Act 与 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,替代 Selenium、Playwright 等依赖 DOM 选择器的脆弱脚本。
AWS 提出跨账户自动化管理 Amazon Textract 适配器生命周期的方案,通过将适配器 ID 存入 AWS Systems Manager Parameter Store,更新生产引用时无需停机或重新部署应用,变更时间从数小时或数天缩短至数秒。
AWS 在 SageMaker HyperPod 上演示了如何用开源强化学习框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型。通过 GRPO 算法,模型在 64 个迷宫测试集上的解决率从 43.75% 提升至 95% 以上。该方案利用 HyperPod 的集群弹性、Ray 集成和 Amazon Managed Grafana 监控,支持多节点长时间训练。
AWS 在 Amazon Bedrock 上为 NarrateAI 引入五项生产级质量保障技术,包括自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架与数据准确性验证,服务超 4,000 名 AWS 高管。该方案通过两阶段级联检测数值幻觉,在实时流式响应下实现约 99% 的数值准确率。
Qwen3-TTS-12Hz-1.7B-Base 现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点,实现基于数秒参考音频的语音克隆,无需重新训练模型。该模型支持 10 种语言及跨语言克隆,输出 24 kHz 音频,适用于教育、媒体等场景,并支持流式生成。部署后数据保留在 AWS 环境中,可通过 CloudWatch 监控端点规模。
GitHub Copilot 应用推出 canvas 功能,一种可在应用内运行、无浏览器界面的全栈应用,支持与 Copilot 智能体双向通信,并可调用第三方 API 或本地执行代码。作者认为聊天界面并非 AI 交互的最佳形态,canvas 能构建定制化 UI,减少 token 浪费并自动化开发工作流,如创建 Connect 4 游戏、管理 Winget 包或操作 SQLite 数据库。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持通过自然语言提示从零创建角色声音,并可在 Google AI Studio、Gemini API 等平台使用。
ABI Research 预测到 2035 年将有 4900 万辆 L3-L5 自动驾驶汽车,Omdia 估计 2026 至 2035 年间将部署约 6000 万台工业机器人。
GitHub 工程师 Stephen Toub 发文详述了使用 GitHub Copilot 将 Copilot agent 运行时从 TypeScript 重写为 Rust 的过程。
推荐理由:作者以第一手数据复盘了用 AI 重写核心运行时的全过程,读者可据此评估 AI 编程在大型工程中的实际成效与局限。
在 Salesforce Dreamforce 大会上,NVIDIA CEO 黄仁勋与 Salesforce CEO Marc Benioff 共同宣布 Salesforce 首个 CRM 推理模型 Koa 发布。
推荐理由:原文给出了 Salesforce 首个 CRM 推理模型 Koa 的技术底座、训练方式与落地时间表,读者可据此判断企业级 AI 应用的新进展。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款语音模型,前者面向规模化与成本效率,后者面向高复杂度任务。
推荐理由:原文给出了两款新模型的定位差异、评测成绩和开放入口,读者可以据此判断它们适合哪些语音交互场景。
Fyxer 借助 OpenAI 模型、微调、记忆机制和真实用户反馈,为用户整理收件箱并按个人语气起草邮件。该系统通过持续学习用户偏好,提升回复的个性化与可信度,让 AI 行政助理更贴合实际工作场景。
GitHub 日韩市场部负责人将活动运营流程改造成代码驱动:用 GitHub Issue 表单收集活动信息、标签触发 GitHub Actions 自动化工作流,并借助 GitHub Copilot 将人工操作手册转化为对话式自动化。活动从策划到会后 CRM 数据整理全程自动执行,无需编写代码,仅依赖事件平台的 API 或 CRM 的 CLI 即可实现。
OpenAI 发布 Agents API,这是一项托管服务,由 Codex harness 驱动,支持编排、长时间运行会话和工具调用,用于构建和部署云端 AI 智能体。该 API 面向开发者,提供开箱即用的基础设施,简化智能体的开发与上线流程。
MIT 研究员借助 GPT-5.6 Sol 与 Codex,自主运行量子计算实验、分析结果并校准量子比特。该工作流展示了 AI 智能体在科研实验全流程中的自动化潜力,从实验设计到数据解析均由模型驱动完成。
微软研究院发布开源框架 Orchard,用于可扩展且低成本的智能体 AI 研究,核心是 Kubernetes 环境服务 Orchard Env,可复用于软件工程、网页导航和个人助理等任务。
推荐理由:原文给出了完整的技术方案、训练数据和基准成绩,读者可以据此评估开源智能体框架的复现成本与能力上限。