uniopen 如何定制 Amazon Nova 以适配零售审核策略并投入生产
台湾统一企业集团旗下数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并辅以提示词级输出优化,使其适配涵盖九类行为与三类主体的零售内容审核策略。
台湾统一企业集团旗下数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并辅以提示词级输出优化,使其适配涵盖九类行为与三类主体的零售内容审核策略。
OpenAI 在 DevDay 发布新智能体 Dots,由 GPT-6 Astra 驱动,定位“首席参谋”式专业助手,可构建虚拟世界,但仅限 $20/月 Pro 及以上用户使用。Meta 的 Muse 则免费提供专用虚拟机,向所有 Meta 账户开放。OpenAI 预计到 2030 年支出 $2800 亿,并计划融资 $300 亿,估值 $1.4 万亿,高昂算力成本使其暂难免费。
Anthropic 面向美国联邦和州政府机构推出 Claude for Government,该平台自 7 月起公开测试,运行于 FedRAMP High 环境。因五角大楼禁用 Claude,此次主要面向民用机构。平台功能与企业版一致,按用量付费并设固定上限,管理员可设置预算和模型访问权限,聊天数据保留在机构设备上。
听力科技初创公司 Legato 于周四宣布其 AI 助听眼镜 Legato Frames 正式开售,起售价 999 美元,面向轻度至中度听力损失的成年人。该眼镜将助听技术集成于镜腿,通过 AI 系统区分人声与背景噪音,并采用双扬声器设计将声音定向传向佩戴者,在距离耳朵几英寸处可将外泄声音降低 99%。
Google 发布新一代前沿模型 Gemini 4 Argon,在关键基准测试中击败部分竞争对手,但整体仍未明显领先,Anthropic 的模型仍占据榜首。Argon 是 Gemini 3.1 Pro 之后七个多月来的首个前沿模型,初始定价为每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入 token 便宜 95%。
xAI 的 Grok 4.7 现已上线 Amazon Bedrock,支持 500K token 上下文窗口,并提供低、中、高、超高四档可配置推理强度。该模型通过跨区域推理配置提供服务,兼容 Responses、Chat Completions 和 Converse API。据 xAI 称,Grok 4.7 是其最强的编码与知识工作模型,在困难任务上能更持久地工作并更仔细地自我验证输出。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,在保留蛋白质生物功能的同时嵌入不可见签名,并可在物理蛋白质上验证。实验显示,水印设计在结合亲和力、命中率和序列多样性上与未水印版本相当,首次实现了带水印且功能正常的蛋白质结合剂。
推荐理由:原文给出了水印技术的原理、实验验证和开放计划,读者可以据此判断它在生物安全与科研诚信中的实际作用。
Google 在 Gemini 聊天中全球推出 Skills,以可自动生成、按“/”调用的详细提示词取代 Gems,并支持文本、PDF、图片作为参考材料。Gems 将于 11 月对个人账户停用,企业与非营利 Workspace 客户延至 2027 年 3 月,教育客户延至 2027 年 6 月,现有 Gems 自动转换。
Meta 与 OpenAI 正押注同一路径:先用可爱的 AI 智能体培养用户感情,再推出实体硬件。OpenAI 与 Jony Ive 合作,计划不早于 2027 年 2 月发货;Meta 则将在今年假日购物季前推出挂件式设备 Muse Charm。OpenAI 在 DevDay 发布 AI 智能体平台 Dots,CEO Sam Altman 暗示其未来可能进入硬件设备。
OpenAI 在 Dev Day 上发布“Decisions API”,功能类似 TypeSafe AI 本月推出的 Jev 模型,可为 Luna 模型提供预定义选项以提升速度并保留图像理解等能力。
Instagram 宣布其独立应用 Edits 将新增 AI“创意助手”,可调用用户账号数据(点赞、观看、视频留存、分享等)提供发帖建议,并回答平台趋势、内容表现差异等问题。该功能对创作者免费,但“重度用户”可订阅 Meta One 获取更多用量。
CoreWeave 在 Fully Connected 大会上宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网可用,Cognition 成为首个在 Vera Rubin 上运行生产负载的客户,其 SWE-2 推理工作负载的 token 总吞吐量较 GB200 NVL72 提升最高 4.8 倍。
Amazon Bedrock AgentCore 新增 Runtime Instances 计算选项,支持最长 14 天的多智能体会话、GPU 访问与持久存储,区别于 MicroVM 的 8 小时上限。
OpenAI发布GPT-6.1 Sol,称其在智能体编码、计算机使用和办公任务上接近旗舰模型Astra,但成本仅为后者的五分之一。API定价为每百万输入token 2美元、输出10美元,缓存输入0.10美元,与Claude Sonnet 5.5同价位。
推荐理由:原文给出了GPT-6.1 Sol的定价、基准成绩与安全表现,读者可据此判断它相对Astra的性价比与适用场景。
Meta 宣布将 AI 智能体 Muse 扩展至小企业,新增 Shopify、Dropbox、Slack、Asana、Notion、Stripe 等十余项集成,可连接 Instagram 专业账号分析、Facebook 主页及 Meta 广告账户。
OpenAI 在 DevDay 上宣布扩展 ChatGPT 插件能力,开发者可构建应用式插件并在侧边栏获得专属入口,支持交互面板与文件查看器。新增 Plugin Creator 工具简化构建流程,并优化插件目录的排序与推荐。ChatGPT Sites 可托管这些插件,同时新增对 MCP Events 规范的支持,使插件能基于连接应用的事件启动自动化。
OpenAI 在 DevDay 上为软件工程智能体 Codex 推出可复用云端开发环境,开发者可从电脑、手机或云端运行 Codex,任务启动更快,团队可共享已批准的设置与权限。同时更新 Codex CLI 支持语音指令,新增 /agents 视图、代码审查体验及 Codex Security Cloud 安全工具,并发布 Decisions API 与支持计算机操作的 Agents API 更新。
OpenAI 在 DevDay 活动上推出 Dots,一款由 GPT-6 Astra 驱动的个人智能体助手,可在后台持续运行并自主追求用户设定的目标。Dots 即日起面向符合条件的 Pro 和 Business Premium 用户开放,可从 Codex 或 ChatGPT 启动,并支持通过 Slack、Teams 等平台交互。
Manus 2.0 发布,面向海外用户推出个人 Agent 应用 Cue,为每个 Agent 配备独立邮箱、电话号码、钱包和电脑,支持拉群协作;桌面端升级为 Manus Studio,新增视频编辑和游戏开发功能。新一代自研 Agent 框架 Cascade 使 Token 消耗减少 23.2%,任务完成时间缩短 28.2%,运行成本降低 32%。面向国内市场的产品正在筹备。
推荐理由:Manus 2.0 与 Cue 的发布细节和国内筹备信息,可帮助读者判断个人 Agent 赛道的下一步走向。
Amazon Bedrock 宣布 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 在印度可用,通过地理跨区域推理在印度区域(仅限 ap-south-1 和 ap-south-2 之间)处理数据,满足本地数据处理要求。
Amazon Bedrock 现已在首尔和新加坡区域支持区域内推理,提供 Claude Opus 5 和 Claude Sonnet 5 模型,满足金融、医疗和公共部门的数据本地化需求。
美国政府周二上线了首个面向公众的 AI 聊天机器人 America.gov,由谷歌与 SpaceXAI 合作开发,目前尚难被越狱。当用户提及 Minecraft 时,该机器人会输出约 1800 词的《终末之诗》改写版,而非模型幻觉。特朗普称 20 岁程序员 Edward Coristine 是该项目首席工程师之一。
GPT-6.1 Sol 现已在 Amazon Bedrock 上正式可用,为编码、计算机使用和专业工作负载带来更强的推理能力。据 OpenAI 称,GPT-6.1 Sol 在 DeepSWE v1.1 上以约五分之一的任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
Wabi 宣布转型为 AI 消息应用 Wabi 2.0,定位为“替你做事并即时构建所需界面的个人智能体”,从 vibe-coding 工具转向与 Meta 的 Muse 和 Instinct 等 AI 智能体竞争。创始人 Eugenia Kuyda 称,纯聊天式智能体体验不佳,未来是智能体、应用与人共处一处。Wabi 2.0 目前仅通过 X 上的邀请码开放使用。
AWS 发布基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台参考架构。该平台用 AI 智能体从合同 PDF 中提取八类关键字段,并由独立验证智能体复核,签名分歧由 Amazon Textract 以计算机视觉裁决,结果存入 Amazon Aurora PostgreSQL。
腾讯推出新版 Marvis,将个人 Agent 定位升级为 AI 管家,新增电池健康检查、高耗电应用识别与开机启动项调整等电脑系统管理功能。截至本月,Marvis 日活跃用户数比 5 月上线时增长近四倍。新版主打电脑、文件、软件和浏览器四类任务,并采用端侧模型建立文件索引、按需调用云端模型的调用路径,电脑配置门槛从六核 16GB 降至四核 8GB。
推荐理由:原文给出了新版 Marvis 的功能变化、用户数据与端侧模型路径,读者可据此判断个人 Agent 在终端管理方向上的实际进展。
Claude Sonnet 5.5 已在 Amazon Bedrock 和 Claude Platform on AWS 上正式可用,面向聚焦编码与知识工作,以更快速度实现大多数任务更低的单任务成本。
AWS 提出用 Amazon Nova Act 与 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,替代 Selenium、Playwright 等依赖 DOM 选择器的脆弱脚本。
四川省教育厅推出的“四川AI助教”正式上线,面向全省中小学教师免费开放。该助教设AI教学空间、AI课堂分析、智能体广场三大板块,可生成教学设计、课堂循证教研报告及班级管理文案,教师可通过四川省中小学智慧教育平台、天府云教等访问。
推荐理由:四川省教育厅免费开放AI助教,覆盖备课、课堂分析、班级管理等场景,可据此了解省级官方推动AI教学落地的具体形态。
Microsoft 不再坚持要求用户购买“Copilot+ PC”认证设备,其新款 Surface 笔记本已放弃这一品牌标识。此举标志着该公司在 AI PC 营销策略上的调整,不再将 Copilot+ 作为硬件推广的核心卖点。
AWS 提出一种结合 Amazon EKS、EFA 与 DeepEP 的架构,用于加速 MoE 模型的大规模强化学习后训练,吞吐量提升 40%。该方案通过 DeepEP 优化 EFA 上的专家并行通信,并协调 rollout 生成与策略训练的异构算力需求,应对 RLHF 与 GRPO 训练中的通信瓶颈。
AWS 在 SageMaker HyperPod 上演示了如何用开源强化学习框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型。通过 GRPO 算法,模型在 64 个迷宫测试集上的解决率从 43.75% 提升至 95% 以上。该方案利用 HyperPod 的集群弹性、Ray 集成和 Amazon Managed Grafana 监控,支持多节点长时间训练。
Qwen3-TTS-12Hz-1.7B-Base 现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点,实现基于数秒参考音频的语音克隆,无需重新训练模型。该模型支持 10 种语言及跨语言克隆,输出 24 kHz 音频,适用于教育、媒体等场景,并支持流式生成。部署后数据保留在 AWS 环境中,可通过 CloudWatch 监控端点规模。
Runway 推出世界模型 GWM Worlds 2 研究预览版,新增 WorldPrompt 输入格式,允许用户通过提示词指定生成世界的初始帧和带时间戳的事件,并支持实时交互。
Meta 推出钥匙扣大小的 AI 助手 Muse Charm,预计 12 月发货。该设备主打便携随身 AI 交互,标志着 Meta 将 AI 助手从手机屏幕延伸至日常佩戴场景。
金吉列留学在2026云栖大会上发布与阿里千问办公联合定制的“DingTalk A1”留学版产品,将27年行业判断标准做进链路,覆盖语音到方案全流程,实现“听、读、想、做、审”五步工作流。产品定位为顾问随身工作台,目前正推进规模化部署,现场真机开放体验。
Simon Willison 用 GPT-6 Astra 编写了 Gemini 3.8 TTS Playground,一个自带 API Key 的交互式工具,可试听谷歌新发布的 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts 模型。
Abre 在其数据智能平台中推出分析智能体“Vera”,支持用自然语言提问并即时获得角色感知的答案,无需数据专业知识。Vera 统一了 1,000 多个 K-12 数据源,提供实时 Liveboards、AI 摘要、KPI 阈值提醒等功能,并内置基于角色的访问控制,确保学生数据加密且不用于训练公共 AI 模型。Vera 提供 Basic、Enhanced 和 Premium 三个套餐层级。
Google 宣布为 Private AI Compute 平台新增私有服务器端记忆层,实现跨设备持久AI记忆。该方案通过硬件安全飞地、加密通道和设备派生密钥,确保数据在云端处理时仍保持设备级隐私,即使 Google 也无法访问。同时发布防篡改软件记录及独立网络安全审计结果,邀请社区验证其保护机制。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持通过自然语言提示从零创建角色声音,并可在 Google AI Studio、Gemini API 等平台使用。