跳到正文

#AI 工具/Agent

今日 5 条
今天10月6日周二
10月3日周六
10月2日周五
  1. GitHub Blog · AI & ML23

    AI 正在改变开发者工作方式,GitHub 建议强化三项技能

    GitHub 发文指出,AI 正在改变开发者工作方式,开发者需学会指挥 AI、评估其输出并做出技术决策。文章建议三项技能:学会指挥 AI 智能体而非仅使用工具、不轻信 AI 首次回答(可用第二模型交叉评审)、利用 AI 节省的时间解决更大问题。文中提及 GitHub Copilot 内置 Rubber Duck 智能体可调用第二模型评审代码。

  2. AWS Machine Learning Blog38

    用 Amazon Bedrock AgentCore 上的智能体扩展云迁移:四智能体模式将 IaC 开发从 3-4 周压缩至分钟级

    AWS 在 Amazon Bedrock AgentCore 上提出四智能体模式,将云迁移中基础设施即代码(IaC)开发时间从每应用 3-4 周缩短至分钟级。该模式与 AWS Transform 及 AWS DMS 协同,通过 MCP 工具连接内部系统,覆盖迁移与运维两大流程,适用于 300+ 应用的大型迁移项目。

  3. AWS Machine Learning Blog42

    在 AWS 上为 Claude Platform 实现多环境访问

    AWS 机器学习博客发布分步指南,为 Claude Platform on AWS(CPonAWS)配置多环境访问。方案采用专用 AI Services 账户模式,通过跨账户 SigV4 支持 AWS 工作负载、工作区级 API 密钥供开发者本地使用、OIDC 联合认证支持外部环境,实现生产与开发流量隔离并共享单一订阅。

10月1日周四
  1. Google DeepMind62

    Google DeepMind 推出 SynthID Bio,为 AI 生成的蛋白质添加水印

    Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,在保留蛋白质生物功能的同时嵌入不可见签名,并可在物理蛋白质上验证。实验显示,水印设计在结合亲和力、命中率和序列多样性上与未水印版本相当,首次实现了带水印且功能正常的蛋白质结合剂。

    推荐理由:原文给出了水印技术的原理、实验验证和开放计划,读者可以据此判断它在生物安全与科研诚信中的实际作用。

9月30日周三
  1. 教育部 · 工作动态81

    教育部等七部门印发《特殊教育发展提升“十五五”行动计划》

    教育部等七部门经国务院同意印发《特殊教育发展提升“十五五”行动计划》,提出到2030年适龄残疾儿童义务教育入学率巩固在97%以上。行动计划将推进特殊教育学校标准化建设、课程教学改革、师资培养和经费保障,并探索建设特殊教育智能体,支持人工智能用于随班就读学生助教陪读和重度残疾学生送教上门。

    推荐理由:文件同时部署特殊教育资源、教学、经费与数字化建设,尤其明确了人工智能助力助教陪读和送教上门的应用场景。

  2. AWS Machine Learning Blog38

    Amazon Quick 提示词工程基础:通用原则与结构化框架(上)

    AWS 发布 Amazon Quick 提示词工程基础系列文章的第一部分,讲解跨平台 AI 功能通用的提示词原则与可复用框架。核心方法包括用具体细节消除歧义、提供业务上下文、以示例替代描述,以及采用 CRISPE 框架(上下文、角色、意图、步骤、范围等)组织复杂请求。系列第二部分将深入 Research 等各组件的专项技巧。

9月29日周二
  1. Microsoft Research40

    微软亚洲研究院(新加坡)成立一周年:研究、合作与人才培养如何推动现实影响

    微软亚洲研究院(新加坡)迎来成立一周年,该实验室于2025年7月24日启用,是微软在东南亚的首个研究实验室。一年来,实验室围绕下一代AI模型与智能体系统、领域特定AI、AI原生研究实践及生态与人才发展四大支柱开展工作,并与新加坡经济发展局(EDB)合作开展博士培养项目。其研究重点包括多模态医疗AI和自进化诊断智能体,旨在推动AI从实验室走向医疗、教育等领域的实际应用。

9月28日周一
9月26日周六
  1. AWS Machine Learning Blog42

    NarrateAI:在 Amazon Bedrock 上实现生产级 LLM 质量保障

    AWS 在 Amazon Bedrock 上为 NarrateAI 引入五项生产级质量保障技术,包括自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架与数据准确性验证,服务超 4,000 名 AWS 高管。该方案通过两阶段级联检测数值幻觉,在实时流式响应下实现约 99% 的数值准确率。

  2. AWS Machine Learning Blog42

    在 Amazon SageMaker AI 上部署 Qwen3-TTS 实现实时个性化语音

    Qwen3-TTS-12Hz-1.7B-Base 现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点,实现基于数秒参考音频的语音克隆,无需重新训练模型。该模型支持 10 种语言及跨语言克隆,输出 24 kHz 音频,适用于教育、媒体等场景,并支持流式生成。部署后数据保留在 AWS 环境中,可通过 CloudWatch 监控端点规模。

9月25日周五
  1. GitHub Blog · AI & ML38

    GitHub Copilot 的 canvas:当聊天不是正确的 UI 时

    GitHub Copilot 应用推出 canvas 功能,一种可在应用内运行、无浏览器界面的全栈应用,支持与 Copilot 智能体双向通信,并可调用第三方 API 或本地执行代码。作者认为聊天界面并非 AI 交互的最佳形态,canvas 能构建定制化 UI,减少 token 浪费并自动化开发工作流,如创建 Connect 4 游戏、管理 Winget 包或操作 SQLite 数据库。

9月23日周三
9月22日周二
9月17日周四
9月16日周三
9月14日周一
9月12日周六
  1. GitHub Blog · AI & ML40

    营销运营即代码:GitHub 上从活动策划到后续跟进的全流程自动化

    GitHub 日韩市场部负责人将活动运营流程改造成代码驱动:用 GitHub Issue 表单收集活动信息、标签触发 GitHub Actions 自动化工作流,并借助 GitHub Copilot 将人工操作手册转化为对话式自动化。活动从策划到会后 CRM 数据整理全程自动执行,无需编写代码,仅依赖事件平台的 API 或 CRM 的 CLI 即可实现。

9月10日周四
9月9日周三
8月4日周二
  1. Microsoft Research60

    微软研究院开源 Orchard 智能体框架,小模型在 SWE-bench Verified 达 69.7%

    微软研究院发布开源框架 Orchard,用于可扩展且低成本的智能体 AI 研究,核心是 Kubernetes 环境服务 Orchard Env,可复用于软件工程、网页导航和个人助理等任务。

    推荐理由:原文给出了完整的技术方案、训练数据和基准成绩,读者可以据此评估开源智能体框架的复现成本与能力上限。