跳到正文

#Microsoft

今日 0 条
10月3日周六
9月29日周二
  1. Microsoft Research40

    微软亚洲研究院(新加坡)成立一周年:研究、合作与人才培养如何推动现实影响

    微软亚洲研究院(新加坡)迎来成立一周年,该实验室于2025年7月24日启用,是微软在东南亚的首个研究实验室。一年来,实验室围绕下一代AI模型与智能体系统、领域特定AI、AI原生研究实践及生态与人才发展四大支柱开展工作,并与新加坡经济发展局(EDB)合作开展博士培养项目。其研究重点包括多模态医疗AI和自进化诊断智能体,旨在推动AI从实验室走向医疗、教育等领域的实际应用。

9月25日周五
  1. GitHub Blog · AI & ML38

    GitHub Copilot 的 canvas:当聊天不是正确的 UI 时

    GitHub Copilot 应用推出 canvas 功能,一种可在应用内运行、无浏览器界面的全栈应用,支持与 Copilot 智能体双向通信,并可调用第三方 API 或本地执行代码。作者认为聊天界面并非 AI 交互的最佳形态,canvas 能构建定制化 UI,减少 token 浪费并自动化开发工作流,如创建 Connect 4 游戏、管理 Winget 包或操作 SQLite 数据库。

9月24日周四
9月17日周四
9月1日周二
  1. Microsoft Research48

    GigaPath-Flash 与 GigaTIME-Flash:面向人群规模发现的更高效病理学基础模型

    微软研究院推出 GigaPath-Flash 与 GigaTIME-Flash,通过知识蒸馏将十亿参数模型压缩至 22M 参数的 ViT-S 骨干,在 PANDA 和 EBRAINS 基准上以约 50 倍更低的算力实现与原版相差 3% 以内的性能。GigaTIME-Flash 在脑、乳腺、结肠和肺癌的内外分布队列中匹配或超越原版预测质量,两者均以 Apache 2.0 协议开源,仅限研究用途。

8月13日周四
  1. Microsoft Research38

    MindTopo 基准揭示多模态大模型的空间推理短板

    微软研究院推出 MindTopo,一个评估多模态大模型拓扑推理能力的新基准,涵盖连通性、封闭、顺序、分离与打结五类任务,并区分静态推理与交互规划两个认知层级。测试显示,当前闭源与开源模型在静态识别上明显强于交互规划,规划阶段常丢失结构关系或提出违反物理约束的动作,整体表现远低于人类水平。该基准旨在为机器人与交互环境中的 AI 系统提供诊断工具。

8月4日周二
  1. Microsoft Research60

    微软研究院开源 Orchard 智能体框架,小模型在 SWE-bench Verified 达 69.7%

    微软研究院发布开源框架 Orchard,用于可扩展且低成本的智能体 AI 研究,核心是 Kubernetes 环境服务 Orchard Env,可复用于软件工程、网页导航和个人助理等任务。

    推荐理由:原文给出了完整的技术方案、训练数据和基准成绩,读者可以据此评估开源智能体框架的复现成本与能力上限。