工作经历
工作经历
首席研究员 — M365 Core,微软
时间:2024 年 8 月–至今
负责 M365 BizChat / Copilot、Researcher agent 及相关 AI 助手的应用研究与开发,重点包括基于 LLM 的企业知识推理、深度搜索、评估,以及面向可信 AI 和安全的产品准备。
- 领导面向产品场景的应用研究,覆盖 AI 助手推理质量、模型选择、深度搜索,以及可信 AI 和安全能力建设。
- 构建面向生产推理轨迹的离线评估与回放基础设施,用于系统诊断答案质量、引用质量、搜索支撑的推理和模型选择质量。
- 推进 Researcher agent、深度搜索和多轮对话质量。
- 持续开展 AI 安全研究,包括 LLM 安全、agent 安全、模型篡改检测与知识产权保护,以及对抗鲁棒性。
- 参与领导微软 Secure Future Initiative(SFI,安全未来计划)和安全学习社区相关工作。
首席研究员 — Bing Core Search,微软
时间:2023 年 2 月–2024 年 8 月
在微软 Bing Core Search 中领导面向产品的多向量检索、提示词优化、文档理解、检索评估和 Web 推荐研究。
- 共同设计灵活的多向量检索系统(XTR + ColBERT),作为用于替代稀疏+稠密检索的新检索机制。
- 设计被多个 Bing 团队采用的提示词优化方法,包括 AMPO 和 StraGo(EMNLP 2024)。
- 构建基于大语言模型的文档理解流水线,为新鲜和长尾 Web 文档生成合成查询和点击信号。
- 持续开展 AI 安全研究,包括 LLM 安全、agent 安全、模型篡改检测与知识产权保护,以及对抗鲁棒性。
研究员 → 主管研究员 → 首席研究员 — 微软亚洲研究院(MSRA)
时间:2001 年 12 月–2023 年 2 月
长期领导 AI 安全、AI 在安全中的应用、可信计算、隐私保护计算、内容保护和多媒体系统方向研究。
- 开展负责任和可信 AI、AI/ML 安全、钓鱼与账号保护、认证、CAPTCHA、可伸缩媒体加密和 DRM、应用密码学、数据嵌入、可视化和人机计算系统研究。
- 推动重要技术转化,包括人工操作勒索攻击防御、恶意 PowerShell 脚本检测、钓鱼检测、CAPTCHA、欺诈检测、Bing 索引压缩和移动完整性检测。
- 建立跨微软亚洲研究院(MSRA)、微软雷德蒙研究院、微软产品团队、亚洲/美国/英国高校伙伴和外部学术社区的合作,将想法推进到原型、评估、转化和长期产品使用。
代表性项目主题
- AI 安全与 AI 在安全中的应用:后门检测与数据清洗、抗规避检测器、基于行为的账号保护。
- 人机交互证明与认证:图像、可操作和覆盖式 CAPTCHA,音频 HIP,图形密码安全分析,以及设备辅助认证。
- 钓鱼、欺诈与账号滥用:机器学习和内容检测、抗规避 logo 识别,以及严格隐私约束下的可解释反钓鱼模型。
- 多媒体安全与内容保护:面向 MPEG-4 和 JPEG2000 的可伸缩、语法兼容加密与 DRM,以及图像、图表和幻灯片数据嵌入(Chartem、ChartStamp)。
- 隐私保护计算与云可靠性:同态加密域中的解压和分析、加密视频运动检测,以及 Azure 无监督异常和故障检测。
主管科学家、联合创始人 — Cognicity, Inc.
地点:Edina, MN 时间:1997 年 8 月–2001 年 9 月
基于 University of Minnesota 博士研究共同创办多媒体水印和数据嵌入公司。负责音频、图像和视频水印、指纹、版权保护、访问控制、追踪和链接产品的研究与开发。
- 为新算法和核心技术提供技术领导,设计产品架构,并将研究原型转化为商业产品。
- 领导 AudioKey(零售音频水印)、AudioKey MP3 tMark 和 Cognicity tMark(下载时交易水印)以及 TurnKey(刻录时每张 CD 唯一 ID 水印)的开发。
- 参与音乐行业版权保护工作,包括 MUSE、4C Entity DVD-Audio proposal 和 SDMI Phase 2 screening,并为美国政府客户开发隐蔽通信产品。
学术兼职与教学
- 兼职教授,华中科技大学,2019–2023 年。
- 教学
- 课程授课教师,《数据挖掘与商务智能》,北京航空航天大学软件学院,2012 年。
- 课程授课教师,《数据仓库与数据挖掘》,北京航空航天大学软件学院,2010 年。
- 课程授课教师,《信息系统管理》,北京航空航天大学软件学院,2009 年。
- 助教,美国明尼苏达大学物理系,1989–1992 年;承担本科物理实验课教学。