Speaker:李航教授,清华大学智能产业研究院首席科学家,字节跳动资深技术顾问,ACM、ACL和IEEE会士

Time: Sep. 24, 11:00 - 12:30

Venue:王克桢楼1113

Host:毕彦超

Abstract

大语言模型(LLM)虽然能像人一样使用语言,但其内部处理机制尚未被充分理解。LLM可解释性研究旨在揭示这一机制,从而更好地指导LLM模型训练。近年来,该领域取得了一定进展。本报告将介绍若干相关研究工作,主要包括:

  • 利用SAE等工具提取LLM中的特征;

  • 利用CLT等工具追踪特征之间形成的回路;

  • LLM中的特征在学习过程中被记忆、在推理中被检索的规律。

Bio

李航教授毕业于京都大学,并在东京大学获得博士学位。他曾在NEC研究院担任研究员,在微软亚洲研究院担任主任研究员,并在华为诺亚方舟实验室担任主任和首席科学家。在字节跳动,他曾担任人工智能实验室总监和研究部门负责人。他的研究领域包括机器学习、自然语言处理、信息检索和机器人技术。


2026-09-12