语言理解与机器翻译
从实体识别与信息抽取,到同声传译、图像内翻译与非字面翻译评价,研究跨语言、跨场景的信息理解与表达。
信息抽取 · 语音翻译 · 翻译评估
BEIJING INSTITUTE OF TECHNOLOGY
Yuhang Guo
北京理工大学 · 计算机学院
研究自然语言处理与语言智能,关注机器如何理解语言、连接多模态信息,并在真实场景中可靠地完成任务。
从实体识别与信息抽取,到同声传译、图像内翻译与非字面翻译评价,研究跨语言、跨场景的信息理解与表达。
信息抽取 · 语音翻译 · 翻译评估
融合语音、视觉与文本,探索多模态对话、语音生成与具身动作规划,让模型更好地理解情境与交互意图。
语音与音频 · 多模态对话 · 具身规划
围绕模型编辑、输出格式遵循、工具调用与智能家居任务,研究大模型的能力增强,以及可验证的可靠性与安全性。
强化学习 · 模型编辑 · 工具安全
结合视觉与音频感知,研究具身智能体如何主动规划动作序列。
面向非字面翻译建立评估基准,探索更贴近语义的翻译质量评价。
覆盖单设备、多设备及有效与无效指令,评估大模型在智能家居中的指令理解能力。
围绕输出格式遵循开展强化学习研究,提高大模型跨任务的格式可靠性。
让模型重写自身推理过程并用于强化学习,提升推理质量,减少冗余思考。
如果你正在了解研究方向、选择导师,可以先阅读一篇感兴趣的论文,或运行一个开源项目,思考你想进一步解决的问题。
论文与开源项目提供了方法、评测和实验实现。欢迎围绕具体应用场景、数据条件与技术问题展开交流。
联系时可简要介绍背景、感兴趣的工作与希望讨论的问题。
联系交流研究交流、学生指导与合作探讨