Jiahui Geng
Biträdande universitetslektor
Mina forskningsintressen kretsar kring säkerhet, tillförlitlighet och alignment hos stora språkmodeller (LLM) samt agentbaserad AI. Mitt mål är att bygga AI-system som kan resonera och samarbeta inom mjukvaruutveckling och embodied tasks.
Presentation
Jag är biträdande lektor (tenure track). Mitt nuvarande forskningsfokus ligger på säkerhet i stora språkmodeller (LLM safety), agentbaserad AI för mjukvaruutveckling samt embodied tasks, med ett särskilt intresse för robotinlärning. Jag välkomnar studenter som är intresserade av AI-forskning att kontakta mig, särskilt studenter från Linköpings universitet, för diskussion och potentiella publikationer.
Publikationer
2026
Forgotten Horizons in Concept Erasure: Safeguarding Close-Proximity Concepts in Text-to-Image Models
IEEE Transactions on Information Forensics and Security, Vol. 21, s. 7202-7214
(Artikel i tidskrift)
https://dx.doi.org/10.1109/TIFS.2026.3714133
知识外化:多模态大型语言模型中的可逆遗忘和模块化检索
第十四届国际学习表征会议
(Konferensbidrag)
CodeMMR: Bridging Natural Language, Code, and Image for Unified Retrieval
Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)
(Konferensbidrag)
虚假奖励悖论:从机制上理解 RLVR 如何激活 LLM 中的记忆捷径
第43届国际机器学习大会
(Konferensbidrag)
LongSpeech:用于长语音转录、翻译和理解的可扩展基准测试 [LongSpeech: A Scalable Benchmark for Transcription, Translation and Understanding in Long Speech]
ICASSP 2026 - 2026 年 IEEE 国际声学、语音和信号处理会议 (ICASSP), s. 15547-15551
(Konferensbidrag)
https://dx.doi.org/10.1109/ICASSP55912.2026.11461821
Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities
DOI: 10.18653/v1/2025.acl-long.146
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language
DOI: 10.18653/v1/2025.acl-long.1172
VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration
DOI: 10.18653/v1/2025.findings-acl.158
Shaping the Safety Boundaries: Understanding and Defending Against Jailbreaks in Large Language Models
DOI: 10.18653/v1/2025.acl-long.1233
HD-NDEs: Neural Differential Equations for Hallucination Detection in LLMs
DOI: 10.18653/v1/2025.acl-long.309
DOI: 10.18653/v1/2025.acl-long.146
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language
DOI: 10.18653/v1/2025.acl-long.1172
VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration
DOI: 10.18653/v1/2025.findings-acl.158
Shaping the Safety Boundaries: Understanding and Defending Against Jailbreaks in Large Language Models
DOI: 10.18653/v1/2025.acl-long.1233
HD-NDEs: Neural Differential Equations for Hallucination Detection in LLMs
DOI: 10.18653/v1/2025.acl-long.309