When Semantics Mislead Vision: Mitigating Large Multimodal Models Hallucinations in Scene Text Spotting and Understanding / Shu, Y., Lin, H., Liu, Y., Zhang, Y., Zeng, G., Li, Y., Zhou, Y.u., Lim, S.N., Yang, H., Sebe, N.. - (2025), pp. 68952-68980. (39th Conference on Neural Information Processing Systems (NeurIPS 2025) San Diego December 2025).

When Semantics Mislead Vision: Mitigating Large Multimodal Models Hallucinations in Scene Text Spotting and Understanding

Shu, Yan;Sebe, Nicu
2025-01-01

2025
Advances in Neural Information Processing Systems 38 (NeurIPS)
New York
Curran Associates, Inc.
Shu, Yan; Lin, Hangui; Liu, Yexin; Zhang, Yan; Zeng, Gangyan; Li, Yan; Zhou, Yu; Lim, Ser Nam; Yang, Harry; Sebe, Nicu
When Semantics Mislead Vision: Mitigating Large Multimodal Models Hallucinations in Scene Text Spotting and Understanding / Shu, Y., Lin, H., Liu, Y., Zhang, Y., Zeng, G., Li, Y., Zhou, Y.u., Lim, S.N., Yang, H., Sebe, N.. - (2025), pp. 68952-68980. (39th Conference on Neural Information Processing Systems (NeurIPS 2025) San Diego December 2025).
File in questo prodotto:
Non ci sono file associati a questo prodotto.

I documenti in IRIS sono protetti da copyright e tutti i diritti sono riservati, salvo diversa indicazione

Utilizza questo identificativo per citare o creare un link a questo documento: https://hdl.handle.net/11572/487835
 Attenzione

Attenzione! I dati visualizzati non sono stati sottoposti a validazione da parte dell'ateneo

Citazioni
  • ???jsp.display-item.citation.pmc??? ND
  • Scopus ND
  • ???jsp.display-item.citation.isi??? ND
  • OpenAlex ND
social impact