Event Extraction in Large Language Model
2025/12/22 by Li, Bobo, Han, Xudong, Liu, Jiang +11
#Computation and Language (cs.CL) #FOS: Computer and information sciences
paper · doi:10.48550/arxiv.2512.19537
Abstract
Large language models (LLMs) and multimodal LLMs are changing event extraction (EE): prompting and generation can often produce structured outputs in zero shot or few shot settings. Yet LLM based pipelines face deployment gaps, including hallucinations under weak constraints, fragile temporal and causal linking over long contexts and across documents, and limited long horizon knowledge management within a bounded context window. We argue that EE should be viewed as a system component that provides a cognitive scaffold for LLM centered solutions. Event schemas and slot constraints create interfaces for grounding and verification; event centric structures act as controlled intermediate representations for stepwise reasoning; event links support relation aware retrieval with graph based RAG; and event stores offer updatable episodic and agent memory beyond the context window. This survey covers EE in text and multimodal settings, organizing tasks and taxonomy, tracing method evolution from rule based and neural models to instruction driven and generative frameworks, and summarizing formulations, decoding strategies, architectures, representations, datasets, and evaluation. We also review cross lingual, low resource, and domain specific settings, and highlight open challenges and future directions for reliable event centric systems. Finally, we outline open challenges and future directions that are central to the LLM era, aiming to evolve EE from static extraction into a structurally reliable, agent ready perception and memory layer for open world systems.
Citations
- Qwen3-VL Technical Report
- Explicit and Implicit Data Augmentation for Social Event Detection
- Adverse Event Extraction from Discharge Summaries: A New Dataset, Annotation Scheme, and Initial Findings
- Retrieval-Enhanced Few-Shot Prompting for Speech Event Extraction
- SEOE: A Scalable and Reliable Semantic Evaluation Framework for Open Domain Event Detection
- Sherlock: Towards Multi-scene Video Abnormal Event Extraction and Localization via a Global-local Spatial-sensitive LLM
- Instruction-Tuning LLMs for Event Extraction with Annotation Guidelines
- LegalCore: A Dataset for Event Coreference Resolution in Legal Documents
- MAQInstruct: Instruction-based Unified Event Relation Extraction
- M3D: A Multimodal, Multilingual and Multitask Dataset for Grounded Document-level Information Extraction
- Situational Scene Graph for Structured Human-centric Situation Understanding
- GPT-4o System Card
- SPEED++: A Multilingual Event Extraction Framework for Epidemic Prediction and Preparedness
- Explicit, Implicit, and Scattered: Revisiting Event Extraction to Capture Complex Arguments
- RUIE: Retrieval-based Unified Information Extraction using Large Language Model
- SpeechEE: A Novel Benchmark for Speech Event Extraction
- Graph Retrieval-Augmented Generation: A Survey
- wav2graph: A Framework for Supervised Learning Knowledge Graph from Speech
- Event-Arguments Extraction Corpus and Modeling using BERT for Arabic
- ACES: Automatic Cohort Extraction System for Event-Stream Datasets
- Debate as Optimization: Adaptive Conformal Prediction and Diverse Retrieval for Event Extraction
- MMUTF: Multimodal Multimedia Event Argument Extraction with Unified Template Filling
- Generalized Event Cameras
- Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
- Generating Harder Cross-document Event Coreference Resolution Datasets using Metaphoric Paraphrasing
- DEGAP: Dual Event-Guided Adaptive Prefixes for Templated-Based Event Argument Extraction with Slot Querying
- Towards Better Question Generation in QA-based Event Extraction
- ADELIE: Aligning Large Language Models on Information Extraction
- Double Mixture: Towards Continual Event Detection from Speech
- CMNEE: A Large-Scale Document-Level Event Extraction Dataset based on Open-Source Chinese Military News
- Event Extraction in Basque: Typologically motivated Cross-Lingual Transfer-Learning Analysis
- GenEARL: A Training-Free Generative Framework for Multimodal Event Argument Role Labeling
- Generating Uncontextualized and Contextualized Questions for Document-Level Event Argument Extraction
- Event Detection from Social Media for Epidemic Prediction
- A Novel Corpus of Annotated Medical Imaging Reports and Information Extraction Results Using BERT-based Language Models
- A Semantic Mention Graph Augmented Model for Document-Level Event Argument Extraction
- KnowCoder: Coding Structured Knowledge into LLMs for Universal Information Extraction
- Improving Event Definition Following For Zero-Shot Event Detection
- Towards Event Extraction from Speech with Contextual Clues
- ULTRA: Unleash LLMs' Potential for Event Argument Extraction through Hierarchical Modeling and Pair-wise Self-Refinement
- UMIE: Unified Multimodal Information Extraction with Instruction Tuning
- ViStruct: Visual Structural Knowledge Extraction via Curriculum Guided Code-Vision Representation
- TextEE: Benchmark, Reevaluation, Reflections, and Future Challenges in Event Extraction
- LLMs Learn Task Heuristics from Demonstrations: A Heuristic-Driven Prompting Strategy for Document-Level Event Argument Extraction
- A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions
- CRAB: Assessing the Strength of Causal Relationships Between Real-world Events
- TIMELINE: Exhaustive Annotation of Temporal Relations Supporting the Automatic Ordering of Events in News Articles
- Continual Event Extraction with Semantic Confusion Rectification
- Improving Large Language Models in Event Relation Logical Prediction
- Guideline Learning for In-context Information Extraction
- Enhancing Document-level Event Argument Extraction with Contextual Clues and Role Relevance
- GoLLIE: Annotation Guidelines improve Zero-Shot Information-Extraction
- LEEC: A Legal Element Extraction Dataset with an Extensive Domain-Specific Label System
- OmniEvent: A Comprehensive, Fair, and Easy-to-Use Toolkit for Event Understanding
- Constructing Holistic Spatio-Temporal Scene Graph for Video Semantic Role Labeling
- XNLP: An Interactive Demonstration System for Universal Structured NLP
- Event Extraction as Question Generation and Answering
- CollabKG: A Learnable Human-Machine-Cooperative Information Extraction Toolkit for (Event) Knowledge Graph Construction
- Training Multimedia Event Extraction With Generated Images and Captions
- Revisiting Event Argument Extraction: Can EAE Models Learn Better When Being Aware of Event Co-occurrences?
- Extensive Evaluation of Transformer-based Architectures for Adverse Drug Events Extraction
- An AMR-based Link Prediction Approach for Document-level Event Argument Extraction
- AMPERE: AMR-Aware Prefix for Generation-Based Event Argument Extraction Model
- STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
- Leveraging Open Information Extraction for More Robust Domain Transfer of Event Trigger Detection
- Coarse-to-Fine Contrastive Learning in Image-Text-Graph Space for Improved Vision-Language Compositionality
- MAILEX: Email Event and Argument Extraction
- BioDEX: Large-Scale Biomedical Adverse Drug Event Extraction for Real-World Pharmacovigilance
- InstructIE: A Bilingual Instruction-based Information Extraction Dataset
- Multilingual Event Extraction from Historical Newspaper Adverts
- Massively Multi-Lingual Event Understanding: Extraction, Visualization, and Search
- Evaluating ChatGPT's Information Extraction Capabilities: An Assessment of Performance, Explainability, Calibration, and Faithfulness
- InstructUIE: Multi-task Instruction Tuning for Unified Information Extraction
- LED: A Dataset for Life Event Extraction from Dialogs
- Visual Instruction Tuning
- LasUIE: Unifying Information Extraction with Latent Adaptive Structure-aware Generative Language Model
- Generative Agents: Interactive Simulacra of Human Behavior
- GLEN: General-Purpose Event Detection for Thousands of Types
- GPT-4 Technical Report
- ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT
- Event Temporal Relation Extraction with Bayesian Translational Model
- Event Causality Extraction with Event Argument Correlations
- VASR: Visual Analogies of Situation Recognition
- Robust Speech Recognition via Large-Scale Weak Supervision
- Retrieval-Augmented Generative Question Answering for Event Argument Extraction
- MAVEN-ERE: A Unified Large-scale Dataset for Event Coreference, Temporal, Causal, and Subevent Relation Extraction
- MINION: a Large-Scale and Diverse Dataset for Multilingual Event Detection
- MEE: A Novel Multilingual Event Extraction Dataset
- Efficient Zero-shot Event Extraction with Context-Definition Alignment
- Video Event Extraction via Tracking Visual States of Arguments
- Open-Vocabulary Argument Role Prediction for Event Extraction
- Title2Event: Benchmarking Open Event Extraction with a Large-scale Chinese Title Dataset
- Code4Struct: Code Generation for Few-Shot Event Structure Prediction
- PHEE: A Dataset for Pharmacovigilance Event Extraction from Text
- Do Vision-and-Language Transformers Learn Grounded Predicate-Noun Dependencies?
- Grounded Video Situation Recognition
- Towards Relation Extraction From Speech
- Ambiguous Images With Human Judgments for Robust Visual Event Classification
- Few-Shot Document-Level Event Argument Extraction
- OneEE: A One-Stage Framework for Fast Overlapping and Nested Event Extraction
- A Multi-Format Transfer Learning Model for Event Argument Extraction via Variational Information Bottleneck
- DICE: Data-Efficient Clinical Event Extraction with Generative Models
- Beyond Grounding: Extracting Fine-Grained Event Hierarchies Across Modalities
- RAAT: Relation-Augmented Attention Transformer for Relation Modeling in Document-Level Event Extraction
- GENEVA: Benchmarking Generalizability for Event Argument Extraction with Hundreds of Event Types and Argument Roles
- DeepStruct: Pretraining of Language Models for Structure Prediction
- Few-Shot Document-Level Relation Extraction
- A Two-Stream AMR-enhanced Model for Document-level Event Argument Extraction
- Collaborative Transformers for Grounded Situation Recognition
- Unified Structure Generation for Universal Information Extraction
- LEVEN: A Large-Scale Chinese Legal Event Detection Dataset
- Multilingual Generative Language Models for Zero-Shot Cross-Lingual Event Argument Extraction
- Prompt for Extraction? PAIE: Prompting Argument Interaction for Event Argument Extraction
- BNAI, NO-TOKEN, and MIND-UNITY: Pillars of a Systemic Revolution in Artificial Intelligence
- DeepKE: A Deep Learning Based Knowledge Extraction Toolkit for Knowledge Base Population
- Grounded Situation Recognition with Transformers
- Query and Extract: Refining Event Extraction as Type-oriented Binary Decoding
- Joint Multimedia Event Extraction from Video and Article
- Language Model Priming for Cross-Lingual Event Extraction
- DEGREE: A Data-Efficient Generation-Based Event Extraction Model
- CasEE: A Joint Learning Framework with Cascade Decoding for Overlapping Event Extraction
- Video Swin Transformer
- Text2Event: Controllable Sequence-to-Structure Generation for End-to-end Event Extraction
- Visualization Techniques to Enhance Automated Event Extraction
- Document-level Event Extraction via Heterogeneous Graph-based Interaction Model with a Tracker
- CLEVE: Contrastive Pre-training for Event Extraction
- OntoED: Low-resource Event Detection with Ontology Embedding
- ExcavatorCovid: Extracting Events and Relations from Text Corpora for Temporal and Causal Analysis for COVID-19
- Document-Level Event Argument Extraction by Conditional Generation
- WEC: Deriving a Large-scale Cross-document Event Coreference dataset from Wikipedia
- Visual Semantic Role Labeling for Video Understanding
- Financial Document Causality Detection Shared Task (FinCausal 2020)
- Generalizing Cross-Document Event Coreference Resolution Across Multiple\n Corpora
- Event Detection: Gate Diversity and Syntactic Importance Scoresfor Graph Convolution Neural Networks
- Graph Transformer Networks with Syntactic and Semantic Structures for Event Argument Extraction
- Joint Constrained Learning for Event-Event Relation Extraction
- GATE: Graph Attention Transformer Encoder for Cross-lingual Relation and Event Extraction
- COMET: A Neural Framework for MT Evaluation
- Domain Knowledge Empowered Structured Neural Net for End-to-End Event Temporal Relation Extraction
- wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations
- Language Models are Few-Shot Learners
- Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks
- Document-Level Event Role Filler Extraction using Multi-Granularity Contextualized Encoding
- Cross-media Structured Common Space for Multimedia Event Extraction
- MAVEN: A Massive General Domain Event Detection Dataset
- Event Extraction by Answering (Almost) Natural Questions
- BLEURT: Learning Robust Metrics for Text Generation
- Grounded Situation Recognition
- Multi-Sentence Argument Linking
- BART: Denoising Sequence-to-Sequence Pre-training for Natural Language\n Generation, Translation, and Comprehension
- Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer
- Entity, Relation, and Event Extraction with Contextualized Span\n Representations
- Joint Event and Temporal Relation Extraction with Shared Representations and Structured Prediction
- Open Event Extraction from Online Text using a Generative Adversarial Network
- RoBERTa: A Robustly Optimized BERT Pretraining Approach
- SpanBERT: Improving Pre-training by Representing and Predicting Spans
- Revisiting Joint Modeling of Cross-document Entity and Event Coreference Resolution
- Context awareness and embedding for biomedical event extraction
- BERTScore: Evaluating Text Generation with BERT
- Doc2EDAG: An End-to-End Document-level Framework for Chinese Financial Event Extraction
- SlowFast Networks for Video Recognition
- One for All: Neural Joint Modeling of Entities and Events
- Semi-Supervised Event Extraction with Paraphrase Clusters
- Graph-Based Decoding for Event Sequencing and Coreference Resolution
- End-to-end named entity extraction from speech
- A Multi-Axis Annotation Scheme for Event Temporal Relations
- Scale Up Event Extraction Learning via Automatic Training Data Generation
- TAMU at KBP 2017: Event Nugget Detection and Coreference Resolution
- Situation Recognition with Graph Neural Networks
- Quo Vadis, Action Recognition? A New Model and the Kinetics Dataset
- Recurrent Models for Situation Recognition
- Commonly Uncommon: Semantic Sparsity in Situation Recognition
- Deep Residual Learning for Image Recognition
- Deep Speech 2: End-to-End Speech Recognition in English and Mandarin
- Faster R-CNN: Towards Real-Time Object Detection with Region Proposal\n Networks
- Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks
- Very Deep Convolutional Networks for Large-Scale Image Recognition
- ImageNet Large Scale Visual Recognition Challenge
- Extracting Temporal and Causal Relations between Events
- Efficient Estimation of Word Representations in Vector Space
- BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding
Related