MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework
2023/08/01 by Sirui Hong, Hong, Sirui, Mingchen Zhuge +27 · 3 voices · 316 citations
Computer Science · #Multi-Agent Systems and Negotiation #Speech and dialogue systems #Natural Language Processing Techniques
paper · pdf · doi:10.48550/arxiv.2308.00352
Abstract
Remarkable progress has been made on automated problem solving through societies of agents based on large language models (LLMs). Existing LLM-based multi-agent systems can already solve simple dialogue tasks. Solutions to more complex tasks, however, are complicated through logic inconsistencies due to cascading hallucinations caused by naively chaining LLMs. Here we introduce MetaGPT, an innovative meta-programming framework incorporating efficient human workflows into LLM-based multi-agent collaborations. MetaGPT encodes Standardized Operating Procedures (SOPs) into prompt sequences for more streamlined workflows, thus allowing agents with human-like domain expertise to verify intermediate results and reduce errors. MetaGPT utilizes an assembly line paradigm to assign diverse roles to various agents, efficiently breaking down complex tasks into subtasks involving many agents working together. On collaborative software engineering benchmarks, MetaGPT generates more coherent solutions than previous chat-based multi-agent systems. Our project can be found at https://github.com/geekan/MetaGPT
Cited by
- From Proprietary to Open-Source: Bridging the Distribution Gap via Multi-Agent Protocol Distillation in Agentic Search
- InteractComp: Evaluating Search Agents With Ambiguous Queries
- PoCEvolve: Generating Proof-of-Concept Exploits from Security Patches with Vulnerability-Aware Prompt Evolution
- Multi-Head Latent Control: A Unified Interface for LLM Agent Decision Making
- Compile, Then Page: Executable SOP Programs and a Capability-Gated Runtime for Procedural LLM Agents
- pAI-Econ-claude: A Gated Human-in-the-Loop Multi-Agent Architecture for AI-Assisted Economic Theory Development
- TriAgent: Divergence-Aware Multi-Agent Committees for Cost-Efficient Financial Sentiment Analysis
- PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents
- In-the-Flow Agentic System Optimization for Effective Planning and Tool Use
- When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines
- SAGA: Scene-Aware, Goal-Evolving Agents for Long-Horizon Strategy Game Planning
- Learning, Reasoning, Refinement: A Framework for Kahneman's Dual-System Intelligence in GUI Agents
- FlashRT: Agent Harness for Guiding Agents to Deploy Real-Time Multimodal Applications
- AgentJet: A Distributed Swarm Training Framework for Agentic Reinforcement Learning
- Bridging the Last Mile of Circuit Design: PostEDA-Bench, a Hierarchical Benchmark for PPA Convergence and DRC Fixing
- Learning Latency-Aware Orchestration for Multi-Agent Systems
- HACO: Hedged Agent Computing for Reliable LLM Systems
- RoboHarness: Memory-Driven Orchestration of Heterogeneous Robot Policies for Long-Horizon Planning
- The Story Shapes the Agent: Narrative Priors in LLM Behavior
- From Multi-Agent to Single-Agent: When Is Skill Distillation Beneficial?
- A Diagnostic Framework for AI Agent Behavior
- Agentic ERP: Multi-Agent Large Language Model Architecture for Autonomous Enterprise Resource Planning
- When LLMs Over-Answer: Measuring and Mitigating Quality Issues in LLM-Based Hardware Description Language Question Answering
- ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog
- Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios
- When Do Multi-Agent Systems Help? An Information Bottleneck Perspective
- Nonuniformity Principle in Human-AI Coworking
- Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports
- Beyond Generalist LLMs: Specialist Agentic Systems for Structured Code Workflow Execution
- AgentWorm: Self-Propagating Attacks Across LLM Agent Ecosystems
- A hierarchical memory architecture overcomes context limits in long-horizon multi-agent computational modeling
- ANet Patu-1: The Value of Connection in the Agent Network
- SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration
- ExecuGraph: A Multi-Agent, Execution-Grounded Framework for Reliable Backend Code Synthesis with Large Language Models
- OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining
- AINTMA: Agentic AI Architecture for Autonomous Test Management with Generative Intelligence, Secure Cloud Communication and Adaptive Quality Analytics
- Semantic Cooperative Games for Contribution Attribution in LLM-Based Multi-Agent Systems
- OpenEvoShield: Dual Non-Stationary Continual Defense for Open-World Multi-Agent System Attacks
- PlanFlip: Attacking Multi-Agent LLM Systems via Planning-Phase Prompt Injection
- From Agent Failure Paths to Quantified Residual Risk: A Compositional Framework for Resilient Agentic AI
- Constraint Decay: The Fragility of LLM Agents in Backend Code Generation
- Dive into Claude Code: The Design Space of Today's and Future AI Agent Systems
- Language Model Teams as Distributed Systems
- Echoing: Identity Failures when LLM Agents Talk to Each Other
- Huxley-Gödel Machine: Human-Level Coding Agent Development by an Approximation of the Optimal Self-Improving Machine
- Emergent Coordination in Multi-Agent Language Models
- Magentic-UI: Towards Human-in-the-loop Agentic Systems
- Paper2Code: Automating Code Generation from Scientific Papers in Machine Learning
- How malicious AI swarms can threaten democracy
- A Survey of AI Agent Protocols
- Do Large Language Models Solve the Problems of Agent-Based Modeling? A Critical Review of Generative Social Simulations
- Aetheria: A multimodal interpretable content safety framework based on multi-agent debate and collaboration
- Multi-Agent Teams Hold Experts Back
- AI4Reading: Chinese Audiobook Interpretation System Based on Multi-Agent Collaboration
- MOSS: Self-Evolution through Source-Level Rewriting in Autonomous Agent Systems
- NERFIFY: A Multi-Agent Framework for Turning NeRF Papers into Code
- Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback
- The Cost of Knowing: A Resource-Aware Protocol for Benchmarking Hallucination Beyond Static Leaderboards
- State-dependent error correlations shape voting thresholds in committees of AI agents
- Focus Is All You Need: Adaptive Goal-aware Attention Orchestration for Multi-Agent Graph Systems
- Agent Team Work Zone: An Automated, Persistent Workspace for Long-Lived Claude Code Agent Teams
- Beyond Sequential Interaction: Benchmarking Parallel Execution and Coordination for GUI Agents
- A Vocabulary for Multi-Agent Automated Research Systems
- When Coordination Is Avoidable: A Monotonicity Analysis of Organizational Tasks
- HeraSys: Collaborative Serving of Multiple LLM Workflows via Fine-Grained End-to-End Optimization
- TrajAudit: Automated Failure Diagnosis for Agentic Coding Systems
- Analyzing Code Injection Attacks on LLM-based Multi-Agent Systems in Software Development
- MoRAgent: Parameter Efficient Agent Tuning with Mixture-of-Roles
- A Plan Reuse Mechanism for LLM-Driven Agent
- Policy-Conditioned Policies for Multi-Agent Task Solving
- MemEvolve: Meta-Evolution of Agent Memory Systems
- Multi-Agent LLM Committees for Autonomous Software Beta Testing
- AMUSE: Audio-Visual Benchmark and Alignment Framework for Agentic Multi-Speaker Understanding
- Artism: AI-Driven Dual-Engine System for Art Generation and Critique
- Beyond Training: Enabling Self-Evolution of Agents with MOBIMEM
- AutoFSM: A Multi-agent Framework for FSM Code Generation with IR and SystemC-Based Testing
- FutureWeaver: Planning Test-Time Compute for Multi-Agent Systems with Modularized Collaboration
- Argus: A Multi-Agent Sensitive Information Leakage Detection Framework Based on Hierarchical Reference Relationships
- Towards a Science of Scaling Agent Systems
- CFD-copilot: leveraging domain-adapted large language model and model context protocol to enhance simulation automation
- TDAG: A multi-agent framework based on dynamic Task Decomposition and Agent Generation
- DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
- The Missing Layer of AGI: From Pattern Alchemy to Coordination Physics
- The Road of Adaptive AI for Precision in Cybersecurity
- The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems
- Orchestrator Multi-Agent Clinical Decision Support System for Secondary Headache Diagnosis in Primary Care
- SRPG: Semantically Reconstructed Privacy Guard for Zero-Trust Privacy in Educational Multi-Agent Systems
- From static to adaptive: immune memory-based jailbreak detection for large language models
- Enhancing Automated Paper Reproduction via Prompt-Free Collaborative Agents
- Decentralized Multi-Agent System with Trust-Aware Communication
- Agent-Kernel: A MicroKernel Multi-Agent System Framework for Adaptive Social Simulation Powered by LLMs
- Transforming Monolithic Foundation Models into Embodied Multi-Agent Architectures for Human-Robot Collaboration
- Latent Collaboration in Multi-Agent Systems
- Agint: Agentic Graph Compilation for Software Engineering Agents
- Human-Centric Open-Future Task Discovery: Formulation, Benchmark, and Scalable Tree-Based Search
- VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning
- DiscoVerse: Multi-Agent Pharmaceutical Co-Scientist for Traceable Drug Discovery and Reverse Translation
- LLMs as Firmware Experts: A Runtime-Grown Tree-of-Agents Framework
- ToC: Tree-of-Claims Search with Multi-Agent Language Models
- Optimizing PyTorch Inference with LLM-Based Multi-Agent Systems
- MURMUR: Using cross-user chatter to break collaborative language agents in groups
- AutoTool: Efficient Tool Selection for Large Language Model Agents
- Co-Layout: LLM-driven Co-optimization for Interior Layout
- From Natural Language to Certified H-infinity Controllers: Integrating LLM Agents with LMI-Based Synthesis
- Bridging the Prototype-Production Gap: A Multi-Agent System for Notebooks Transformation
- AUTO-Explorer: Automated Data Collection for GUI Agent
- PRAGMA: A Profiling-Reasoned Multi-Agent Framework for Automatic Kernel Optimization
- FLEX: Continuous Agent Evolution via Forward Learning from Experience
- Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
- Catching Contamination Before Generation: Spectral Kill Switches for Agents
- Multi-Agent Collaborative Framework For Math Problem Generation
- Trustworthy LLM-Mediated Communication: Evaluating Information Fidelity in LLM as a Communicator (LAAC) Framework in Multiple Application Domains
- A Hierarchical Multi-Agent System for Autonomous Discovery in Geoscientific Data Archives
- PublicAgent: Multi-Agent Design Principles From an LLM-Based Open Data Analysis Framework
- Systematizing LLM Persona Design: A Four-Quadrant Technical Taxonomy for AI Companion Applications
- Modular Task Decomposition and Dynamic Collaboration in Multi-Agent Systems Driven by Large Language Models
- MARS-SQL: A multi-agent reinforcement learning framework for Text-to-SQL
- GraphGeo: Multi-Agent Debate Framework for Visual Geo-localization with Heterogeneous Graph Neural Networks
- From Evidence to Verdict: An Agent-Based Forensic Framework for AI-Generated Image Detection
- Validity Is What You Need
- The Era of Agentic Organization: Learning to Organize with Language Models
- InfoFlow: Reinforcing Search Agent Via Reward Density Optimization
- LLM-TSFD: An industrial time series human-in-the-loop fault diagnosis method based on a large language model
- RedCodeAgent: Automatic Red-teaming Agent against Diverse Code Agents
- Two Calls Beat Five Agents: Evaluating Multi-Agent Pipelines Against Self-Refinement for Local Language Models
- Flows: Building Blocks of Reasoning and Collaborating AI
- The Capability Paradox: How Smarter Auditors Make Multi-Agent Systems Less Secure
- The Moltbook Files: A Harmless Slopocalypse or Humanity's Last Experiment
- Can Current Agents Close the Discovery-to-Application Gap? A Case Study in Minecraft
- Ripple Effect Protocol: Coordinating Agent Populations
- Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook
- Artificial Organisations
- CooperBench: Why Coding Agents Cannot be Your Teammates Yet
- ProMediate: A Socio-cognitive framework for evaluating proactive agents in multi-party negotiation
- WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
- CodeWiki: Evaluating AI's Ability to Generate Holistic Documentation for Large-Scale Codebases
- PFEA: An LLM-based High-Level Natural Language Planning and Feedback Embodied Agent for Human-Centered AI
- Alita-G: Self-Evolving Generative Agent for Agent Generation
- CodeCRDT: Observation-Driven Coordination for Multi-Agent LLM Code Generation
- Multi-Stakeholder Alignment in LLM-Powered Collaborative AI Systems: A Multi-Agent Framework for Intelligent Tutoring
- Collaborative LLM Agents for C4 Software Architecture Design Automation
- SwiftSolve: A Self-Iterative, Complexity-Aware Multi-Agent Framework for Competitive Programming
- Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
- Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
- Embracing Trustworthy Brain-Agent Collaboration as Paradigm Extension for Intelligent Assistive Technologies
- Thought Communication in Multiagent Collaboration
- Build Your Personalized Research Group: A Multiagent Framework for Continual and Interactive Science Automation
- Integrating Machine Learning into Belief-Desire-Intention Agents: Current Advances and Open Challenges
- AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation
- From Specification to Service: Accelerating API-First Development Using Multi-Agent Systems
- Fetch.ai: An Architecture for Modern Multi-Agent Systems
- Enterprise Deep Research: Steerable Multi-Agent Deep Research for Enterprise Analytics
- Empowering Real-World: A Survey on the Technology, Practice, and Evaluation of LLM-driven Industry Agents
- TREAT: A Code LLMs Trustworthiness / Reliability Evaluation and Testing Framework
- ProtocolBench: Which LLM MultiAgent Protocol to Choose?
- MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs
- Adaptive Minds: Empowering Agents with LoRA-as-Tools
- IMAGINE: Integrating Multi-Agent System into One Model for Complex Reasoning and Planning
- Deflanderization for Game Dialogue: Balancing Character Authenticity with Task Execution in LLM-based NPCs
- OpenDerisk: An Industrial Framework for AI-Driven SRE, with Design, Implementation, and Case Studies
- Automated Network Protocol Testing with LLM Agents
- ResearStudio: A Human-Intervenable Framework for Building Controllable Deep-Research Agents
- A2FM: An Adaptive Agent Foundation Model for Tool-Aware Hybrid Reasoning
- DocReward: A Document Reward Model for Structuring and Stylizing
- Stronger-MAS: Multi-Agent Reinforcement Learning for Collaborative LLMs
- Automating Structural Engineering Workflows with Large Language Model Agents
- PaperArena: An Evaluation Benchmark for Tool-Augmented Agentic Reasoning on Scientific Literature
- DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis
- MedCoAct: Confidence-Aware Multi-Agent Collaboration for Complete Clinical Decision
- SLEAN: Simple Lightweight Ensemble Analysis Network for Multi-Provider LLM Coordination: Design, Implementation, and Vibe Coding Bug Investigation Case Study
- MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
- SIA: Self Improving AI with Harness & Weight Updates
- Agent Bazaar: Enabling Economic Alignment in Multi-Agent Marketplaces
- Effective Strategies for Asynchronous Software Engineering Agents
- FOR-Prompting: From Objection to Revision via an Asymmetric Prompting Protocol
- CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards
- Dynamic Generation of Multi-LLM Agents Communication Topologies with Graph Diffusion Models
- Simulating Teams with LLM Agents: Interactive 2D Environments for Studying Human-AI Dynamics
- Traceability and Accountability in Role-Specialized Multi-Agent LLM Pipelines
- AutoMLGen: Navigating Fine-Grained Optimization for Coding Agents
- Training-Free Group Relative Policy Optimization
- ProSEA: Problem Solving via Exploration Agents
- AMAS: Adaptively Determining Communication Topology for LLM-based Multi-Agent System
- Intelligent AI Delegation
- Automating Data-Driven Modeling and Analysis for Engineering Applications using Large Language Model Agents
- FURINA: A Fully Customizable Role-Playing Benchmark via Scalable Multi-Agent Collaboration Pipeline
- From Simulation to Strategy: Automating Personalized Interaction Planning for Conversational Agents
- ARM: Discovering Agentic Reasoning Modules for Generalizable Multi-Agent Systems
- Generative AI-Driven Hierarchical Multi-Agent Framework for Zero-Touch Optical Networks
- MARS: Co-evolving Dual-System Deep Research via Multi-Agent Reinforcement Learning
- Alignment Tipping Process: How Self-Evolution Pushes LLM Agents Off the Rails
- Trade in Minutes! Rationality-Driven Agentic System for Quantitative Financial Trading
- Retrieval-Augmented Code Generation: A Survey with Focus on Repository-Level Approaches
- TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
- Where Did It All Go Wrong? A Hierarchical Look into Multi-Agent Error Attribution
- AlphaApollo: Orchestrating Foundation Models and Professional Tools into a Self-Evolving System for Deep Agentic Reasoning
- Adversarial Agent Collaboration for C to Rust Translation
- AutoMaAS: Self-Evolving Multi-Agent Architecture Search for Large Language Models
- Cache-to-Cache: Direct Semantic Communication Between Large Language Models
- Homophily-induced Emergence of Biased Structures in LLM-based Multi-Agent AI Systems
- JoyAgent-JDGenie: Technical Report on the GAIA
- A Tale of LLMs and Induced Small Proxies: Scalable Small Language Models for Knowledge Mining
- Stochastic Self-Organization in Multi-Agent Systems
- CORTEX: Collaborative LLM Agents for High-Stakes Alert Triage
- The Hunger Game Debate: On the Emergence of Over-Competition in Multi-Agent Systems
- DyFlow: Dynamic Workflow Framework for Agentic Reasoning
- Flash-Searcher: Fast and Effective Web Agents via DAG-Based Parallel Execution
- Scaling Generalist Data-Analytic Agents
- From Ambiguity to Verdict: A Semiotic-Grounded Multi-Perspective Agent for LLM Logical Reasoning
- Agentic Services Computing
- MAS2: Self-Generative, Self-Configuring, Self-Rectifying Multi-Agent Systems
- PartnerMAS: An LLM Hierarchical Multi-Agent Framework for Business Partner Selection on High-Dimensional Features
- MCPMark: A Benchmark for Stress-Testing Realistic and Comprehensive MCP Use
- RADAR: A Risk-Aware Dynamic Multi-Agent Framework for LLM Safety Evaluation via Role-Specialized Collaboration
- CORRECT: COndensed eRror RECognition via knowledge Transfer in multi-agent systems
- Scaling LLM Test-Time Compute with Mobile NPU on Smartphones
- Diagnose, Localize, Align: A Full-Stack Framework for Reliable LLM Multi-Agent Systems under Instruction Conflicts
- Deceive, Detect, and Disclose: Large Language Models Play Mini-Mafia
- PRIME: Planning and Retrieval-Integrated Memory for Enhanced Reasoning
- Generalized Multi-agent Social Simulation Framework
- RobustFlow: Towards Robust Agentic Workflow Generation
- Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
- VibeCodeHPC: An Agent-Based Iterative Prompting Auto-Tuner for HPC Code Generation Using LLMs
- Eigen-1: Adaptive Multi-Agent Refinement with Monitor-Based RAG for Scientific Reasoning
- Disagreements in Reasoning: How a Model's Thinking Process Dictates Persuasion in Multi-Agent Systems
- Federation of Agents: A Semantics-Aware Communication Fabric for Large-Scale Agentic AI
- Embodied AI: From LLMs to World Models
- Scaling LLM-Driven Multi-Agent Systems: Design Principles and Architectural Scalability Analysis
- Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning
- Benchmarking Open-Ended Multi-Agent Coordination in Language Agents
- RepoTransAgent: Multi-Agent LLM Framework for Repository-Aware Code Translation
- Enhancing LLM-Based Social Bot via an Adversarial Learning Framework
- Agentic AutoSurvey: Let LLMs Survey LLMs
- Cortex: Achieving Low-Latency, Cost-Efficient Remote Data Access For LLM via Semantic-Aware Knowledge Caching
- Orchestrate, Generate, Reflect: A VLM-Based Multi-Agent Collaboration Framework for Automated Driving Policy Learning
- Towards Transparent and Incentive-Compatible Collaboration in Decentralized LLM Multi-Agent Systems: A Blockchain-Driven Approach
- RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation
- Online Multi-Robot Coordination and Cooperation with Task Precedence Relationships
- (P)rior(D)yna(F)low: A Priori Dynamic Workflow Construction via Multi-Agent Collaboration
- MICA: Multi-Agent Industrial Coordination Assistant
- Who is Introducing the Failure? Automatically Attributing Failures of Multi-Agent Systems via Spectrum Analysis
- Aegis: Automated Error Generation and Attribution for Multi-Agent Systems
- An LLM-based multi-agent framework for agile effort estimation
- Evaluating Classical Software Process Models as Coordination Mechanisms for LLM-Based Software Generation
- Crash Report Enhancement with Large Language Models: An Empirical Study
- From Language to Action: A Review of Large Language Models as Autonomous Agents and Tool Users
- EvoEmpirBench: Dynamic Spatial Reasoning with Agent-ExpVer
- Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection
- From Legacy Fortran to Portable Kokkos: An Autonomous Agentic AI Workflow
- MAPGD: Multi-Agent Prompt Gradient Descent for Collaborative Prompt Optimization
- Compartmentalised Agentic Reasoning for Clinical NLI
- Population-Aligned Persona Generation for LLM-based Social Simulation
- Development of Automated Software Design Document Review Methods Using Large Language Models
- Abduct, Act, Predict: Scaffolding Causal Inference for Automated Failure Attribution in Multi-Agent Systems
- LightAgent: Production-level Open-source Agentic AI Framework
- MCP-AgentBench: Evaluating Real-World Language Agent Performance with MCP-Mediated Tools
- AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
- EnvX: Agentize Everything with Agentic AI
- Astra: A Multi-Agent System for GPU Kernel Performance Optimization
- PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments
- World Model Implanting for Test-time Adaptation of Embodied Agents
- app.build: A Production Framework for Scaling Agentic Prompt-to-App Generation with Environment Scaffolding
- Situating AI Agents in their World: Aspective Agentic AI for Dynamic Partially Observable Information Systems
- AgentScope 1.0: A Developer-Centric Framework for Building Agentic Applications
- Aligning Requirement for Large Language Model's Code Generation
- Towards Agentic OS: An LLM Agent Framework for Linux Schedulers
- SHERPA: A Model-Driven Framework for Large Language Model Execution
- EPIC: Generative AI Platform for Accelerating HPC Operational Data Analytics
- PosterForest: Hierarchical Multi-Agent Collaboration for Scientific Poster Generation
- Re4: Scientific Computing Agent with Rewriting, Resolution, Review and Revision
- Bridging Minds and Machines: Toward an Integration of AI and Cognitive Science
- From Bits to Boardrooms: A Cutting-Edge Multi-Agent LLM Framework for Business Excellence
- Encouraging Good Processes Without the Need for Good Answers: Reinforcement Learning for LLM Agent Planning
- OmniHuman-1.5: Instilling an Active Mind in Avatars via Cognitive Simulation
- Toward Edge General Intelligence with Agentic AI and Agentification: Concepts, Technologies, and Future Directions
- AppAgent-Pro: A Proactive GUI Agent System for Multidomain Information Integration and User Assistance
- Requirements Development and Formalization for Reliable Code Generation: A Multi-Agent Vision
- Open-Universe Assistance Games
- MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers
- Exploring Autonomous Agents: A Closer Look at Why They Fail When Completing Tasks
- AgentCDM: Enhancing Multi-Agent Collaborative Decision-Making via ACH-Inspired Structured Reasoning
- CAMF: Collaborative Adversarial Multi-agent Framework for Machine Generated Text Detection
- AI Agentic Programming: A Survey of Techniques, Challenges, and Opportunities
- Allen: Rethinking MAS Design through Step-Level Policy Autonomy
- FROGENT: An End-to-End Full-process Drug Design Agent
- Agentic AI Frameworks: Architectures, Protocols, and Design Challenges
- Preacher: Paper-to-Video Agentic System
- MVISU-Bench: Benchmarking Mobile Agents for Real-World Tasks by Multi-App, Vague, Interactive, Single-App and Unethical Instructions
- Cowpox: Towards the Immunity of VLM-based Multi-Agent Systems
- BrowseMaster: Towards Scalable Web Browsing via Tool-Augmented Programmatic Agent Pair
- Chimera: Harnessing Multi-Agent LLMs for Automatic Insider Threat Simulation
- MAViS: A Multi-Agent Framework for Long-Sequence Video Storytelling
- TeamMedAgents: Pareto-Efficient Multi-Agent Medical Reasoning Through Teamwork Theory
- Multi-agent systems for chemical engineering: A review and perspective
- EMPATHIA: Multi-Faceted Human-AI Collaboration for Refugee Integration
- VASPilot: MCP-Facilitated Multi-Agent Intelligence for Autonomous VASP Simulations
- Automated Code Development for PDE Solvers Using Large Language Models
- DRAMA: A Dynamic and Robust Allocation-based Multi-Agent System for Changing Environments
- StackPilot: Autonomous Function Agents for Scalable and Environment-Free Code Execution
- RCR-Router: Efficient Role-Aware Context Routing for Multi-Agent LLM Systems with Structured Memory
- Tree-of-Reasoning: Towards Complex Medical Diagnosis via Multi-Agent Reasoning with Evidence Tree
- HealthFlow: A Self-Evolving AI Agent with Meta Planning for Autonomous Healthcare Research
- Large Language Model-based Data Science Agent: A Survey
- BlockA2A: Towards Secure and Verifiable Agent-to-Agent Interoperability
- A Survey on Agent Workflow -- Status and Future
- Blueprint First, Model Second: A Framework for Deterministic LLM Workflow
- Multi-Agent Game Generation and Evaluation via Audio-Visual Recordings
- Semantic Chain-of-Trust: Autonomous Trust Orchestration for Collaborator Selection via Hypergraph-Aided Agentic AI
- DynaSwarm: Dynamically Graph Structure Selection for LLM-based Multi-agent System
- MetaAgent: Automatically Constructing Multi-Agent Systems Based on Finite State Machines
- An Explainable Emotion Alignment Framework for LLM-Empowered Agent in Metaverse Service Ecosystem
- MAGE: Multimodal Alignment and Generation Enhancement via Bridging Visual and Semantic Spaces
- A Multi-Agent Generative AI Framework for IC Module-Level Verification Automation
- A2HCoder: An LLM-Driven Coding Agent for Hierarchical Algorithm-to-HDL Translation
- MAAD: Automate Software Architecture Design through Knowledge-Driven Multi-Agent Collaboration
- RingMo-Agent: A Unified Remote Sensing Foundation Model for Multi-Platform and Multi-Modal Reasoning
Discussions
Related