Технологии и методы разработки систем, способных к обучению и имитации интеллектуального поведения. Начните отсюда, затем уточните подраздел для конкретного направления.


454 публикаций

Нажмите рядом со статьёй — скопируете ссылку для списка литературы по ГОСТ.

Hybrid Diffusion Transformer for Instruction-Guided Audio Editing via Rectified Flow
Sensorimotor World Models: Perception for Action via Inverse Dynamics
Dual-Agent Framework for Cross-Model Verified Translation of Natural-Language Protocols into Robotic Laboratory Platform
ScaffoldAgent: Utility-Guided Dynamic Outline Optimization for Open-Ended Deep Research
Phoenix: Safe GitHub Issue Resolution via Multi-Agent LLMs
An Infrastructure-less, Control-Independent Solution to Relative Localisation of a Team of Mobile Robots using Ranging Measurements
Contagion Networks: Evaluator Bias Propagation in Multi-Agent LLM Systems
QMFOL: Benchmarking Large Language Model Reasoning via Quantifiable Monadic First-Order Logic Test Case Generation
Thermodynamic Measure of Intelligence
ScholarQuest: A Taxonomy-Guided Benchmark for Agentic Academic Paper Search in Open Literature Environments
A Multi-Agent system for Multi-Objective constrained optimization
Intermittent Strategic Cooperation of Two Selfish Agents on Graphs
ThinkDeception: A Progressive Reinforcement Learning Framework for Interpretable Multimodal Deception Detection
TRAP: Benchmark for Task-completion and Resistance to Active Privacy-extraction
Spotlight: Synergizing Seed Exploration and Spot GPUs for DiT RL Post-Training
Reinforcement Learning Foundation Models Should Already Be A Thing
SwitchBraidNet: Quantisation-Aware Lightweight Architecture for Hybrid Brain-Computer Interface
Maturing Markov Decision Processes: Decision Making under Increasing Information and Shrinking Action Sets
Space Is Intelligence: Neural Semigroup Superposition for Riemannian Metric Generation
ProvenanceGuard: Source-Aware Factuality Verification for MCP-Based LLM Agents
Intelligence Entropy Principle and the ADE Stability Engineering Framework
On the Reliability of Networks of AI Agents: Density Evolution, Stopping Sets, and Architecture Optimization
DRFLOW: A Deep Research Benchmark for Personalized Workflow Prediction
Learning Red Agent Policy from Observations for Neurosymbolic Autonomous Cyber Agents
EvolveNav: Proactive Preflection and Self-Evolving Memory for Zero-Shot Object Goal Navigation
Large Language Models as Supervised Extraction Assistants: Lowering the Barrier to Documentation Standard Adoption in Agent-Based Modelling
Multiagent Protocols with Aggregated Confidence Signals
See What I See, Know What I Think: Dense Latent Communication Across Heterogeneous Agents
Structural Role Injection in Handlebars-Templated LLM Prompts: Triple-Brace Interpolation, Delimiter Family, and the Limits of HTML Auto-Escaping
Embedded Machine Learning for Microcontroller-Class Edge Devices: Data, Feature, Evaluation, and Deployment Pipelines
Towards Understanding and Measuring COGNITIVE ATROPHY in LLM Behaviour
Knowledge Reutilization in Meta-Reinforcement Learning
LegalHalluLens: Typed Hallucination Auditing and Calibrated Multi-Agent Debate for Trustworthy Legal AI
LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling
Catastrophic Forgetting is Low-Rank: A Function-Space Theory for Continual Adaptation
When English Isn't the Best Teacher: Source Language Effects in Cross-Lingual In-Context Learning
The Proxy Knows Too Much: Sealing LLM API Routers with Attested TEEs
Misinformation Propagation in Benign Multi-Agent Systems
Human-on-the-Bridge: Scalable Evaluation for AI Agents
Safety-Contract Graph Multi-Agent Reinforcement Learning for Autonomous Network Security Response
Decision-Weighted Flow Matching for Contextual Stochastic Optimization
Decoupling Semantics from Distortions: Multi-Scale Two-Stream Vision-Language Alignment for AI-Generated Image Quality Assessment
LabOSBench: Benchmarking Computer Use Agents for Scientific Instrument Control
Adaptive and Explicit safe: Triggering Latent Safety Awareness in Large Reasoning Models
Binary Tracking for Spatial QA and Navigation with Open Vision-Language Models
IMPACTeen: Intentions, Manipulation, Persuasion, Annotations, and Consequences in Teen Communication Dataset
Greed Is Learned: Visible Incentives as Reward-Hacking Triggers
Demystifying Variance in Circuit Discovery of LLMs
TokenPilot: Cache-Efficient Context Management for LLM Agents
FusionRS: A Large-Scale RGB-Infrared Remote Sensing Dataset for Dual-Modal Vision-Language Foundation Models
HAMON: Passive Optical Sequence Mixing for Long-Horizon Forecasting
The Importance of Phase in Neural Representations: An Internal Oppenheim-Lim Test of Image Classifiers
Kairos: A Native World Model Stack for Physical AI
The Faithfulness Gap: Certifying Semantic Equivalence Between Natural-Language and Formal Mathematical Statements
ROSA-RL: Uncertainty-Aware Roundabout Optimized Speed Advisory with Reinforcement Learning
TNODEV: Toolbox for Neural ODE Verification
Overcoming the Regulatory Bottleneck via Agent-to-Agent Protocols: A Nuclear Case Study
Selective Agentic Recovery for UAV Autonomy with a Persistent Mission Runtime
When and How Severely: Scenario-Specific Safety Envelopes for Driving VLAs
SkillAudit: Ground-Truth-Free Skill Evolution via Paired Trajectory Auditing
AFFORDANCE20Q: Evaluating Affordance Reasoning from Physical Properties
WorkBench Revisited: Workplace Agents Two Years On
Semantic Quorum Assurance: Collective Certification for Non-Deterministic AI Infrastructure
Elastic Queries Reinforcement Learning: Self-Aware Policy Execution for VLA Models
Discovery under Hypothesis Redundancy: A Geometric Theory of Discovery Bottlenecks
Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack
Naive Visual Memory is Not Enough: A Failure-Mode Study of GUI Agents
Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning
CottonLeafVision: An Explainable and Robust Deep Learning Framework for Cotton Leaf Disease Classification
Flood and Harvest: The Provable Necessity of Trivia for Generating Valuable Mathematics via the Lens of Language Generation in the Limit
Learning Coordinated Preference for Multi-Objective Multi-Agent Reinforcement Learning
Rethinking Global Average Pooling: Your Classifier Is Secretly a Multi-Instance Learner
Regional Climate Model Emulation with Diffusion Approaches: What is the Added Value of Generative Machine Learning?
StreamMemBench: Streaming Evaluation of Agent Memory for Future-Oriented Assistance
SIMMER: Benchmarking Latent Failures in LLM Executable Planning with a World Model
SkillAxe: Sharpening LLM-Authored Agent Skills Through Evaluation-Guided Self-Refinement
Multi-agent rendezvous in fluid flows via reinforcement learning
Contrast-Informed Augmentation and Domain-Adversarial Training for Adult-to-Neonatal MR Reconstruction Generalization
A Three-Layer Framework for AI in Scientific Discovery
ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages
Decentralized Multi-Agent Systems with Shared Context
Automated reproducibility assessments in the social and behavioral sciences using large language models
SpatialClaw: Rethinking Action Interface for Agentic Spatial Reasoning
OKCFTr: Translators for Knowledge Reuse
Reward Modeling for Multi-Agent Orchestration
Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch
Beyond Runtime Enforcement: Shield Synthesis as Defensibility Analysis for Adversarial Networks
Tuning Agent-Based Predator-Prey Models Toward Lotka-Volterra Dynamics
Mod-Guide: An LLM-based Content Moderation Feedback System to Address Insensitive Speech toward Indigenous Ethnic and Religious Minority Communities
Neuro-Symbolic Agents for Regulated Process Automation: Challenges and Research Agenda
Optimizing Appliance Scheduling for Solar Energy Management Using Metaheuristic Algorithms
Benchmarking Open-Ended Multi-Agent Coordination in Language Agents
Co-GLANCE: Uncertainty-Aware Active Perception for Heterogeneous Robot Teaming
From Verdict to Process: Agentic Reinforcement Learning for Multi-Stage Fact Verification
Different Layers, Different Manifolds: Module-Wise Weight-Space Geometry in Transformer Optimization
ERTS: Adversarial Robustness Testing of Ethical AI via Semantic Perturbation in a Bounded Consequence Space
Once-for-All: Scalable Simultaneous Forecasting via Equilibrium State Estimation
Is Telehealth Better Used to Treat Patients or Help Other Physicians Treat Patients? An Agent-Based Modeling Study of Healthcare Provision
RAILS: Verification-Native Clearing For Agentic Commerce
PerspectiveGap: A Benchmark for Multi-Agent Orchestration Prompting
Reroute, Don't Remove: Recoverable Visual Token Routing for Vision-Language Models
Beyond Goodhart's Law: A Dynamic Benchmark for Evaluating Compliance in Multi-Agent Systems
Sovereign Assurance Boundary: Certificate-Bound Admission for Agentic Infrastructure
Automating Geometry-Intensive Compliance Checking in BIM: Graph-Based Semantic Reasoning Framework
GRPO Does Not Close the Multi-Agent Coordination Gap
Lung-SRAD: Spectral-Aware Regularized Audio DASS with Dual-Axis Patch-Mix Contrastive Learning for Respiratory Sound Classification
Toward Generalist Autonomous Research via Hypothesis-Tree Refinement
Categorical Prior Lock-in: Why In-Context Learning Fails for Structured Data
Bridging the Morphology Gap: Adapting VLA Models to Dexterous Manipulation via Intent-Conditioned Fine-Tuning
Augmenting Molecular Language Models with Local $n$-gram Memory
Soft-Prompt Tuning for Fair and Efficient LLM Benchmark Evaluation
Unstable Features, Reproducible Subspaces: Understanding Seed Dependence in Sparse Autoencoders
Editorial Intelligent Help Systems for UNIX: Planning and Knowledge Representation
The Three-Ring Architecture: Governing Agents in the Era of On-Platform Organisations
Recoverable but Not Stationary:Local Linear Structures in Weights and Activations
Frontier Coding Agents Use Metaprogramming to Adapt to Unfamiliar Programming Languages
WorldKernel: A World Model is the Coupling Kernel of Admissible Possible Worlds
Beyond APIs: Probing the Limits of MLLMs in Physical Tool Use
Moonshine: An Autonomous Mathematical Research Agent Centered on Conjecture Generation
Earth-OneVision: Extending Remote Sensing Multimodal Large Language Models to More Sensor Modalities and Tasks
K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling
AHA-WAM:Asynchronous Horizon-Adaptive World-Action Modeling with Observation-Guided Context Routing
OmniGameArena: A Unified UE5 Benchmark for VLM Game Agents with Improvement Dynamics
Autonomous Incident Resolution at Hyperscale: An Agentic AI Architecture for Network Operations
Performance Evaluation of Social Learning
Revisiting mesoscopic traffic flow simulation in SUMO: Limitations, analysis, and an alternative
TheoremBench: Evaluating LLMs on Theorem Proving in Formal Mathematics
A Finetuned SpeechLLM for Joint Multi-Granular L2 Assessment and Natural-Language Rationales
Emergent alignment and the projectability of ethical personas
Memory Beyond Recall: A Dual-Process Cognitive Memory System for Self-Evolving LLM Agents
Seeing the Hivemind: A Consensus-Aware Interaction Technique for Mitigating AI Homogenization
I Was Scrolling and Then I Saw a Pregnant Strawberry
Next-Token Prediction Learns Generalisable Representations of Sleep Physiology
Closure-Validated Circuit Discovery in Attention Heads: Co-activation Proposes, Ablation Disposes
(Auto)formalization is supposed to be easy: Trellis process semantics for spelling out rigorous proofs
MeCo: One-Step MeanFlow-based Corrector for Multi-Channel Speech Separation
An 84-Format Numeric Catalog with Bit-Exact Conformance Vectors: A Vendor-Neutral Reference for FP8, BF16, MXFP4, and Microscaling Formats
Observability for Delegated Execution in Agentic AI Systems
Emergence World: A Platform for Evaluating Long-Horizon Multi-Agent Autonomy
SceneConductor: 3D Scene Generation from Single Image with Multi-Agent Orchestration
The Consistency Illusion: How Multi-Agent Debate Hides Reasoning Misalignment
Quantitative Promise Theory: Intentionality and Inference in Autonomous Agents
RAMPART: Registry-based Agentic Memory with Priority-Aware Runtime Transformation
R-APS: Compositional Reasoning and In-Context Meta-Learning for Constrained Design via Reflective Adversarial Pareto Search
Channel Fracture: Architectural Blind Spots in Scheduled Cross-Agent Memory Injection for Multi-Agent Orchestration Systems
Learning Multi-Agent Communication Protocol: Study on Information Entropy Efficiency in MARL
Hierarchical Certified Semantic Commitment for Byzantine-Resilient LLM-Agent Collaboration
Towards Unified Song Generation and Singing Voice Conversion with Accompaniment Co-Generation
The Sim-to-Real Gap of Foundation Model Agents: A Unified MDP Perspective
StainFlow: Entity-Stain Tracking and Evidence Linking for Process Rewards in GUI Agents
Phonetic Error Analysis of Raw Waveform Acoustic Models
From Global Policies to Local Strategies: Multi-Objective Optimization of Resource-Specific Handover Policies
Twelve quick tips for designing AI-driven HPC workflows
Sparse Subspace-to-Expert Sharing for Task-Agnostic Continual Learning
REMEDI: A Benchmark for Retention and Unlearning Evaluation in Multi-label Clinical Disease Inference
Think Fast: Estimating No-CoT Task-Completion Time Horizons of Frontier AI Models
UrduMMLU: A Massive Multitask Benchmark for Urdu Language Understanding
AUDITFLOW: Executable Symbolic Environments for Structured Financial Reporting Verification
Capability Advertisement as a Market for Lemons: A Trust Layer for Heterogeneous Agent Networks
ModuLoop : Low-Level Code Generation using Modular Synthesizer and Closed-Loop Debugger for Robotic Control
SPOQ: Specialist Orchestrated Queuing for Multi-Agent Software Engineering
A Temporal Spatial Minimax Rate for Smoothly-Varying Distributions in Wasserstein Space
SleepExplain: Explainable Non-Rapid Eye Movement and Rapid Eye Movement Sleep Stage Classification from EEG Signal
A robust PPG foundation model using multimodal physiological supervision
Mitosis Detection in the Wild: Multi-Tumor and Context-Aware Generalization in the MIDOG 2025 Challenge
Unsupervised Skill Discovery for Agentic Data Analysis
Emergent Language as an Approach to Conscious AI
Humans' ALMANAC: A Human Collaboration Dataset of Action-Level Mental Model Annotations for Agent Collaboration
HomeWorld: A Unified Floorplan-to-Furnished Framework for Generating Controllable, Densely Interactive Whole-Home Scenes
Risk Assessment of Autonomous Driving: Integrating Technical Failures, Ethical Dilemmas, and Policy Frameworks
LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs
Towards One-to-Many Temporal Grounding
Multi-ResNets for Subspace Preconditioning in Constrained Optimization
Plug-and-Play Guidance for Discrete Diffusion Models via Gradient-Informed Logit Correction
The Ringelmann Effect in Multi-Agent LLM Systems: A Scaling Law for Effective Team Size
LLM Consortium for Software Design Refinement: A Controlled Experiment on Multi-Agent Collaboration Topologies
Design of Knowledge Map Representation Learning Algorithm Based on Artificial Neural Network
Unsupervised Pattern Analysis in Japanese Veterinary Toxicology: A Regulatory-Compliant Framework for Cross-Species Risk Assessment
Evaluating Agentic Configuration Repair for Computer Networks
Towards the Readability of LLM-Generated Codes through Multitask Representation Engineering
DisasterBench: A Multimodal Benchmark for UAV-Based Disaster Response in Complex Environments
Democracy on Rugged Landscapes: Phase Transitions in Optimal Voting Rules
Self-Regulation through Communication in Evolved Neural Agents
A formal definition and meta-model for a machine theory of mind
D2MDT: Department-aware Multidisciplinary Team Consultation with Deliberation for Efficient Clinical Prediction
On dynamic multi-agent pathfinding methods: review, simulations and modifications
Regret Minimization with Adaptive Opponents in Repeated Games
TempoVLA: Learning Speed-Controllable Vision-Language-Action Policies
Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution
HANDOFF: Humanoid Agentic Task-Space Whole-Body Control via Distilled Complementary Teachers
Failed Reasoning Traces Tell You What Is Fixable (But Not by Reading Them)
Multi-Column RBF Neural Network Using Adaptive and Non-Adaptive Particle Swarm Optimization
Reinforcement Learning from Rich Feedback with Distributional DAgger
Streaming Communication in Multi-Agent Reasoning
Contents
From Control Boundary to Insurance Claim: Reconstructing AI-Mediated Losses Through the CER Framework
Signed Spiking Neuron Enabled by an Orthogonal-Easy-Axis Magnetic Tunnel Junction
Trading Human Curation for Synthetic Augmentation in RLVR
CoEval: Ranking Language Models for Custom Tasks Without Labeled Data or Trustworthy Benchmarks
Towards Non-Monotonic Entailment in Propositional Defeasible Standpoint Logic
Diagnosing Knowledge Gaps in LLM Tool Use: An Agentic Benchmark for Novel API Acquisition
From Answers to States: Verifiable Process-Level Evaluation of Chemical Reasoning in Large Language Models
Chapter 21 The Semantic Web: Webizing Knowledge Representation
ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ В ОБРАЗОВАНИИ
ПРАВОСУБЪЕКТНОСТЬ ИСКУССТВЕННОГО ИНТЕЛЛЕКТА
ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ И ПРАВО
Formalizing the Binding Problem
Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories
Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking
Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models
When Parallelism Pays Off: Cohesion-Aware Task Partitioning for Multi-Agent Coding
Coordinating Task Switching in a Robotics Multi-Agent System Using Behavior Trees
SkillAdaptor: Self-Adapting Skills for LLM Agents from Trajectories
Genotype-Conditioned Molecular Generation via Evidence-Grounded Multi-Objective Latent Perturbation in Diffusion Models
ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ В ОБРАЗОВАНИИ
Искусственный интеллект в кардиологии
О ПРАВОСУБЪЕКТНОСТИ ИСКУССТВЕННОГО ИНТЕЛЛЕКТА
ПРАВОВОЙ ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ
The Best-Laid SCHEMEs: Coordinated Sabotage and Monitoring in Multi-Agent Systems
An Abstract Worlds Semantic Framework for Belief Change Operators
From Capability Models to Automated Planning: An AAS-Native Approach for Automatic PDDL Generation
Order within Chaos: Capturing Intrinsic Energy Anomalies for AI-Manipulated Image Forgery Localization
On the Generalization in Topology Optimization via Sensitivity-Conditioned Bernoulli Flow Matching
LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning
DynaGraph: Lightweight Multi-Model Interaction Framework via Dynamic Topological Reconfiguration
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training
MOC: Multi-Order Communication in LLM-based Multi-Agent Systems
Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems
Social Reasoning in Machines: Investigating Collective Truth-Seeking Dynamics in Large Language Model Debate
Delayed Repression and Emergent Instability in Adaptive Multi-Agent Systems
Intelligence as Managed Autonomy: Failure, Escalation, and Governance for Agentic AI Systems
Decoupled Intelligence: A Multi-Agent LLM Framework for Controllable Traffic Scenario Generation in SUMO
Long Live the Librarian! A Persistent Search Sub-Agent for Energy-Efficient Multi-Agent Software Engineering Systems
TunerDiT: Training-free Progressive Steering of Diffusion Transformer for Multi-Event Video Generation
Benchmarking and Enhancing Text-to-Image Models for Generating Visual Representations in Early Arithmetic Education
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
Comparing LLM-Based Conversational and Graphical Interfaces for Industrial Decision Tasks: An Exploratory Mixed-Methods Study
What changes after deployment? A survey on On-device Learning in TinyML
Comparing Market Mechanism Efficiencies
Generalized Intention Modeling in Multi-Agent Reinforcement Learning
Social welfare optimisation under institutional reward and punishment
Dreaming Of Others: Latent Teammate Modeling In World Models For Multi-Agent Reinforcement Learning
The Terminal Representation in Reinforcement Learning
Latent Space Disentanglement via Activation Steering for Interpretable Attribute Control in Symbolic Music Generation
TraceGraph: Shared Decision Landscapes for Diagnosing and Improving Agent Trajectories
Inconsistency-Aware Minimization: Improving Generalization with Unlabeled Data
AgentSociety: Incentivizing Agentic Social Intelligence
Sentinel: Embodied Cooperative Spatial Reasoning and Planning
Decoupled Delay Compensation: Enhancing Pre-trained MARL Policies via Learned Dynamics Filtering
Answer-Set-Programming-based Abstractions for Reinforcement Learning
Used Car Salesbots? Honesty and Credulity of LLMs as Bargaining Agents under Partial Information
Fine-grained Verification via Diagnostic Reasoning Supervision for Aspect Sentiment Triplet Extraction
PithTrain: A Compact and Agent-Native MoE Training System
Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization
EASE Configuration Facilitates A Reproducible Science of LLM Social Simulations
SpecBench: Evaluating Specification-Level Reasoning for Software Engineering LLM Agents
Constitutional Arms Races in the Public Goods Game: Co-Evolving LLM Constitutions Under Cooperation-Defection Pressure
Control Physiology: An Agent-Based Model of FAIR-CAM Dynamics
UnityMAS-O: A General RL Optimization Framework for LLM-Based Multi-Agent Systems
AgensFlow: A Coordination-Policy Substrate for Multi-Agent Systems
How Reliable Are AI Attackers Against a Fixed Vulnerable Target? A 400-Run Empirical Study of LLM Penetration Testing Consistency
When Cloud Agents Meet Device Agents: Lessons from Hybrid Multi-Agent Systems
xModel-KD: Cross-modal Knowledge Distillation for 3D Scene Perception using LiDAR
VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome Diagnosis
Modularizing Educational LLM-Agency for Fostering Responsible Learning Assistance
CalArena: A Large-Scale Post-Hoc Calibration Benchmark
Token-Level Generalization in LoRA Adapter Backdoors: Attack Characterization and Behavioral Detection
A Universal Cliff and a Design Fingerprint: Cross-Section Defect Detection Under LLM Orchestration
Front Matter
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
mcp-proto-okn: Natural-language access to open scientific knowledge graphs through the Model Context Protocol
ProjectionBench: Evaluating Scientific Hypothesis Generation in LLMs Under Progressive Information Disclosure
MIRA: Mid-training Rubric Anchoring for Source-Aware Data Selection
Recursive Multi-Agent Trading System: Iterative Optimized Portfolio Strategy Under Geopolitical Uncertainty
Towards Reliable Fetal Ultrasound Interpretation with Multi-Agent Collaboration
KYA: A Framework-Agnostic Trust Layer for Autonomous Systems with Verifiable Provenance and Hierarchical Policy Composition
Evo-Attacker: Memory-Augmented Reinforcement Learning for Long-Horizon Tool Attacks on LLM-MAS
Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification
Adaptive Multimodal Agents-Based Framework for Automatic Workflow Execution
Measuring Form and Function in Language Models
LACUNA: Safe Agents as Recursive Program Holes
Towards Reliable Multilingual LLMs-as-a-Judge: An Empirical Study
Thinking as Compression: Your Reasoning Model is Secretly a Context Compressor
IPO-Mine: A Toolkit and Dataset for Section-Structured Analysis of Long, Multimodal IPO Documents
OpenURMA: A Clean-Room Open Implementation of the Unified Bus Protocol
Modeling Vehicle-Type-Specific Pedestrian Crash Avoidance Behavior in Safety-Critical Interactions Using Smooth-Mamba Deep Reinforcement Learning
Refusal Before Decoding: Detecting and Exploiting Refusal Signals in Intermediate LLM Activations
A Matter of TASTE: Improving Coverage and Difficulty of Agent Benchmarks
Token Optimization Strategies for LLM-Based Oracle-to-PostgreSQL Migration
CaMBRAIN: Real-time, Continuous EEG Inference with Causal State Space Models
OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration
Calibrating Conservatism for Scalable Oversight
Beyond Binary: Sim-to-Real Dexterous Manipulation with Physics-Grounded Contact Representation
Self-Refining Topology Optimization via an LLM-Based Multi-Agent Framework
Arrow-Type Impossibility for Genuinely Modal Judgments
Heterogeneous Multi-Agent Modeling for Measurement and Network Analysis of the Data Service Market
Trace2Skill: Verifier-Guided Skill Evolution for Long-Context EDA Agents
AI-Enabled Serious Games: Integrating Intelligence and Adaptivity in Training Systems
The Log is the Agent: Event-Sourced Reactive Graphs for Auditable, Forkable Agentic Systems
Emergence of agriculture in an artificial society of reinforcement learning agents
Evaluating the Relevance of Uncertainty Estimators for LLM Hallucination
Black-box Membership Inference Attacks on the Pre-training Data of Image-generation Models
ORCA: An End-to-End Interactive Copilot for Optimized Root Cause Analysis
Boosting Knowledge Graph Foundation Models via Enhanced Negative Sampling
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
Knowledge Representation
Explaining Too Much? Understanding How Large Language Model Reasoning Traces Influence Performance and Metacognition
MuNet: A Mutualistic Network for Joint 3D Human Mesh Recovery and 3D Clothed Human Reconstruction from Single Images
Causal Tongue-Tie: LLMs Can Encode Causal Direction, But Their Yes/No Outputs Fail to Express
$D^2$-Monitor: Dynamic Safety Monitoring for Diffusion LLMs via Hesitation-Aware Routing
Hybrid Systems for Knowledge Representation in Artificial Intelligence
What Do Agents Communicate? Characterizing Information Exchange in Multi-Agent Systems
Benchmarking Pathology Foundation Models for Spatial Domain Understanding
Concept Unlearning via Cross-Attention Activation Projection for Diffusion Models
MDGMIX: Boundary-Aware Subgraph Mixing for Multi-Domain Graph Pre-Training
Efficient Benchmarking Is Just Feature Selection and Multiple Regression
Emergence of agriculture in an artificial society of reinforcement learning agents
Convergence Without Understanding: When Language Models Agree on Representations but Disagree on Reasoning
Human-in-the-Loop Multi-Agent Ventilator Decision Support with Contextual Bandit Preference Learning
Sparse Compositional Flow Matching by geometric assembly from motion primitives
ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning
Safety, Liveness, and Fairness in Quantitative Argumentation Dialogues
The Communication Complexity of Instant-Runoff Voting
PhotoFlow: Agentic 3D Virtual Photography Missions
Multi-agent Collaboration with State Management
Intent-First Aerial V2V for Tactical Coordination and Separation: Protocol and Performance Under Density and Disturbance
CandorMD: An AI-Assisted Audio Simulation and Feedback System for Training Clinicians for Medical Error Disclosure
Self-Evolving Multi-Agent Systems via Decentralized Memory
The Value of Covariance Matching in Gaussian DDPMs and the Lanczos Sampler
Post-Training is About States, Not Tokens: A State Distribution View of SFT, RL, and On-Policy Distillation
Knowledge representation and decision making: A hybrid approach
Knowledge is power: Open-world knowledge representation learning for knowledge-based visual reasoning
Nash Welfare in Additively Separable Hedonic Games
RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning
DecisionBench: A Benchmark for Emergent Delegation in Long-Horizon Agentic Workflows
Innovations in Cardless Artificial Intelligence Banking: A Comprehensive Framework for Cyber Secure and Fraud Mitigation using Machine Learning Algorithms
Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
Contractual Skills: A GovernSpec Design Framework for Enterprise AI Agents
Knowledge representation
Reliability and Effectiveness of Autonomous AI Agents in Supply Chain Management
PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning
S-Bus: Automatic Read-Set Reconstruction for Multi-Agent LLM State Coordination
MADP: A Multi-Agent Pipeline for Sustainable Document Processing with Human-in-the-Loop
MOSS: Self-Evolution through Source-Level Rewriting in Autonomous Agent Systems
Finite-Particle Convergence Rates for Conservative and Non-Conservative Drifting Models
The Matching Principle: A Geometric Theory of Loss Functions for Nuisance-Robust Representation Learning
Vector Policy Optimization: Training for Diversity Improves Test-Time Search
Implicit Regularization of Mini-Batch Training in Graph Neural Networks
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
The Neural Compiler: Program-to-Network Translation for Hybrid Scientific Machine Learning
BeLink: Biomedical Entity Linking Meets Generative Re-Ranking
Requirements Specification for Knowledge-Based Systems
Handbook of Knowledge Representation
Preface
Knowledge Discovery from Numerical Data
AiraXiv: An AI-Driven Open-Access Platform for Human and AI Scientists
DeepWeb-Bench: A Deep Research Benchmark Demanding Massive Cross-Source Evidence and Long-Horizon Derivation
Quantifying Hyperparameter Transfer and the Importance of Embedding Layer Learning Rate
Variance Reduction for Expectations with Diffusion Teachers
BootstrapAgent: Distilling Repository Setup into Reusable Agent Knowledge
Divide et Calibra: Multiclass Local Calibration via Vector Quantization
Fine-grained Claim-level RAG Benchmark for Law
AutoRPA: Efficient GUI Automation through LLM-Driven Code Synthesis from Interactions
ProCrit: Self-Elicited Multi-Perspective Reasoning with Critic-Guided Revision for Multimodal Sarcasm Detection
Decoupling Communication from Policy: Robust MARL under Bandwidth Constraints
Transforming Privacy Artifacts into Accessible Reports for Non-Technical Stakeholders
RePCM: Region-Specific and Phenotype-Adaptive Bi-Ventricular Cardiac Motion Synthesis
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation
How Much Online RL is Enough? Informative Rollouts for Offline Preference Optimization in RLVR
HaorFloodAlert: Deseasonalized ML Ensemble for 72-Hour Flood Prediction in Bangladesh Haor Wetlands
Long-term Power Grid Planning via Answer Set Programming
A Methodology for Selecting and Composing Runtime Architecture Patterns for Production LLM Agents
Atoms of Thought: Universal EEG Representation Learning with Microstates
Hybrid Approaches to Knowledge Representation and Reasoning in Artificial Intelligence Systems
Synergistic Foundation Models for Semi-Supervised Fetal Cardiac Ultrasound Analysis: SAM-Med2D Boundary Refinement and DINOv3 Semantic Enhancement
Stitched Value Model for Diffusion Alignment
Latent Laplace Diffusion for Irregular Multivariate Time Series
Chunking German Legal Code
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
The Dynamics of Policy Gradient in Social Dilemmas with Partner Selection
Beyond Scaling: Agents Are Heading to the Edge
Efficient Gradient Methods for Distributed Saddle Problems
ICRL: Learning to Internalize Self-Critique with Reinforcement Learning
Chapter 5: Expert Systems
IdeaForge: A Knowledge Graph-Grounded Multi-Agent Framework for Cross-Methodology Innovation Analysis and Patent Claim Generation
Flowing with Confidence
Prompt2Fingerprint: Plug-and-Play LLM Fingerprinting via Text-to-Weight Generation
GAMMA: Global Bit Allocation for Mixed-Precision Models under Arbitrary Budgets
ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ
ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ В РОБОТОТЕХНИКЕ
Spiker-LL: An Energy-Efficient FPGA Accelerator Enabling Adaptive Local Learning in Spiking Neural Networks
Mapping the Fitness Landscape: A Structure-Guided Approach to Multi-Modal Optimization
Rough Sets for Knowledge Representation in Artificial Intelligence Systems: A Critical Review
SMCEvolve: Principled Scientific Discovery via Sequential Monte Carlo Evolution
LongMINT: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems
Query-Conditioned Knowledge Alignment for Reliable Cross-System Medical Reasoning
Overeager Coding Agents: Measuring Out-of-Scope Actions on Benign Tasks
NeuroMAS: Multi-Agent Systems as Neural Networks with Joint Reinforcement Learning
Dynamic Deployment of Mobile Charging Trucks During Natural Disaster Evacuation: An Offline-to-Online Framework
Lifelong LaCAM with Local Guidance for Lifelong MAPF
When Fireflies Cluster; Enhancing Automatic Clustering via Centroid-Guided Firefly Optimization
Self-supervised local learning rules learn the hidden hierarchical structure of high-dimensional data
Actionable World Representation
Code as Agent Harness
Chapter 6. Structure Representation
Commonsense Knowledge Representation I
Knowledge evolutionary process of Artificial intelligence in E-commerce: Main path analysis and science mapping analysis
Commonsense Knowledge Representation II
Differing perspectives of knowledge representation in artificial intelligence and discrete event modeling
Comparative Evaluation of the Discovered Knowledge
Shaping Zero-Shot Coordination via State Blocking
A Research Agenda on Agents and Software Engineering: Outcomes from the Rio A2SE Seminar
AgentDisCo: Towards Disentanglement and Collaboration in Open-ended Deep Research Agents
Adaptive TD-Lambda for Cooperative Multi-agent Reinforcement Learning
RaPD: Resolution-Agnostic Pixel Diffusion via Semantics-Enriched Implicit Representations
Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation
SLIP & ETHICS: Graduated Intervention for AI Emotional Companions
LoCO: Low-rank Compositional Rotation Fine-tuning
Learning Sim-Grounded Policies for Bimanual Rope Manipulation from Human Teleoperation Data
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
XSearch: Explainable Code Search via Concept-to-Code Alignment
Looped SSMs: Depth-Recurrence and Input Reshaping for Time Series Classification
Chapter 21. Evaluation of Knowledge-based Systems
When Does Hierarchy Help? Benchmarking Agent Coordination in Event-Driven Industrial Scheduling
Decoupled Planning for Multiple Omega-Regular Objectives
Hybrid Approaches to Knowledge Representation and Reasoning in Artificial Intelligence Systems
Chapter 7: Knowledge Acquisition
Chapter 8: Knowledge Representation
Knowledge-based Expert Systems in Chemistry
CANTANTE: Optimizing Agentic Systems via Contrastive Credit Attribution
Discrete Diffusion for Complex and Congested Multi-Agent Path Finding with Sparse Social Attention
VGGT-Edit: Feed-forward Native 3D Scene Editing with Residual Field Prediction
FutureSim: Replaying World Events to Evaluate Adaptive Agents
Multi-Agentic Approach for History Matching of Oil Reservoirs
AI Knows When It's Being Watched: Functional Strategic Action and Contextual Register Modulation in Large Language Models
A Prototyping Framework for Distributed Control of Multi-Robot Systems
APWA: A Distributed Architecture for Parallelizable Agentic Workflows
Knowledge-Driven Marketing Management Support Systems I: Artificial Intelligence, Knowledge Representation, and Expert Systems
DCSG: A Logic Grammar for Knowledge Representation of Hierarchically Organized Objects
SkillSafetyBench: Evaluating Agent Safety under Skill-Facing Attack Surfaces
Intermediate Artifacts as First-Class Citizens: A Data Model for Durable Intermediate Artifacts in Agentic Systems
Attacks and Mitigations for Distributed Governance of Agentic AI under Byzantine Adversaries
Events as Triggers for Behavioral Diversity in Multi-Agent Reinforcement Learning
ATLAS: Agentic or Latent Visual Reasoning? One Word is Enough for Both
EntityBench: Towards Entity-Consistent Long-Range Multi-Shot Video Generation
Negation Neglect: When models fail to learn negations in training
Quantifying Sensitivity for Tree Ensembles: A symbolic and compositional approach
Topology-Preserving Neural Operator Learning via Hodge Decomposition
EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents
WARDEN: Endangered Indigenous Language Transcription and Translation with 6 Hours of Training Data

Ещё 837 статей в подразделах