Bounded knowledge map

Recent connections

Explicit wiki links among recent Safety entries.

Browse all entries
90 nodes · 0 links. The server bounds this neighbourhood, so the browser never downloads or simulates the complete wiki graph.

90 nodes · 0 links shown. Hover or focus to isolate neighbours; select a node to open its source entry.

No links inside this recent set

Try another category, or browse entries to follow links beyond this bounded view.

Safety

90 shown
Predicting Space Groups of Double Perovskites by LLM with Dynamic Few-Shot LearningEfficient Hypergradient Descent for Inverse Reinforcement LearningAPCReg: Anatomical-Prior-Guided Coarse-to-Fine CBCT--IOS Registration via Multi-View Projection and Reliability-Controlled Residual CorrectionMitigating Bus Bunching with Reinforcement Learning Enhanced by Semantic Stop EmbeddingHidden in Plain Sight: Diffusion-Based Unrestricted Robotic Attacks on Vision-Language-Action ModelsTemplated or fully Synthetic? Prompt construction as a confound in measuring LLM political stance beyond writing assistanceEvery Token Counts: Exact Likert-Scale Distributions for Measuring LLM Attitudes and BiasesRethinking Data Efficiency in Industrial Dense Prediction: Pretraining Coherence, Not Inductive Bias, Determines ViTs Low-Data AdvantageSPOTting the Future: Lookahead Explanations for Deep Reinforcement LearningThreat-guided Policy-aware Scene Perturbation for Safe Autonomous Driving with Online Reinforcement LearningSafeCap: Improving LVLM Safety with Image Captioning Reinforcement LearningUPAIR: Diagnosing Reasoning States via Uncertainty-Progress Alignment for Selective InterventionDual-Loop Self-Evolution via Verifiable Emotion Feedback for Multi-Turn Empathetic DialogueSBCO: Self-Supervised, Verifier-Grounded Harness Optimization For Planning AgentsPolicy Convergence and Divergence Across National and Within Regional AI Strategies: A Policy Design Element AnalysisThe Parser Already Knows: Lightweight Bias Correction in Constrained DecodingDreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous DrivingEnhancing Automated Essay Scoring With Three Techniques: Two-Stage Fine-Tuning, Score Alignment, and Self-TrainingCritic-Free Pretraining for Efficient Online Reinforcement Learning Fine-TuningSurgical WAM: A World-Action Model for Data-Efficient Surgical Robot LearningELMER: Evolutionary Language Model that Explores and RefinesConvergence of Sign-based Random Reshuffling Algorithms for Nonconvex OptimizationLeveraging Large Language Models for Causal Discovery: a Constraint-based, Argumentation-driven ApproachDo AI weather models miss extremes?Multiplayer Nash Preference OptimizationOpenAI VP of Global Policy Ann O'Leary says AI policy in the US is anchored in the states and informed by California's AI transparency law passed in 2025 (Chase DiFeliciantonio/Politico)IADD-TR: Intervention-Aware Dynamics Decoupling with Targeted Regularization for Model-Based Reinforcement LearningMost biomedical publications show signs of LLM-assisted writingTCAM for Autonomous Deformable Manipulation: The RMC2 Champion System for WBCD 2026 Track 4What We Know about Responsible AI Practices in Industry: A Half Decade of Empirical ResearchStatus Association Does Not Reliably Predict Decision LeakageActions Speak Louder than Words: Measuring Cross-Lingual Policy Retention in Tool-Using AgentsMIDAS: Mutual Information Disentanglement with Uncertainty-Aware Fusion for Incomplete Multimodal Sentiment AnalysisA Joint-Distribution Route to Fair Representations with Continuous Sensitive AttributesDual Stress: Runtime Safety Monitoring for Safety-Constrained MPC NavigationToward a Theory of Value in AI AlignmentA Neural Network Based Teleoperation for Remote Controlled VehiclesConfTriage: A Calibration-Aware LLM Triage Framework for Pulmonary Nodule Malignancy with Selective Specialist DeferralConRub-Med: Reinforcement Learning with Consensus Rubrics for Open-Ended Medical Question AnsweringNever Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language ModelsAdvFD: Boosting Visual Generation via Adversarial Fr'echet Distance LossSimilarity Gates Approve Reversals: A Validity Audit of Embedding-Cosine Thresholds in Agent SystemsLoRCA: LoRA Cycle Adaptation for Histology to HiP-CT Translation with DINOv3LLMs Encode Their Failures: Predicting Success from Pre-Generation ActivationsThe Impact of Operational-Data Fidelity when Assessing Safety-Critical Autonomous-Vehicle SoftwareTowards Color-Faithful Low-Light Image Enhancement via Adaptive Color Debiasing and Saturation RectificationTopological Feasibility Guarantees for Differentiable Predictive ControlDual Space Preconditioning for Gradient Descent in the Overparameterized RegimePhysics-Informed Machine Learning in Prognostics and Health Management: A Systematic Literature ReviewFedCGR: Federated Cross-Domain Generative RecommendationYour LLM, Your Style: Behavioral Mode Axes for LLM Behavioral ControlSelective Prediction Reduces the Negative Effects of Automation Bias Overall but Increases False NegativesCARE: Confidence-Aware Reasoning for Reliable Medical VQANavigating the Proximity-Safety Balance: Constraint Decomposition for Human Following in Pedestrian CrowdsMedUP: Awakening Unified Understanding and Perception in Medical Vision-Language ModelsOperationalising Relative Causal Knowledge: Backbone Identifiability from Private Reports on a Shared OutcomeReOrder-OPD:Reliability-Aware Prompt Ordering for On-Policy DistillationCRHT: A Continuous Regression Hybrid Transformer for Vessel Trajectory Prediction with Online Cluster SamplingWhat DINO saw: ALiBi positional encoding reduces positional bias in Vision TransformersRobust Sliding Mode and Admittance Control of Underactuated Aerial Manipulators for Contact-Based InspectionPair-Centric Graph Rewiring for Over-Squashing via Optimal Transport-Guided Communication AlignmentSapiensID 2.0: Aligning Human Recognition Foundation Models with Human PerceptionScheduling Mixed RL Rollouts Beyond Prefix LocalityProbGuard: Calibrated Safety Risk Estimation from LLM Output DistributionsAutomated Data Enrichment using Confidence-Aware Fine-Grained Debate among Open-Source LLMs for Mental Health and Online SafetyIO Factory: Simulating AI-Enabled Influence Campaigns at ScaleProcedural Fairness Failures in RLHF from Preference AveragingPartially Observable Learning for Multi-Platform Dispatch OptimizationFoR-SALE: Frame of Reference-guided Spatial Adjustment in LLM-based Diffusion EditingHip Energized Monopedal HoppingVIDS-Seg: Towards Reliable Uncertainty Quantification in Pediatric Cardiac Ultrasound SegmentationOmniVTA: Visuo-Tactile World Modeling for Contact-Rich Robotic ManipulationObservational Policy Ranking for SMB Financial Guidance from Multi-Action Accounting LogsMERA: Model Evolution and Routing with Skill Adaptation for Agentic Systems at ScaleRobust Safety Filtering for Input-Constrained Underactuated Linear SystemsHierarchical Empirical-Bayes Naive Bayes: Minimax Smoothing and Calibration with AODE ExtensionDo Time-Series Forecasters Use the Right History: Recoverability, Recovery, and Functional Use of Temporal DelaysData Attribution of Emergent Misalignment with Persona FeaturesMarkNull: Model-Agnostic Watermark Removal in AI-Generated Images via On-Manifold Latent ManipulationXCoT-VLA: Executable Chain-of-Thought for Vision-Language-Action DrivingTRACE-GS: On-Policy Trajectory Distillation with Privileged Geometric Conditioning for Sparse-View 3DGS RestorationHow to Verify Consistency of Probabilistic ClaimsCarefully Considering Culture: Analyzing LLM Alignment in Single- and Multi-Cultural Settings using Cultural Consensus TheoryA Convolutional Layer Activation Dimensionality Reduction for Out-of-Distribution and Adversarial Attack Detection MethodsStay or Stray - A Dynamical Systems Viewpoint of Popularity BiasFrom Prediction to Incrementality: Causal Optimization for Large-Scale Targeting and RecommendationMulti-View Relational Distillation for Spatial Reasoning with Vision-Language ModelsSmart Enough to Go Extinct? An Evolutionary Challenge to the Value of General Intelligence and Its Ethical Implications for AGILearning in ImaginationLand: Omnidirectional Policies through 3D Generative Models (OP-Gen)UniMod: Enhancing Multi-Modal Medical Diagnosis through Cross-Modality and Within-Modality Alignment