Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links
Paper Citation Record · LEDGER
As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2402.14762.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-16T10:29:58.982687Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z
0 of 0 outbound references displayed
External citation measurements
2
arxiv_reference, observed 2026-08-05T02:28:24.338817Z
No outbound reference observations are available for this paper version.
Observation 7f3d1380-8b99-4205-9ece-ebaec2a3b2ba · inbound
HashAttention: Semantic Sparsity for Faster Inference MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fcb239eb-9466-422a-aa2d-3a257d5f1400 · inbound
SLAM-Omni: Timbre-Controllable Voice Interaction System with Single-Stage Training MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4cc13d9a-a97f-4c64-b41a-cbefc34d5fc8 · inbound
LLMzSz{\L}: a comprehensive LLM benchmark for Polish MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6cf20da9-676f-4ec2-9ca0-b13072a7d0c8 · inbound
Mixed-Precision Graph Neural Quantization for Low Bit Large Language Models MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 633bc806-8686-4c0c-bb0e-16e5805b4fdd · inbound
Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d2265866-541a-48bd-85de-94793a13743a · inbound
DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 211c39db-1a9e-44e8-952e-e3a33be7cf9e · inbound
Learning Safety Constraints for Large Language Models MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d316c10c-5751-4cb2-a82f-c5351ec05453 · inbound
Response-Level Rewards Are All You Need for Online Reinforcement Learning in LLMs: A Mathematical Perspective MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8b1f57c4-2a95-4836-94c0-2e0694b4156f · inbound
A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 27e4bece-34d3-4655-b59c-ecbd55ba1e41 · inbound
CompassJudger-2: Towards Generalist Judge Model via Verifiable Rewards MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cf649334-406c-4c7d-98bb-7ca48335d4ce · inbound
ReasonCache: Accelerating Large Reasoning Model Serving through KV Cache Sharing MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 6a187fa1-5fae-4d64-be44-61702cb8e1ae · inbound
Solution for Meta KDD Cup'25: A Comprehensive Three-Step Framework for Vision Question Answering MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d4ecc412-daae-4138-8cbb-188cac617ada · inbound
Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7421eaa2-cb8c-4dfa-aca7-fffe265779ab · inbound
HAEPO: History-Aggregated Exploratory Policy Optimization MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a18df4d1-2a4a-4f59-89be-946cb227ce9a · inbound
HEAL: A Hypothesis-Based Preference-Aware Analysis Framework MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 032f5bc1-5851-425b-9f95-bae93273db73 · inbound
On Robustness and Reliability of Benchmark-Based Evaluation of LLMs MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a9cc51ba-faca-438d-a7b4-6110a6626d3c · inbound
Towards EnergyGPT: A Large Language Model Specialized for the Energy Sector MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 62
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation a00122ef-879c-4f4d-a762-b4d05b30c41f · inbound
EngiBench: A Benchmark for Evaluating Large Language Models on Engineering Problem Solving MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 7
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 0c440476-c355-4a33-bea2-dd03f799a293 · inbound
VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 2024
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bf87898b-6604-476f-a8f0-09be40510a6f · inbound
TRINITY: An Evolved LLM Coordinator MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation f85cb0a4-4ef9-4018-965d-66d156def34d · inbound
CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 6b273d60-9fc3-4e0b-aa37-21701045d294 · inbound
SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 171e8e7a-e63f-423c-9429-0d528fa917c1 · inbound
SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 013ebd6f-8cd6-44b8-90bc-3107c13cf362 · inbound
Computational Hermeneutics: Evaluating generative AI as a cultural technology MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 708f1963-d2b9-4cbe-9017-bac3f7bef479 · inbound
EditPropBench: Measuring Factual Edit Propagation in Scientific Manuscripts MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation e64eb975-69de-4818-999b-0c7de8e4c887 · inbound
Data-dependent Exploration for Online Reinforcement Learning from Human Feedback MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 60
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 66ea7f5d-b4a0-4328-a510-91626b9c075a · inbound
Data-dependent Exploration for Online Reinforcement Learning from Human Feedback MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation f3a3d97e-f4e4-4b7a-a513-f30e3dad32b5 · inbound
SOMA: Efficient Multi-turn LLM Serving via Small Language Model MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation d694354c-ed2d-4217-88ab-b54dc64fc165 · inbound
DecisionBench: A Benchmark for Emergent Delegation in Long-Horizon Agentic Workflows MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation fa98b5b0-fe77-41bf-9f14-4807a9748093 · inbound
Mechanistic Analysis of Alignment Algorithms in Language Models MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.
Observation 5d50b31a-19cb-464a-a26f-f169d91263c7 · inbound
Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 857cc624-b313-4e75-831d-b45d1c04ed67 · inbound
Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0a22fc85-a5fe-456f-b43a-4d89dc2add11 · inbound
Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Reference 65
Source-reported events for the cited work
Unavailable: canonical work link unavailable.