Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-03T20:19:57.764281Z
Paper Citation Record · LEDGER
As of 4 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2511.20439.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-03T20:19:57.764281Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-04T06:34:03.388597+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
39 of 39 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 7bdb75b9-0d88-489e-adf9-e36e7ed32e77 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Qwen2.5-VL Technical Report
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4f0d3d5d-0777-4283-9fe4-89b8b9592b11 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Invariant Slot Attention: Object Discovery with Slot- Centric Reference Frames
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 76d49dd9-2e87-49fb-a2ea-e98103c4d516 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Token merging: Your vit but faster
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a3efce13-acb8-4973-aafb-ba9f97e94bbf · outbound
Object-Centric Vision Token Pruning for Vision Language Models An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e8217cb1-0a4a-49f7-9ed5-c678a3b68b78 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Mme: A comprehensive evaluation bench- mark for multimodal large language models
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 31db8585-1472-4072-b029-37f2c5229368 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Making the v in vqa matter: Elevating the role of image understanding in visual question answer- ing
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 609920c9-3a26-4a6e-a95e-ef91aa253854 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Vizwiz grand challenge: Answering visual questions from blind people
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 663eec7e-fe31-49d6-a943-7b3e1687816f · outbound
Object-Centric Vision Token Pruning for Vision Language Models Gqa: A new dataset for real-world visual reasoning and compositional question answering
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 54797207-daea-4a8f-ab57-2a0b46532e1f · outbound
Object-Centric Vision Token Pruning for Vision Language Models Improving Object-centric Learning with Query Optimization
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e1d3a1af-e38b-4fa0-9683-b2c3d9861204 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Spot: Self-Training with Patch-Order Permutation for Object-Centric Learning with Autoregressive Transformers
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 29e27677-42f9-4bd0-a46a-886eb9446861 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Seed-bench: Bench- marking multimodal large language models
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9f61697f-ab6b-404a-8f56-d7c1bd16f01a · outbound
Object-Centric Vision Token Pruning for Vision Language Models Evaluating Object Hallucination in Large Vision-Language Models
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8648c6b5-3eec-4c1d-ba4a-0156d6f1239a · outbound
Object-Centric Vision Token Pruning for Vision Language Models Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 781f2851-0b89-49b7-af6b-9cdee1c13a93 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Microsoft coco: Common objects in context
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fc242561-69c5-40b5-9219-65e5fd4cfde7 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d675fbc9-106a-4e70-b47b-0b320e632b6d · outbound
Object-Centric Vision Token Pruning for Vision Language Models Llavanext: Improved reasoning, ocr, and world knowledge, 2024
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2701cd67-e999-4c85-95a1-d10392917ddd · outbound
Object-Centric Vision Token Pruning for Vision Language Models HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 15fe81ce-0ad1-4070-b11a-0052199e36e1 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Mmbench: Is your multi-modal model an all-around player? InEuropean conference on computer vi- sion, pages 216–233
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ff3236da-a8f7-46d3-88c0-312359f14136 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Object- centric learning with slot attention.Advances in neural in- formation processing systems, 33:11525–11538, 2020
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 87a856d0-8a55-40b1-ae5f-547db0fc364b · outbound
Object-Centric Vision Token Pruning for Vision Language Models Learn to explain: Multimodal reasoning via thought chains for science question answering.Advances in Neural Information Processing Systems, 35:2507–2521,
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 44d11a48-ed1b-4212-8026-ed04f7018e8b · outbound
Object-Centric Vision Token Pruning for Vision Language Models Temporally consistent object-centric learning by contrasting slots
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cfb0f784-a140-4f1c-9729-15bada9374dd · outbound
Object-Centric Vision Token Pruning for Vision Language Models Learning transferable visual models from natural language supervi- sion
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a99ef534-51d8-492f-af74-ebadcf5362c6 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Bridging the gap to real-world object-centric learning
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bd5e67b3-50e3-4a13-bdc5-4586ec7cc3b9 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Towards vqa models that can read
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e037fa8f-5851-4b95-ad99-51695ad72b50 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Less is more: A sim- ple yet effective token reduction method for efficient multi- modal llms
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 12614eef-ba43-45c0-a693-6ef5fa328563 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063,
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8744c380-d06b-41a7-81a0-c22e11551ea8 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ad154c0f-9850-42c5-bdce-09a2c25ee2a1 · outbound
Object-Centric Vision Token Pruning for Vision Language Models SlotDiffusion: Object-Centric Generative Mod- eling with Diffusion Models.Advances in Neural Informa- tion Processing Systems, 36:50932–50958, 2023
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 61340193-c238-4791-8e28-0eb470e7efe9 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Conical visual concentration for efficient large vision-language models
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c0f215aa-3b7b-4206-b922-b7aaca170ec1 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Visionzip: Longer is better but not necessary in vision language models
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 501c6f9c-7aad-4093-845b-4ac155d10106 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for ex- pert agi
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 84f066d8-5d1c-4deb-a718-97079d7bd7df · outbound
Object-Centric Vision Token Pruning for Vision Language Models Object-Centric Learning for Real-World Videos by Pre- dicting Temporal Feature Similarities.Advances in Neural Information Processing Systems, 36, 2024
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 22b0e0e0-5ed3-4dbe-863b-fbb411463446 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Lmms-eval: Re- ality check on the evaluation of large multimodal models
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 41fcc725-f991-4930-89b4-fe565ca1e56d · outbound
Object-Centric Vision Token Pruning for Vision Language Models Sparsevlm: Vi- sual token sparsification for efficient vision-language model inference
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e4d2496a-9011-448c-bea4-4daf8586d8d1 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Predicting video slot attention queries from random slot-feature pairs.arXiv preprint arXiv:2508.22772, 2025
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 15f17c84-6894-4ad7-a2af-1e1a4649d094 · outbound
Object-Centric Vision Token Pruning for Vision Language Models Vector-Quantized Vision Foundation Model for Object-Centric Learning
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 66de32da-b792-4fa5-97a9-c7195582385b · outbound
Object-Centric Vision Token Pruning for Vision Language Models Smoothing Slot Attention Iterations and Recurrences
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cc776f21-cf19-4a1e-a9fb-260e27c90d8d · outbound
Object-Centric Vision Token Pruning for Vision Language Models Slot Attention with Re-Initialization and Self-Distillation
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8dea26c4-5443-416e-9183-a419fbf7c9e1 · outbound
Object-Centric Vision Token Pruning for Vision Language Models MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models
Reference 39
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
No inbound Pith citation observations are available.