Pith. sign in

Paper Citation Record · LEDGER

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers

As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2511.14751.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2511.14751 v2

Coverage vector

measured 44 of 44 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-17T20:36:45.221000Z

measured 45 of 45 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-12T01:12:13.747675Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

44 of 44 outbound references displayed

  • verified exact3
  • verified fuzzy39
  • unresolved2
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ca7eb543-be41-4943-8c49-8d93fffe17e2 · outbound

This paper cites Large-scale data for multiple-view stereopsis.International Journal of Computer Vision, pages 1–16.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Large-scale data for multiple-view stereopsis.International Journal of Computer Vision, pages 1–16

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.918822Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:5a8061c8ccd7eb565f97cfe8410738c59966d9ae4cabc3686b28b960bf0367a2

Observation befadd1c-7ac2-4575-b411-79410b0ee321 · outbound

This paper cites Token merging for fast sta- ble diffusion.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Token merging for fast sta- ble diffusion

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:42:06.674876Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:80c933b3491ff64f4c9a7c8d7e4c5ec4e4e216fd58f5a4862d39b900308c8bdc

Observation e7934d8d-6501-429e-a763-17cfea1b4e5f · outbound

This paper cites Token merging: Your vit but faster.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Token merging: Your vit but faster

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.939651Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:025fadf8f4738dd3b020416bcd8bda299e442f276f87ab2dd12e4a897cf8c2e3

Observation efd23255-0bbc-4c67-9351-70862c31dbdd · outbound

This paper cites Learning to rank using gradient descent.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Learning to rank using gradient descent

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.932563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:559f2975857013e91a90d620b41b0bb3f17af8aa1d895b294dcc48b493f4dc54

Observation f4138322-9e18-474f-b73e-19a75714f1a1 · outbound

This paper cites Must3r: Multi-view network for stereo 3d reconstruc- tion.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Must3r: Multi-view network for stereo 3d reconstruc- tion

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.930376Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:320c3654ad663ed78e30ed6f5c765d309eac5422cc6aed9ed29ccbd9b2f22d4b

Observation 4ad6f26e-4ee5-4c53-aa50-2535974bd6a8 · outbound

This paper cites Pumer: Pruning and merging tokens for efficient vision language models.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Pumer: Pruning and merging tokens for efficient vision language models

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.923747Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:fb3d535bfedc4580dae56acd1bff37d6c0d3a22c4eff3103a59e51a2a19b90bf

Observation 5db6d812-f620-4536-a88d-8d60784ec70c · outbound

This paper cites Sparsevit: Revisiting activation sparsity for efficient high-resolution vision transformer.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Sparsevit: Revisiting activation sparsity for efficient high-resolution vision transformer

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.928029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:cc8060224104397541d2161bf1233119c9dd36984470cf857f0a2a024ea535ba

Observation 74672f6f-b726-4f6c-b1e6-7b6796ab1532 · outbound

This paper cites Vggt- long: Chunk it, loop it, align it – pushing vggt’s limits on kilometer-scale long rgb sequences.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Vggt- long: Chunk it, loop it, align it – pushing vggt’s limits on kilometer-scale long rgb sequences

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.925944Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:bde3f97b0cb9c4c3176489b51996d3c5aa2b42cb0a5015173c5971042cdf4ee3

Observation 8a3d29a3-0a2e-4da8-9de3-1e3772056d47 · outbound

This paper cites Flex attention: A programming model for generating optimized attention kernels.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Flex attention: A programming model for generating optimized attention kernels

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.921335Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:1643607bdde95bf92f949a3da5ca24926924fca9dfa906a09389c07c3fc1a10b

Observation 6b607802-7d3d-4e00-84bc-b71ecc0711a9 · outbound

This paper cites Reloc3r: Large-scale training of relative camera pose regression for generalizable, fast, and accurate visual localization.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Reloc3r: Large-scale training of relative camera pose regression for generalizable, fast, and accurate visual localization

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.913980Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:27deeb24460ce587201fdf52c18ce68945b64793a7910cbc9fe1cf15d5f8130b

Observation 398ab548-8e4f-41cd-bfed-a4d057fe94e1 · outbound

This paper cites Pow3r: Empowering un- constrained 3d reconstruction with camera and scene priors.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Pow3r: Empowering un- constrained 3d reconstruction with camera and scene priors

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.916338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:c9009ed92ce40c8a741a2706130bba0cdf651508b59a25bd33d5ea741204678b

Observation 609d23de-caaa-4d03-88e9-4b6209326d83 · outbound

This paper cites Mapanything: Universal feed- forward metric 3d reconstruction.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Mapanything: Universal feed- forward metric 3d reconstruction

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.937545Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:b0fbf6756da65099ba393dad916ddb999ebf335ec516910f71eec25de88e781a

Observation eaa60ddb-beb0-4db9-845e-6b25adeb8475 · outbound

This paper cites What uncertainties do we need in bayesian deep learning for computer vision?.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers What uncertainties do we need in bayesian deep learning for computer vision?

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:42:06.672092Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:80b875d71f76a599a0476e6d872c6cbdecf5ad0f92ee0bb5177c9930edd083a8

Observation 35a3596c-5af9-46fd-ae29-55940eaa6997 · outbound

This paper cites Rethinking the self-attention in vision transformers.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Rethinking the self-attention in vision transformers

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.934950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:bfa36d83b6cf4b3e6dd4977fd0517d09009d5802712e1775f5b36b164bcb0cc6

Observation fcf54481-f3e0-4406-8ff6-fd628865ed7e · outbound

This paper cites Token fusion: Bridging the gap between token pruning and token merging.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Token fusion: Bridging the gap between token pruning and token merging

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.911644Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:7068d0b071132b252925096d58acd12408b08f3658121c7fd424b7c887b246a2

Observation ec58bf8e-e2a2-4b11-a6d1-269a0ccf75bb · outbound

This paper cites Stream3r: Scalable sequential 3d reconstruction with causal transformer.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Stream3r: Scalable sequential 3d reconstruction with causal transformer

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.880256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:b467e2a26eb792790235f3d3ae19c1396b109ddc62addef9aaeb83018515e129

Observation 9da5feef-ad1a-47ec-9717-710e2a1f0b47 · outbound

This paper cites A purely algebraic justification of the kabsch-umeyama algo- rithm.Journal of Research of the National Institute of Stan- dards and Technology, 124.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers A purely algebraic justification of the kabsch-umeyama algo- rithm.Journal of Research of the National Institute of Stan- dards and Technology, 124

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.867727Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:0f3a52e86c47ec63d01c405b5c9a28312baeecf5ef48d5c570967adb25a0502e

Observation 8f465f76-ab55-4f5f-aa83-63c7baf5bcca · outbound

This paper cites Mast3r: Grounding image matching in 3d world.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Mast3r: Grounding image matching in 3d world

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.884803Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:bc15c4c9f6a9d669413d992d2b31ffc2aaf5a22fc9a0457a2da59ac0d1f27242

Observation 7e4eb1ab-f277-414d-b053-fa49a83b2bdd · outbound

This paper cites Revisiting token pruning for object detection and instance segmentation.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Revisiting token pruning for object detection and instance segmentation

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.889298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:5791bda233f89eb987fb1659aab388ebeade1f98ee5938c59cbc4e9c6619d88c

Observation adf56859-0bc5-4f20-944d-badd55bf9dc5 · outbound

This paper cites Align3r: Aligned monocular depth estimation for dynamic videos.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Align3r: Aligned monocular depth estimation for dynamic videos

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.859360Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:745037703465e785b5e6525de2af54024dcb0e18943b6cd7c7922886b21087b6

Observation 03a6dbe1-1761-4ed2-942a-552a7c9fa637 · outbound

This paper cites Single-pass parallel prefix scan with decoupled lookback.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Single-pass parallel prefix scan with decoupled lookback

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.902438Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:d5829092cbea57f85033afceb3ab72b72bab82da85a2069eaa58c63f5e8552ba

Observation 60984954-62de-4d30-8f28-452c2ad86be2 · outbound

This paper cites Indoor segmentation and support inference from rgbd images.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Indoor segmentation and support inference from rgbd images

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.882566Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:7726099c0ac5742595e4676ffbfd8b4f4ae63bbb5384c62dcdb28f51ec9af828

Observation f2ee7f70-0af2-4375-abfa-58702bd237f3 · outbound

This paper cites On the uncertainty of self-supervised monocular depth estimation.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers On the uncertainty of self-supervised monocular depth estimation

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:42:06.669194Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:06b5421540afcbe7d4b3fd237952f2f6640af521149462718877c9dae892df51

Observation 29c1c18e-1d7c-454f-ab38-abe75689e044 · outbound

This paper cites MAC-VO: Metrics-aware covariance for learning-based stereo visual odometry mac-vo.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers MAC-VO: Metrics-aware covariance for learning-based stereo visual odometry mac-vo

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.904658Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:6a2d906e514cde7ecc0616d78a035ed172ff7019f7b51544dbac0c14b9583b68

Observation 4204baef-82eb-4bbb-b242-ab66160ab0f1 · outbound

This paper cites Dynamicvit: Efficient vision transformers with dynamic token sparsification.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Dynamicvit: Efficient vision transformers with dynamic token sparsification

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:42:06.520396Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:661cb424134bd0b28c2f75593e932f5b2294f2f1616f747eca09ee2b82d761b6

Observation dd826616-babd-4455-aa57-db2e9be80214 · outbound

This paper cites Ryoo, AJ Piergiovanni, Anurag Arnab, Mostafa Dehghani, and Anelia Angelova.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Ryoo, AJ Piergiovanni, Anurag Arnab, Mostafa Dehghani, and Anelia Angelova

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.869999Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:cd620656bf5a900b3efcac57c6a81ee06534c8bd5dccb6feb614261460dec2c7

Observation d6b6000f-68ce-4e72-bf29-7556d8856edc · outbound

This paper cites Sch¨onberger, Silvano Galliani, Torsten Sattler, Konrad Schindler, Marc Pollefeys, and An- dreas Geiger.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Sch¨onberger, Silvano Galliani, Torsten Sattler, Konrad Schindler, Marc Pollefeys, and An- dreas Geiger

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.874860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:9d795ff0376f6c8d3a41bdca174f9f845b8a62c2abda3243aab9153f953d8669

Observation 1b5c69d6-b14c-44e6-836b-a4e49c416003 · outbound

This paper cites Fastvggt: Training-free acceleration of visual geometry transformer.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Fastvggt: Training-free acceleration of visual geometry transformer

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:42:06.515200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:5791603d92c15d5c90b4431426d88b261b0db38aa606123fca9ff561b3ddf537

Observation 75363cba-8c84-4690-b85f-eb8b63c32a80 · outbound

This paper cites an unresolved cited work.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-05-17T20:42:06.517733Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:954e82c9ba0e64da1be834204e64d568d7890506bf1e9bc3bf54ecae1d8b1517

Observation 65228937-961b-42e6-9864-b0d87e62b1fa · outbound

This paper cites Dynamic token pruning in plain vision transformers for semantic segmentation.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Dynamic token pruning in plain vision transformers for semantic segmentation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.895104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:1cb6299c17ce05dcf88e8c3b2bdf156c58bd6f758c723b3507b69f5247e00cef

Observation 70f73f88-6ca6-424e-b9e9-7c693ec8c497 · outbound

This paper cites Sparsity invariant cnns.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Sparsity invariant cnns

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.886987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:d065c19d16a5fd23a0e577b452003b7752e106ff5a2b8b99aea89a5220716663

Observation 2ff8abc5-a619-4fbc-9e59-48ab3ada4c46 · outbound

This paper cites an unresolved cited work.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-05-17T20:45:14.899838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:625eb81f942343c9b3305fdfbe62c82294c8f42c1b6ffbf8f0cab561bff77bcc

Observation ee555f02-9d67-472c-be5f-85f73ef338be · outbound

This paper cites Gomez, Lukasz Kaiser, and Illia Polosukhin.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Gomez, Lukasz Kaiser, and Illia Polosukhin

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.892605Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:21b5913b791e9290842fab8a7351306d231bdecb95912f862c7ebb26bcd991d0

Observation 358d0586-45d2-4f0d-b1f3-0a5dcc636cb3 · outbound

This paper cites 3D Reconstruction with Spatial Memory.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers 3D Reconstruction with Spatial Memory

Reference 34

Resolution
verified exact
local_arxiv, observed 2026-05-17T20:40:14.960167Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:10676ec645784f45d719f779f4e63e2e128c5413dfa2de9cf458a5c09847c498

Observation bc02a689-e802-4914-be36-2b09d17e3c61 · outbound

This paper cites Vggt: Visual geometry grounded transformer.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Vggt: Visual geometry grounded transformer

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.907300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:84d3d98a33c56d06ae1e52e5cd4906e61a4220f8aca21b6c1a73de3836bb21da

Observation 5c7260f4-6e97-4119-8903-26db2d8e0648 · outbound

This paper cites Continuous 3D Perception Model with Persistent State.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Continuous 3D Perception Model with Persistent State

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-17T20:40:14.955935Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:f83bab7b9c73b4bc6c50f3cb839d5b544b6c8b56243caeb2b4d27e4b94c7e4ed

Observation eb64254f-36c7-4374-8da0-05c864c9157b · outbound

This paper cites Dust3r: Geometric 3d vi- sion made easy.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Dust3r: Geometric 3d vi- sion made easy

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.865188Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:69cc5910533aad556f6b8119406bad5f6d9eae8596daee1035670f44b98f745e

Observation 3c9bb362-7ecb-4a8e-b029-0c0e4a0dffbd · outbound

This paper cites Tartanair: A dataset to push the limits of visual slam.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Tartanair: A dataset to push the limits of visual slam

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.872424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:40253277cf217d55db8dca278e5bc7cf185dce4d9fd1d8c3c3bef2560dff8d58

Observation 930e3960-d2b2-4b0e-9076-550ad15ca37a · outbound

This paper cites Liang, Mikael Henaff, Hao Tang, Ang Cao, Joyce Chai, Franziska Meier, and Matt Feiszli.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Liang, Mikael Henaff, Hao Tang, Ang Cao, Joyce Chai, Franziska Meier, and Matt Feiszli

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.897462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:b8bc5f5408b745d2a4fba9b4f1ef649f63bdc5c5e815449662ee91ab43950079

Observation fc88df30-a482-4e6f-884c-afcedec47d9f · outbound

This paper cites Alvarez, Arun Mallya, Jan Kautz, and Pavlo Molchanov.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Alvarez, Arun Mallya, Jan Kautz, and Pavlo Molchanov

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.909386Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:62428339952b21ef8b1d48a84ca59d62ed648c3d5ada4d6876db985cb5cb65cb

Observation efebb0e6-554a-4766-a9a4-edfd25bbbe47 · outbound

This paper cites Alvarez, Arun Mallya, Jan Kautz, and Pavlo Molchanov.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Alvarez, Arun Mallya, Jan Kautz, and Pavlo Molchanov

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.862262Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:de487536b770b23b38b6c26982e58f0fb3c0b0664c37cad0c8562cb697edbd50

Observation 0030667e-eda3-4624-9bae-95969611b2de · outbound

This paper cites X-pruner: explainable pruning for vision transformers.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers X-pruner: explainable pruning for vision transformers

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.856984Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:65b21c75231d07f7f6fa836fd22b549bb92ea68f6742ee77abc2eadd3da56e9f

Observation 354c5b55-5053-417c-891f-7bb1a9c2a23a · outbound

This paper cites Stereo magnification: learning view syn- thesis using multiplane images.ACM Trans.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Stereo magnification: learning view syn- thesis using multiplane images.ACM Trans

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T20:45:14.877268Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:1d51d7dfd2ceedc4ce492ebc4db55d41ec6fa00c59b569ea02c282d2f9bb3305

Observation 44a1376a-ff9b-4875-b654-947e1b8cd243 · outbound

This paper cites Streaming 4D Visual Geometry Transformer.

Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers Streaming 4D Visual Geometry Transformer

Reference 44

Resolution
verified exact
local_arxiv, observed 2026-05-17T20:40:14.948775Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-17T20:36:45.221000Z digest=sha256:98028dc2125867381c111129d2c532bf30e636de7900e45b48b88c1f88dea018

Pith citing papers

Observation dc13eab0-183b-4e02-9d6f-cc504c11e80c · inbound

SAF3R: Dynamic Sparse Attention for Feed-Forward 3D Reconstruction Transformers cites this paper.

SAF3R: Dynamic Sparse Attention for Feed-Forward 3D Reconstruction Transformers Co-Me: Confidence-Guided Token Merging for Visual Geometric Transformers

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-12T01:12:13.747675Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T01:12:13.747675Z digest=sha256:ad46ed7dc7656ec852050fcd6bf9dfbb201d89aa65876f245c32f6c82a333b58