Pith. sign in

Paper Citation Record · LEDGER

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection

As of 17 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2505.08561.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.08561 v2

Coverage vector

measured 76 of 76 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T21:55:21.602712Z

measured 76 of 76 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

76 of 76 outbound references displayed

  • verified exact0
  • verified fuzzy60
  • unresolved16
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 456fc492-22d3-4e44-9a34-954739288557 · outbound

This paper cites Learning to see by moving.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Learning to see by moving

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.952347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.232608Z digest=sha256:9f6778a5ddc041afdd2792786d1732292939ead12f45b022df217c27542e5ccd

Observation 7c342753-40eb-4017-bf82-1731b4feda72 · outbound

This paper cites Self-supervised object detection from egocentric videos.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Self-supervised object detection from egocentric videos

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.936977Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.238307Z digest=sha256:6acfec62c11cc10df35699635511701ce3841da699fa27fb65b1f0b6d6e5c993

Observation cf2d989e-2bff-4181-9ae4-de3868240580 · outbound

This paper cites Self- supervised Object-centric Learning for Videos.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Self- supervised Object-centric Learning for Videos

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.921945Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.244208Z digest=sha256:08c04bd55feaabf874efb5fb6b37d924ca1f7880a0b21dc09ce36730c4d884b2

Observation 1a4c6e03-ae63-4004-bd31-c3fe5a44f651 · outbound

This paper cites Adamae: Adaptive masking for efficient spatiotempo- ral learning with masked autoencoders.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Adamae: Adaptive masking for efficient spatiotempo- ral learning with masked autoencoders

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.905957Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.249736Z digest=sha256:7047115179689c45ed7232de3aa2d874e85e6605a52056ea2af12fc847ddb25a

Observation a908a89e-89b8-4e53-9a70-a9c96f8e0c87 · outbound

This paper cites Clustering on the unit hypersphere using von mises-fisher distributions.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Clustering on the unit hypersphere using von mises-fisher distributions

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.888030Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.255972Z digest=sha256:aaafc39c43adbde6467f38113c811ca16b7898361d31c5a30b27fd1ae8898e4b

Observation f3946730-b2ce-4410-8dde-485a3340ce37 · outbound

This paper cites Beit: Bert pre-training of image transformers.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Beit: Bert pre-training of image transformers

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.872732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.260922Z digest=sha256:f275806d91f3994dd67799aa2ac4f9ba26e75b43436fd84da9bac4df90ecd60f

Observation 8fabecb0-6e89-43c1-9808-4e64e066f88d · outbound

This paper cites Improving masked autoencoders by learning where to mask.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Improving masked autoencoders by learning where to mask

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.857099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.266179Z digest=sha256:3a549faaa76bf8fe37d5e0842e6d14fb1d1f05dabb4df6870ade7548c427c038

Observation 40c0d332-7c81-48f4-b74c-74cce651107e · outbound

This paper cites Generative pretraining from pixels.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Generative pretraining from pixels

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.841668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.270802Z digest=sha256:4abc78fd2978194eb4cf2efcfbd20df2df2ad3223ff52f73371daf45f2b43a6d

Observation aa78ea1d-5f7f-4393-bd42-7d857d98639d · outbound

This paper cites Dynamonet: Dynamic action and motion network.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Dynamonet: Dynamic action and motion network

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.826487Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.275462Z digest=sha256:e5c3e1d85a5d814ec0b4802c5768578f31d77087313e6bcc28c9b09cef461d8f

Observation e0cc744e-9ffa-4f53-8fd3-e87d1c9021a5 · outbound

This paper cites Peco: Perceptual codebook for bert pre-training of vision transformers.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Peco: Perceptual codebook for bert pre-training of vision transformers

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.279864Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.279864Z digest=sha256:a05673a95c895f06d9327d3131ee7631edc9579d1911c9db4d3fcfbd0ca39b7a

Observation e6c2c009-414e-4f9b-8611-d0684ee20355 · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection An image is worth 16x16 words: Transformers for image recognition at scale

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.801665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.284600Z digest=sha256:87d7717fefbb6f797c8732d82af6b8aed0fda39ea0a1e1b5b29492b2f25a8d04

Observation a8d8bbff-4149-4aaa-88ad-2e86f739f106 · outbound

This paper cites Motion- guided masking for spatiotemporal representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Motion- guided masking for spatiotemporal representation learning

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.786983Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.289604Z digest=sha256:b5334fdfe53fc127d48d7556b82ca5e8e4c0aa1aa8ff5c6f18f0103b8a49fa12

Observation 26fc7600-3081-431a-a748-af829ae4e389 · outbound

This paper cites A large-scale study on unsupervised spatiotemporal representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection A large-scale study on unsupervised spatiotemporal representation learning

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.772537Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.294333Z digest=sha256:c8dd720a509737a4df77f5063bb7439948a39216dd8a938acd82c3939be04a22

Observation c73e85c8-c50c-4b60-84c0-3b1c4ef79649 · outbound

This paper cites Masked autoencoders as spatiotemporal learners.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Masked autoencoders as spatiotemporal learners

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.298798Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.298798Z digest=sha256:297746ef40754cf887e4e539c3a3cbfbfe7d84f6409a7a9e4baa2404c32858b8

Observation dccc737d-1951-4486-a59b-b3d0a11d73a6 · outbound

This paper cites Evolved part masking for self-supervised learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Evolved part masking for self-supervised learning

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.747358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.303291Z digest=sha256:73226d25c788387988a7dd48dac33b431438e0eba49a1c3246e854eccee5bb5f

Observation 49ce48f5-f03d-4abf-9c54-aa03f83cfe47 · outbound

This paper cites Self-supervised video representation learn- ing with odd-one-out networks.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Self-supervised video representation learn- ing with odd-one-out networks

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.731987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.307835Z digest=sha256:2bb0abcbf4ffc91a4e02dff006d6d7ca3c548aff43e9a611f49ac5600b1ab8d7

Observation 602587dc-2f1b-4755-afbb-9cde839747d9 · outbound

This paper cites Omnimae: Single model masked pretraining on images and videos.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Omnimae: Single model masked pretraining on images and videos

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.716772Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.312326Z digest=sha256:ee8c21e8dcbbf74307caa6f23aa4705cde027d82746055873eac79da52577b6b

Observation 9f219456-65fd-4bad-bf76-141f15ba2df5 · outbound

This paper cites Reinforcement learning for language mod- els.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Reinforcement learning for language mod- els

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.701744Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.316743Z digest=sha256:fd7ccd6b3d1ed5ebb10d2fe6141e9cb932327f5e455f74e3a9b5c614c47f65b2

Observation fd42de66-1e6f-445e-9faa-b2734348f35d · outbound

This paper cites Unsupervised learning of spatiotemporally coherent metrics.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Unsupervised learning of spatiotemporally coherent metrics

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.686644Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.321421Z digest=sha256:d79f349a29441237b13729f360b69af254babebe74f8823bf70001ac5747db8f

Observation efb2d874-002c-466d-9828-e98f75ee0e42 · outbound

This paper cites The” something something” video database for learning and evaluating visual common sense.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection The” something something” video database for learning and evaluating visual common sense

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.671660Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.326072Z digest=sha256:cdf0cdf953eea359b4e66d9f18d5c6b4fa43f10e4b52078e35b39060e9a4f2fb

Observation 1c56b44f-83d5-47d5-a4ce-b4e65c4331f6 · outbound

This paper cites Video repre- sentation learning by dense predictive coding.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Video repre- sentation learning by dense predictive coding

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.656308Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.330690Z digest=sha256:c7552bf0f545d80c3a0f9bf1f73d0c32ea05e96b41f91e651150ee0b3f8f6f51

Observation d7fa5d87-302d-46a6-9d19-9bfef0ae0c1e · outbound

This paper cites Self- supervised co-training for video representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Self- supervised co-training for video representation learning

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.641950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.335223Z digest=sha256:e439aa74af82f687060a0de939d002b834babafb3789effc1a582107d81cbebb

Observation c29b23f2-ebc8-4026-8044-229c5c797b27 · outbound

This paper cites Masked autoencoders are scalable 9 vision learners.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Masked autoencoders are scalable 9 vision learners

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.628358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.339857Z digest=sha256:e7704e9646b28711e20c85fb3babbe5c44a99f5cf80426f6600d7ae6959bd263

Observation 3be9baad-e4a4-4af1-8067-7d647389d279 · outbound

This paper cites Using self-supervised learning can improve model robustness and uncertainty.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Using self-supervised learning can improve model robustness and uncertainty

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.613390Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.344302Z digest=sha256:12baee59009367a752fb473ed31aae174889969561b6e513548acc12c94323f9

Observation 2c91c85f-4714-40c4-bb2d-26a0195321f1 · outbound

This paper cites Mgmae: Motion guided masking for video masked autoencoding.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Mgmae: Motion guided masking for video masked autoencoding

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.598267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.348970Z digest=sha256:214c31d6203c7d176e54cffa5760baf656737e2f8dd0efd0591c0f90128dbc5c

Observation aab6526b-9d3c-4009-9ff9-81c371c51f42 · outbound

This paper cites Everest: Efficient masked video autoencoder by removing redundant spatiotemporal tokens.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Everest: Efficient masked video autoencoder by removing redundant spatiotemporal tokens

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.583153Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.353753Z digest=sha256:c4c41e00c23dcde6c2aa115658fe117e49d6c8aef883f1f1ac387efac5a4bd73

Observation 7855792d-54bc-4f48-8396-06e78e46c649 · outbound

This paper cites Categorical Reparameterization with Gumbel-Softmax.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Categorical Reparameterization with Gumbel-Softmax

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.358356Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.358356Z digest=sha256:53faf7c5daaf595c1e986acc33f9b07287ece2f7f0e248fa0a75ee448907da8b

Observation afcc3b9e-c644-4b97-81b7-065c645dc4d2 · outbound

This paper cites What to hide from your students: Attention- guided masked image modeling.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection What to hide from your students: Attention- guided masked image modeling

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.567083Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.363766Z digest=sha256:3e9ebf82610a0ccb1317d9255024904844c02d4482dbcdf6456f23cac00f52dd

Observation 9f27fe6e-d582-4781-b6c4-c21d96642c9d · outbound

This paper cites The Kinetics Human Action Video Dataset.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection The Kinetics Human Action Video Dataset

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.368747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.368747Z digest=sha256:5e4274b3b4f87930e6842dd3343d20c3e82857a759f055c69f3b557b4e84f8ac

Observation aaa9e343-87b6-4480-b528-4f3f9cf10137 · outbound

This paper cites Bert: Pre-training of deep bidirectional transform- ers for language understanding.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Bert: Pre-training of deep bidirectional transform- ers for language understanding

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.550534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.374429Z digest=sha256:69384f7a6d21ffb11942c2c892b0e50c6506ee00b3ffa8108574654a878616ac

Observation b7be5f72-fe6d-416b-b3d2-0d21401e4f06 · outbound

This paper cites Hmdb: a large video database for human motion recognition.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Hmdb: a large video database for human motion recognition

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.535250Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.379070Z digest=sha256:b0bbb1e72d3ac6c482c06ae51bf383a34a64694932fd6523a2760ae9e17c166b

Observation a62873de-d529-401f-9eca-2bb005eade60 · outbound

This paper cites Unsupervised representation learning by sorting sequences.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Unsupervised representation learning by sorting sequences

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.521298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.384829Z digest=sha256:fcfe215df540bd372941dbac6561c680f3d5f087b642683f95da68fd592aeb29

Observation f4e51637-d4b9-40d3-9c10-075b8775bbe8 · outbound

This paper cites Semmae: Semantic-guided mask- ing for learning masked autoencoders.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Semmae: Semantic-guided mask- ing for learning masked autoencoders

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.506685Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.389225Z digest=sha256:6a4765a0dc2335ae012b3f86df0fb57196f699ed29598c73a55c285dc91e3445

Observation b9cbab6a-c058-45d4-babb-5dee076270d1 · outbound

This paper cites Uniform Masking: Enabling MAE Pre-training for Pyramid-based Vision Transformers with Locality.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Uniform Masking: Enabling MAE Pre-training for Pyramid-based Vision Transformers with Locality

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.393495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.393495Z digest=sha256:2513e0245ca1578f517d45e562c50eb7f80eea87812e0a8a707c441d18550e7b

Observation 063d91a8-9d80-4dba-9d63-6074ce889b21 · outbound

This paper cites Deep predictive coding networks for video prediction and unsu- pervised learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Deep predictive coding networks for video prediction and unsu- pervised learning

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.488841Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.398505Z digest=sha256:e498767b9e65a866993e25c61e53331a9579edc5580f0fca4c51a4f8b0728432

Observation ed48cf8f-a264-44ab-9828-d2cf89339c2f · outbound

This paper cites Cl-mae: Curriculum-learned masked autoencoders.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Cl-mae: Curriculum-learned masked autoencoders

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.472549Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.403165Z digest=sha256:dafe8f1ed36b3ab1b9d7fdcd62ab15dc70605fc5a32e553a2a5896744c36e144

Observation 66401026-9a94-4be3-9c84-6a6d4dce65cd · outbound

This paper cites Deep multi-scale video prediction beyond mean square error.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Deep multi-scale video prediction beyond mean square error

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.456123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.407824Z digest=sha256:72ccde71ee292dfc0554c0b633d4f38194fdfdaadb42976f45349b04918fd6ce

Observation 1e72860e-e54c-45b1-82a2-d3f01d27b3d9 · outbound

This paper cites Shuffle and learn: unsupervised learning using temporal order veri- fication.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Shuffle and learn: unsupervised learning using temporal order veri- fication

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.440100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.412537Z digest=sha256:d1d0e58844611691da8f680b752a5e4c531e12d3b410b47137620d8e3e933aa2

Observation f76d39d1-452d-4d92-92f9-f98cf19aa301 · outbound

This paper cites Oswald, Alexander Kirillov, Cees G.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Oswald, Alexander Kirillov, Cees G

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.424699Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.417478Z digest=sha256:5384e51d28f349012d7aef62bee7441622f0c7af535f69bb2d1929d22a1abbad

Observation d96bb54e-0cbc-4964-9a3a-61b33d0cdbc4 · outbound

This paper cites an unresolved cited work.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Unresolved cited work

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.422423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.422423Z digest=sha256:4bfdd8ccebe59158197eff24a5ab6febaf9733ab045e389877b74bb0e431beb7

Observation f6815896-74e7-4a66-8d98-e5bf5f7ffbaa · outbound

This paper cites Learning features by watching objects move.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Learning features by watching objects move

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.399046Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.427072Z digest=sha256:7a0ce80dd65cdbfb149b51461aaf8ef0bd142991282da41cdfaebe01be61feb7

Observation 5745f6dd-25b5-42a8-8313-b22a528423d6 · outbound

This paper cites Keeping your eye on the ball: Trajectory at- tention in video transformers.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Keeping your eye on the ball: Trajectory at- tention in video transformers

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.382879Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.431640Z digest=sha256:8cbd03b7572c09d743116b9c163b3d1bcfb05931ca4af1fe9c7af94e829e88ba

Observation cf4196cd-9df5-457e-b0aa-ba29e603b4d7 · outbound

This paper cites Spatiotempo- ral contrastive video representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Spatiotempo- ral contrastive video representation learning

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.436800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.436800Z digest=sha256:339641da296c215063fff3fa03a366ece279eb430a09d2af2d309408d644080d

Observation 59138987-f182-4563-a1e2-e1c46b18cd87 · outbound

This paper cites Learning transferable visual models from natural language supervi- sion.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Learning transferable visual models from natural language supervi- sion

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.356614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.441850Z digest=sha256:10ec02db39a14f139c177f9373a96750758459da2fbcceb33cdf6261c4a3b282

Observation f4ae26ec-5c87-4f62-9f0a-f77ef7c8ebe9 · outbound

This paper cites Zero-shot text-to-image generation.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Zero-shot text-to-image generation

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.446515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.446515Z digest=sha256:bd14b5d5e5eadf071e9797cc0e7cf48cb34f04cd72555de1c6cc3cc799159b78

Observation 31ad8e4a-5e9d-4381-b745-f67c54c2a720 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Proximal Policy Optimization Algorithms

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.451455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.451455Z digest=sha256:26a9ffff31bd28ff1ec832d80918898401d5e73ff2a90d422013d50ca6999aab

Observation d55fd36d-48ff-4fe3-9ab3-e8fdf3907b7b · outbound

This paper cites Adversarial masking for self-supervised learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Adversarial masking for self-supervised learning

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.331515Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.456367Z digest=sha256:97fd097e53a3b9ebc1e9567efe46c4177d8142aef005bd9f71f7b5412afe943f

Observation e3d7e413-fe2e-4c50-a0d6-628f3deb2e55 · outbound

This paper cites UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.461287Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.461287Z digest=sha256:31379c39cb3a153350e98a030c4f142d6418a4f2794379e7f7165ba07a1eda93

Observation c4edf3dd-42e5-4a5e-9843-a4082010dd57 · outbound

This paper cites Learning Video Representations using Contrastive Bidirectional Transformer.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Learning Video Representations using Contrastive Bidirectional Transformer

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.466300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.466300Z digest=sha256:98e7fe1269a7a94e3359269edd47c92d3f7f2d2a0d80f235e25ffa25fe2162fe

Observation 022db088-2d15-412c-b117-5bfd2d0885cb · outbound

This paper cites Masked motion encoding for self-supervised video representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Masked motion encoding for self-supervised video representation learning

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.314528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.471756Z digest=sha256:1a56acfa1f2ef36c2a1facfde20139803569d7001b31026f5761194cc44dddcf

Observation aba5a830-a61a-4562-89a4-75e8a4214508 · outbound

This paper cites Raft: Recurrent all-pairs field transforms for optical flow.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Raft: Recurrent all-pairs field transforms for optical flow

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.297064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.476322Z digest=sha256:e10073b6063351acc25395e1f4763753bfd19d24d130ba9efd43f222bb8f8831

Observation 9631e057-8b94-4cb4-975f-b82bd14d3dc5 · outbound

This paper cites Video- MAE: Masked autoencoders are data-efficient learners for self-supervised video pre-training.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Video- MAE: Masked autoencoders are data-efficient learners for self-supervised video pre-training

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.280299Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.481855Z digest=sha256:17158211935a19269c09fe232c7a3ee24ccb8521c76e29dffc8ec72e3a393e85

Observation 172285a1-73ad-4df9-9155-92ec820ec08b · outbound

This paper cites Neural discrete representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Neural discrete representation learning

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.486544Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.486544Z digest=sha256:82aa7121e8642fc1c9dad09bca78f863925ae7b6ff5c1ef149c51da5d88781a3

Observation 4157729b-29f8-492d-8c72-081523efb4dd · outbound

This paper cites Attention is all you need.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Attention is all you need

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.491586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.491586Z digest=sha256:3631cb8c5188f1816f209e9a627c4f27a7c34f09369e3aea27a221698917e7db

Observation 74fce342-f55a-4cf8-b249-239d36dc94ea · outbound

This paper cites Extracting and composing robust features with denoising autoencoders.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Extracting and composing robust features with denoising autoencoders

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.242196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.496147Z digest=sha256:d4d9a3368587c517a047bd5f968452974ff34d76751d51fb2b47665adfea0186

Observation d54e986b-6ba1-4978-aef7-c6a75364ce3c · outbound

This paper cites An- ticipating visual representations from unlabeled video.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection An- ticipating visual representations from unlabeled video

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.226590Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.500837Z digest=sha256:27db5714eab97e614d6191766b8aac2a20fb6a5bb007f551f0ae11d1d6758632

Observation 13c01e24-7eec-41e1-85de-b53cca3c332c · outbound

This paper cites Tracking emerges by col- orizing videos.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Tracking emerges by col- orizing videos

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.170184Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.505625Z digest=sha256:1b4be0e046bf6b3f79f2f4a9110a09203166debf969878bf6a44ac3b67e90114

Observation 12f63dfb-5c89-41b1-8696-7668dd521ae1 · outbound

This paper cites Self-supervised spatio-temporal representation learning for videos by predicting motion and appearance statistics.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Self-supervised spatio-temporal representation learning for videos by predicting motion and appearance statistics

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.099994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.510955Z digest=sha256:c7322ea2eae1aeccba57569be7105334a84e84b4267ecdbe26f8da1865d5e13f

Observation c717fb67-d06b-47eb-98e6-43e0daf7e394 · outbound

This paper cites Videomae v2: Scaling video masked autoencoders with dual masking.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Videomae v2: Scaling video masked autoencoders with dual masking

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.082787Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.515456Z digest=sha256:8243ab7d4cff277f543f8df81fdad976b4c84245194bababb25576ab9ee3c5f6

Observation b3e59620-f5c3-4a88-bc0a-e36e7a6aba4a · outbound

This paper cites Bevt: Bert pretraining of video transformers.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Bevt: Bert pretraining of video transformers

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.065414Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.520682Z digest=sha256:5fefd657c5413ce80f444b0f007d30634b48222f9686e03f538294441e6ceb00

Observation 4b69c861-14b6-43ab-a7b2-bba6b1f91b47 · outbound

This paper cites Masked video distillation: Rethinking masked feature mod- eling for self-supervised video representation learning.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Masked video distillation: Rethinking masked feature mod- eling for self-supervised video representation learning

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.049126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.526018Z digest=sha256:bccdce5ad6601084024b65a267bfb0f0dd45769f2645d1fc23e59aee94dec22f

Observation f0dd86e0-dd55-47f1-a485-7b0bc45e6604 · outbound

This paper cites Unsupervised learning of visual representations using videos.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Unsupervised learning of visual representations using videos

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.032115Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.530780Z digest=sha256:bad96193a8fecb5b3c925b6f0172ef6d3f40541ab74e05874fef47ea15d5cc54

Observation 0620a0f1-3273-462e-a129-5cecb358ec23 · outbound

This paper cites Learning correspondence from the cycle-consistency of time.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Learning correspondence from the cycle-consistency of time

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:22.002449Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.535511Z digest=sha256:97e46ae687cf37d2d5dc14ca811532b650003c454a47302d86b9f4ef868ac732

Observation adc99540-6c9d-4b5b-96e2-1dab3041796a · outbound

This paper cites Masked feature predic- tion for self-supervised visual pre-training.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Masked feature predic- tion for self-supervised visual pre-training

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.955567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.540871Z digest=sha256:0fe3f9ba4e814d1e0a643205ddbb199d9341763b881a6b47f98531ccee310a8f

Observation 82348a76-1cff-4ac7-a71e-9104452b7700 · outbound

This paper cites Learning and using the arrow of time.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Learning and using the arrow of time

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.939267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.545577Z digest=sha256:b69539544fa2947278982e38cec619e8be1ea1a2d1a83870953df2d530fcae6a

Observation 12651564-55af-4dcf-a1ee-1e0994462feb · outbound

This paper cites Efficient vision- language pre-training by cluster masking.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Efficient vision- language pre-training by cluster masking

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.920862Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.550600Z digest=sha256:1a9d321b36ae0863af20104f08f6e526d70145da4647fd367dc91cd107cbb4be

Observation 9913fb91-343c-47fe-8e8f-1aa7da67174f · outbound

This paper cites Williams.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Williams

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.902411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.555760Z digest=sha256:ff1fd5a72b1c9649e2935597404a6e2659c2fb9f843a9bf0413b3a4eade05c8c

Observation 446de0e2-b8d3-4ecd-ab48-3706d7737dd4 · outbound

This paper cites Slow feature analysis: Unsupervised learning of invariances.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Slow feature analysis: Unsupervised learning of invariances

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.884972Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.561423Z digest=sha256:6503b0d9b6ace553cee5ced71938766cd05d7abca7008b9be506843708657ed4

Observation 17f7758e-e85a-49aa-8f71-3d47434653b2 · outbound

This paper cites Masked frequency modeling for self-supervised visual pre-training.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Masked frequency modeling for self-supervised visual pre-training

Reference 69

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.868947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.566441Z digest=sha256:f384f999b4e642343647832f20b01a98dda768cb623073a49ef27c0c89805539

Observation 4fe288e0-1f11-4637-8ac0-3b87dbcfd13d · outbound

This paper cites Simmim: A simple framework for masked image modeling.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Simmim: A simple framework for masked image modeling

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.850705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.572311Z digest=sha256:b02b299ba7648217b7dede5e43ba07563f93af83848a8849ecbdc1b0912b3e34

Observation 52cd698a-d424-4650-b2a1-32127a0c9bb4 · outbound

This paper cites How mask mat- ters: Towards theoretical understandings of masked autoen- coders.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection How mask mat- ters: Towards theoretical understandings of masked autoen- coders

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-15T21:55:21.577435Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:55:21.577435Z digest=sha256:ef3be54d060925b9ed850fac8eee2a46ffd1c7088ffba46870ba2b21dd09df26

Observation e78b7c37-b539-44ca-a3c0-cb69f9262175 · outbound

This paper cites Image BERT pre-training with online tokenizer.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Image BERT pre-training with online tokenizer

Reference 72

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.819842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.581982Z digest=sha256:96bc278b8f792a374b523b9c8a1cf7033e449f2d285db99f103dc13c2497a81e

Observation c250d101-8781-4096-8bec-ace125e506e0 · outbound

This paper cites Each video depicts a single action with a duration ranging from 2 to 6 seconds.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Each video depicts a single action with a duration ranging from 2 to 6 seconds

Reference 73

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.802527Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.586648Z digest=sha256:f166e2eeab2a22435a317507d51086d607fb5c0fd1b7826e94e0c5c16eb14f92

Observation 9b7a02ea-4b96-48a7-b830-072355ec7428 · outbound

This paper cites Data Preprocessing Our data processing pipeline closely follows AdaMAE [4] for pre-training.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Data Preprocessing Our data processing pipeline closely follows AdaMAE [4] for pre-training

Reference 74

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T21:55:21.784743Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.592155Z digest=sha256:f06fdf354303595d4070afd6573a7834e87dfa7139eedd2f4c466c95f68bd344

Observation 651237d2-40a2-4c09-9978-bef3cdb967eb · outbound

This paper cites an unresolved cited work.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Unresolved cited work

Reference 75

Resolution
unresolved
raw_fallback, observed 2026-08-15T21:55:21.766661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.597248Z digest=sha256:3e41d89ff29be3e0f3f10b3ad47c2d57ae156344eca91e73b0c6d941c8251406

Observation cc5fc016-76eb-47da-b739-5c841254d1ab · outbound

This paper cites an unresolved cited work.

Reinforcement Learning meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection Unresolved cited work

Reference 76

Resolution
unresolved
raw_fallback, observed 2026-08-15T21:55:21.748161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T21:55:21.602712Z digest=sha256:d59b560c90c31cf967b6249498728324e296bda15851148290c8ae0a1dc80ef0

Pith citing papers

No inbound Pith citation observations are available.