{"as_of":"2026-08-19T03:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a79d0ecb4567997e74f6de2e3f763e38169cab0c4917b52f4bd844a10e063ca9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:57:07.433040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:06:27.676592Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-08-12T18:35:01.842737Z","title":"Temporal-spatial feature pyramid for video saliency detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11454","last_updated":"2024-11-18T10:42:27Z","snapshot_observed_at":"2026-08-17T15:16:12.686014Z","submitted_at":"2024-11-18T10:42:27Z","title":"Relevance-guided Audio Visual Fusion for Video Saliency Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:01.842737Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2411.11454"},"observation_digest":"sha256:0f0196fb797b0c8fb300450fb13a355667e9d85e8b0d6f31f51a71ba6fb1ed52","observation_id":"9785c31e-4b64-42b5-a0d1-a05621c22116","resolution":{"observed_at":"2026-08-12T18:35:01.842737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-08-09T19:13:03.404771Z","title":"Temporal-spatial feature pyramid for video saliency detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00397","last_updated":"2025-02-01T11:05:28Z","snapshot_observed_at":"2026-08-19T00:01:59.303636Z","submitted_at":"2025-02-01T11:05:28Z","title":"Minimalistic Video Saliency Prediction via Efficient Decoder & Spatio Temporal Action Cues","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T19:13:03.404771Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2502.00397"},"observation_digest":"sha256:eb24174649b564e8f36e38863c59f84ad6912b213c2d5008effcc057ffe3d3b0","observation_id":"1fb34a7e-f573-4d0a-b98e-6a4f6650a71b","resolution":{"observed_at":"2026-08-09T19:13:03.404771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-08-09T13:10:15.662276Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02172","last_updated":"2025-02-04T09:45:52Z","snapshot_observed_at":"2026-08-17T11:59:31.270909Z","submitted_at":"2025-02-04T09:45:52Z","title":"EditIQ: Automated Cinematic Editing of Static Wide-Angle Videos via Dialogue Interpretation and Saliency Cues","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T13:10:15.662276Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2502.02172"},"observation_digest":"sha256:df9a07a4008f97032626c9538f0f830c554c5bf8f6ee2598086419d44fd8ee08","observation_id":"6b078949-2915-41c2-96ff-e5404cd432b6","resolution":{"observed_at":"2026-08-09T13:10:15.662276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-08-16T11:57:07.433040Z","title":"Temporal-spatial feature pyramid for video saliency detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14267","last_updated":"2025-04-19T11:30:54Z","snapshot_observed_at":"2026-08-16T11:50:37.302799Z","submitted_at":"2025-04-19T11:30:54Z","title":"Text-Audio-Visual-conditioned Diffusion Model for Video Saliency Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:57:07.433040Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2504.14267"},"observation_digest":"sha256:23d7daaea9f9c13f3fb46fb8a2a0789b4761ac07a75ed319126e27ac9085e9aa","observation_id":"461dd6b5-0bfe-4385-8a93-c3693a9947b7","resolution":{"observed_at":"2026-08-16T11:57:07.433040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":"2105.04213","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-07-02T02:06:27.676592Z","title":"Temporal-spatial feature pyramid for video saliency detection","venue":null,"work_id":"913c435d-6f29-4c45-9881-c799e101bf56","year":2016},"citing_paper":{"arxiv_id":"2604.08858","last_updated":"2026-04-10T01:45:47Z","snapshot_observed_at":"2026-08-12T21:18:58.549117Z","submitted_at":"2026-04-10T01:45:47Z","title":"BIAS: A Biologically Inspired Algorithm for Video Saliency Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:37.810179Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2604.08858"},"observation_digest":"sha256:0e0d41786c4be080087eca2caae07b0312a09ed122d932260133ae6623ab95dd","observation_id":"6bc58f84-6c81-4100-9147-52d93e66bf90","resolution":{"observed_at":"2026-05-11T00:41:03.260794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":"2105.04213","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-07-02T02:06:27.676592Z","title":"Temporal-spatial feature pyramid for video saliency detection","venue":null,"work_id":"913c435d-6f29-4c45-9881-c799e101bf56","year":2016},"citing_paper":{"arxiv_id":"2605.23790","last_updated":"2026-05-22T15:52:01Z","snapshot_observed_at":"2026-07-06T23:33:59.210165Z","submitted_at":"2026-05-22T15:52:01Z","title":"Exploring deep learning for Event-Based Saliency Prediction with a Transformer-based model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T04:24:48.915046Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2605.23790"},"observation_digest":"sha256:96bde5189df0392251d2ff9fc7bf3c280526bc057e93239e0e24792be5a75844","observation_id":"d3ab65cc-c247-440d-a7c2-7b73b2a038d8","resolution":{"observed_at":"2026-05-25T04:25:19.154859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":"2105.04213","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-07-02T02:06:27.676592Z","title":"Temporal-spatial feature pyramid for video saliency detection","venue":null,"work_id":"913c435d-6f29-4c45-9881-c799e101bf56","year":2016},"citing_paper":{"arxiv_id":"2605.29302","last_updated":"2026-05-28T03:33:07Z","snapshot_observed_at":"2026-08-17T15:14:37.620014Z","submitted_at":"2026-05-28T03:33:07Z","title":"ViASNet: A Video Ad Saliency Network for Predicting Dynamic Saliency and Viewer Engagement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T08:50:03.872247Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2605.29302"},"observation_digest":"sha256:18443a46381a9d242fe9f540512f99b0d7c18f9b07a0d5de0dace9297b6faa87","observation_id":"4d39d212-8089-4e8e-8bf0-4059322f9912","resolution":{"observed_at":"2026-06-29T08:53:15.892339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection","version":2},"cited_work":{"arxiv_id":"2105.04213","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04213","snapshot_observed_at":"2026-07-02T02:06:27.676592Z","title":"Temporal-spatial feature pyramid for video saliency detection","venue":null,"work_id":"913c435d-6f29-4c45-9881-c799e101bf56","year":2016},"citing_paper":{"arxiv_id":"2606.03540","last_updated":"2026-06-02T12:00:21Z","snapshot_observed_at":"2026-08-05T13:50:31.262258Z","submitted_at":"2026-06-02T12:00:21Z","title":"Attend to Anything: Foundation Model for Unified Human Attention Modeling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T11:11:23.887576Z"},"links":{"cited_paper":"/paper/2105.04213","citing_paper":"/paper/2606.03540"},"observation_digest":"sha256:5fd4917ebb8dc014fa99a31caa4c61a1f7967bce0f1e4eebc5a3612b6b383358","observation_id":"a8dbe8d3-1bf3-4282-afd8-6523f7998d3b","resolution":{"observed_at":"2026-07-02T02:06:27.678700Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2105.04213/citation-record","integrity":"/paper/2105.04213/integrity","json":"/paper/2105.04213/citation-record.json","paper":"/paper/2105.04213"},"outbound":[],"paper":{"arxiv_id":"2105.04213","last_updated":"2021-09-14T00:40:20Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T18:25:54.944418Z","submitted_at":"2021-05-10T09:14:14Z","title":"Temporal-Spatial Feature Pyramid for Video Saliency Detection"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2105.04213."}