{"as_of":"2026-08-09T15:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4fbc581b1f388be8d75c7c8ae8269646bf312c59fdb23a796027756394a6691","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:35:20.884050Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.04584/citation-record","integrity":"/paper/2602.04584/integrity","json":"/paper/2602.04584/citation-record.json","paper":"/paper/2602.04584"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.091828Z","title":"F.743-10 - Requirements for mobile edge computing-enabled content delivery networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.091828Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:4bd49eb082b46df41fa63c3173027c6eed02ee02e9e0e97fff47446e8d077e24","observation_id":"bb0f5b5e-4f6f-4e55-8772-0ad16d1a0a4e","resolution":{"observed_at":"2026-08-03T04:35:15.091828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.205421Z","title":"A feature-based approach for saliency estimation of omni-directional images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.205421Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:e5258bc550d21e1f9f87d89f70b8b7f0e5af3e1bc68448f8e1f8b95b4aad106a","observation_id":"3929e1ae-51f6-44f2-b224-5c9799a0dbb6","resolution":{"observed_at":"2026-08-03T04:35:15.205421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.323322Z","title":"Applying Transformer-Based Computer Vision Models to Adaptive Bitrate Allocation for 360° Live Streaming,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.323322Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:dc60315d7d55ecba2c721b41f82b8a6032e62beb478e601ffc6ae05053051d13","observation_id":"6c2ca10f-1e06-44b4-8cfa-7b75f44a090e","resolution":{"observed_at":"2026-08-03T04:35:15.323322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.417600Z","title":"Enhancing 360 video streaming through salient content in head-mounted displays,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.417600Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:bf6a16de4879ba2f71d4608c480ede8ba6a1080ff20566a4f55cb7fcc83d122a","observation_id":"73794244-0690-4b64-82a7-7976e57418dc","resolution":{"observed_at":"2026-08-03T04:35:15.417600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.691274Z","title":"Track: A new method from a re-examination of deep architectures for head motion prediction in 360° videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.691274Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:57068d94a94ec2f3f94fefddd81d6ae5684630714e42de7971045a3e0b7e3695","observation_id":"754e2878-1b21-471a-a374-0ec04218e491","resolution":{"observed_at":"2026-08-03T04:35:15.691274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.789596Z","title":"Optimizing fixation prediction using recurrent neural networks for 360 ◦ video streaming in head-mounted virtual reality,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.789596Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:1ee59bd2949fc31cf5e4549c46810e0bea5b7b605f1ef36296d64aa70a1f2d82","observation_id":"3e574545-6f44-42f3-8a69-2f8b542cb216","resolution":{"observed_at":"2026-08-03T04:35:15.789596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.886023Z","title":"Spherical convolution-based saliency detection for fov prediction in 360-degree video streaming,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.886023Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:034adbcf3be08c2d45b26bebb761035026017e411fac8cbd3bad4a2a2ff6ea04","observation_id":"2901f3c9-58e2-4024-8b21-2c386067c159","resolution":{"observed_at":"2026-08-03T04:35:15.886023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.032436Z","title":"CoLive: An Edge-Assisted Online Learning Framework for Viewport Prediction in 360°Live Streaming,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.032436Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:6bd803086eebb45e13ea060454eb151f99a4623592023ef5f431874c1d62dbb9","observation_id":"6cb41d50-b665-48cb-96d5-dafe99980160","resolution":{"observed_at":"2026-08-03T04:35:16.032436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.088554Z","title":"MADRL-Based Rate Adaptation for 360°Video Streaming With Multiviewpoint Prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.088554Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:0924f691aa127f2e356b54b540110cf4afe6b0dccc14bf28c2c353b1ce1dfdab","observation_id":"502db258-3591-4fef-9d87-741dda61239c","resolution":{"observed_at":"2026-08-03T04:35:16.088554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.176396Z","title":"Towards attention- aware interactive 360-degree video streaming on smartphones,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.176396Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:07e70c03809ff37405f3e4e0c8fb9913aed23dc2ef66664551c62a3de1d69562","observation_id":"4bc907a1-2b27-49aa-a987-88a1ee7805ab","resolution":{"observed_at":"2026-08-03T04:35:16.176396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.243031Z","title":"Viewport prediction, bitrate selection, and beamforming design for thz-enabled 360°video streaming,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.243031Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:28981e41d18fc0567efcb8907fdf35aca2bff620736b2268858e03e96e912f37","observation_id":"451051f3-0e5a-43d7-ba44-fcb102966150","resolution":{"observed_at":"2026-08-03T04:35:16.243031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.15203","last_updated":"2021-10-28T09:29:17Z","snapshot_observed_at":"2026-08-09T05:42:01.477071Z","submitted_at":"2021-05-31T17:59:51Z","title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.15203","snapshot_observed_at":"2026-08-03T04:35:16.332249Z","title":"Segformer: Simple and efficient design for semantic segmentation with transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.332249Z"},"links":{"cited_paper":"/paper/2105.15203","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:96c0e82fec3d91f29bbe6603f6ce47a2be009cc61742f2bc1ad68e48c4c81a1a","observation_id":"6d264bf6-8e43-4455-88c6-7e61112ce49c","resolution":{"observed_at":"2026-08-03T04:35:16.332249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.383986Z","title":"Predicting head movement in panoramic video: A deep reinforcement learning approach,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.383986Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:45b8a4d9e97600f557f649d5ea4aa227b25926d4c78383bae85317dd4eedf779","observation_id":"dd13299c-d75d-419d-bc4b-3698437d0dcd","resolution":{"observed_at":"2026-08-03T04:35:16.383986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.476581Z","title":"Gaze Prediction in Dynamic 360° Immersive Videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.476581Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:c950c1f3c76d36e9e9ef726bc65eedd2dd5281dcbd69084678497fd10a4d6284","observation_id":"29998be4-3316-4c17-94f2-2cf52786f512","resolution":{"observed_at":"2026-08-03T04:35:16.476581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.562880Z","title":"Saliency Detection in 360° Videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.562880Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:b049b54ad616f625bd43597c56bb31ea34e8b062446436cd55fe3f3b4b75bb3b","observation_id":"ecb49d93-f471-442c-845e-945fcef1073f","resolution":{"observed_at":"2026-08-03T04:35:16.562880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.613513Z","title":"TranSalNet: Towards perceptually relevant visual saliency prediction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.613513Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:9be17b1682a6011fcf00093384f19de1d50303f2139cbeae8c412da9014dca9d","observation_id":"ee70f3f1-f897-4ff3-b158-f6b5112d26e4","resolution":{"observed_at":"2026-08-03T04:35:16.613513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.05786","last_updated":"2019-08-15T22:30:50Z","snapshot_observed_at":"2026-08-07T21:28:14.683307Z","submitted_at":"2019-08-15T22:30:50Z","title":"TASED-Net: Temporally-Aggregating Spatial Encoder-Decoder Network for Video Saliency Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.05786","snapshot_observed_at":"2026-08-03T04:35:16.694241Z","title":"Tased-net: Temporally-aggregating spatial encoder-decoder network for video saliency detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.694241Z"},"links":{"cited_paper":"/paper/1908.05786","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:7d98530c7efe5adffd8686137648db33a70740e06dabfffa1b274614d7cba6e8","observation_id":"4ba14048-b278-4e81-ac4b-8ad5d0e6353f","resolution":{"observed_at":"2026-08-03T04:35:16.694241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.759109Z","title":"Spatio-temporal self-attention network for video saliency prediction,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.759109Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:84fe59dd01897cad35e613dd6567f8f43e6fb96f5a42e2537c317f5756e3575f","observation_id":"6efa35b2-f67a-49f4-8d55-7aaab264701c","resolution":{"observed_at":"2026-08-03T04:35:16.759109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:16.874895Z","title":"Revisiting video saliency prediction in the deep learning era,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:16.874895Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:79adcc4a801d7032617c726748554611177607ef5fe8e08f0e8d4fcf6ee0f0a3","observation_id":"746d36c7-34d1-4ec7-be80-1172459f9fa3","resolution":{"observed_at":"2026-08-03T04:35:16.874895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.017185Z","title":"Salsac: A video saliency pre- diction model with shuffled attentions and correlation-based convlstm,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.017185Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:8ecde683a181c2f48b29a069c4a3f573c6411e9a2c4cc406f5e3f0ef2600925f","observation_id":"2bfa16e9-e3bb-4ce0-a155-0f65c03bd0ac","resolution":{"observed_at":"2026-08-03T04:35:17.017185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.154831Z","title":"Droste, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.154831Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:26373860287982d97fb088017b6fb00065628fefcf7233b1fb1c521b3e6c7c5e","observation_id":"97483ad7-9abe-4cc6-803f-bb12fa238b8a","resolution":{"observed_at":"2026-08-03T04:35:17.154831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-03T04:35:17.240158Z","title":"Mobilenets: Efficient convolutional neural networks for mobile vision applications,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.240158Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:faef25bf82a7cfd474bd20f102d28f599a9d601f38c2b1f263ff334a964dac01","observation_id":"2682b814-9876-4a26-95a3-c34e21e86642","resolution":{"observed_at":"2026-08-03T04:35:17.240158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.297181Z","title":"An Ablation Study on 360-Degree Saliency Estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.297181Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:87d7cd8e2d010b7c792565064c03fe3e75cc1d903079bb3928a604bb55a94333","observation_id":"0e1a7208-8c66-4329-a34b-1b41666c42fe","resolution":{"observed_at":"2026-08-03T04:35:17.297181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.450257Z","title":"Your Attention is Unique: De- tecting 360-Degree Video Saliency in Head-Mounted Display for Head Movement Prediction,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.450257Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:2292336a6a624d12d868d87bf9489b00a5624e3fdc6ba35a04455c935d6c4110","observation_id":"cd5b96ef-4250-4913-a2f0-1c9d450b6327","resolution":{"observed_at":"2026-08-03T04:35:17.450257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.490248Z","title":"Track: a Multi-Modal Deep Architecture for Head Motion Prediction in 360°Videos,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.490248Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:e4afc8d0b84671de552ce390f1693a7919aa05c4003a6465c2836906d7a06a07","observation_id":"9b9eedb2-4767-49a1-8a97-3b672b8f14f9","resolution":{"observed_at":"2026-08-03T04:35:17.490248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.583223Z","title":"Viewport prediction with cross modal multiscale transformer for 360°video streaming,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.583223Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:678932088086a45780e0e129d22fcba46129380245f3651ff7cb6299abdc88e3","observation_id":"eb5a04f5-4644-4922-849d-a9f9503a3ca3","resolution":{"observed_at":"2026-08-03T04:35:17.583223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:17.743393Z","title":"Salgan360: Visual saliency prediction on 360 degree images with generative adver- sarial networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.743393Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:4cfc32300f885ce97844541589716ca99c537c77196794cbc2f306f06d8b5205","observation_id":"6c9f4ee8-d72e-4f9c-9321-f9bcbd6fa2ab","resolution":{"observed_at":"2026-08-03T04:35:17.743393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.01081","last_updated":"2018-07-01T18:52:31Z","snapshot_observed_at":"2026-08-08T01:30:47.218585Z","submitted_at":"2017-01-04T17:16:54Z","title":"SalGAN: Visual Saliency Prediction with Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.01081","snapshot_observed_at":"2026-08-03T04:35:17.964647Z","title":"Salgan: Visual saliency prediction with generative adversarial networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:17.964647Z"},"links":{"cited_paper":"/paper/1701.01081","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:02776eebb75291ca20dccda07aed291bd4cb2a3dd838ab0493e35c11ba2163ab","observation_id":"f025aa59-b996-4f2f-a930-623d5e29dbe1","resolution":{"observed_at":"2026-08-03T04:35:17.964647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2661","last_updated":"2014-06-10T18:58:17Z","snapshot_observed_at":"2026-07-06T03:46:00.791740Z","submitted_at":"2014-06-10T18:58:17Z","title":"Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2661","snapshot_observed_at":"2026-08-03T04:35:18.047438Z","title":"Generative adversarial networks,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.047438Z"},"links":{"cited_paper":"/paper/1406.2661","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:42222f0e6e0857f0e41060e55ae0c9413cfbe74434a646454297123b10b58f0c","observation_id":"5120b90a-acbf-4e64-b874-ff63693befad","resolution":{"observed_at":"2026-08-03T04:35:18.047438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:18.149663Z","title":"Panoramic convolutions for360 ◦ single-image saliency prediction,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.149663Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:7c5391b0a5ccc9eccc9725950cf2689bd5588f1a89ffcdd491e0cf43118280c0","observation_id":"1059caa2-818c-4e18-a20c-3ea173fd3fe5","resolution":{"observed_at":"2026-08-03T04:35:18.149663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:18.236556Z","title":"Spherenet: Learning spher- ical representations for detection and classification in omnidirectional images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.236556Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:56adb165396d0642505ff32cf3f9f32da554eb3ab1d091bcf99cc0378418b083","observation_id":"74a48ec8-2348-4e4f-be03-749595041895","resolution":{"observed_at":"2026-08-03T04:35:18.236556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:18.313800Z","title":"Sphere-GAN: a GAN-based Approach for Saliency Estimation in 360°Videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.313800Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:ac8a6aa2ecde7055185823c624b62930a6639867a2d145ec897cc6bf9b3e0c1f","observation_id":"40685c56-f3b9-46e8-b232-4e4344294813","resolution":{"observed_at":"2026-08-03T04:35:18.313800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-06T11:05:16.105361Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-03T04:35:18.428172Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.428172Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:ff0fd7cce040c1ce3e9388803df6b28fe50813ccef0676387d1989661f63b9d2","observation_id":"a6ba9b4d-07d6-4361-b5b1-c4baca2acd52","resolution":{"observed_at":"2026-08-03T04:35:18.428172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01320","last_updated":"2018-06-04T18:42:37Z","snapshot_observed_at":"2026-08-08T11:32:02.508197Z","submitted_at":"2018-06-04T18:42:37Z","title":"Cube Padding for Weakly-Supervised Saliency Prediction in 360{\\deg} Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01320","snapshot_observed_at":"2026-08-03T04:35:18.578719Z","title":"Cube padding for weakly-supervised saliency prediction in 360 ◦ videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.578719Z"},"links":{"cited_paper":"/paper/1806.01320","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:7d51efb5f4de4527a91706ef4cb00ab6efb34e6d679bf5c7bad2c85780f71984","observation_id":"28ffcee9-58f2-49b3-af10-eed561aabc44","resolution":{"observed_at":"2026-08-03T04:35:18.578719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.04214","last_updated":"2015-09-19T11:02:03Z","snapshot_observed_at":"2026-08-07T13:58:38.865727Z","submitted_at":"2015-06-13T03:19:24Z","title":"Convolutional LSTM Network: A Machine Learning Approach for Precipitation Nowcasting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.04214","snapshot_observed_at":"2026-08-03T04:35:18.714733Z","title":"Convolutional lstm network: A machine learning approach for precipitation nowcasting,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.714733Z"},"links":{"cited_paper":"/paper/1506.04214","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:7852733146caeea81da0d76b23a4507fd771d66e0c4554b130bf3c434e6ba0ca","observation_id":"5eb9d6f5-799c-4bcc-be50-9390c7778aa4","resolution":{"observed_at":"2026-08-03T04:35:18.714733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:18.822103Z","title":"Saliency detection in 360°videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.822103Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:ffeeb7d48c4a23e36e86cec5cde174240c2eed2df810aea8229dd59d50440ca5","observation_id":"6d56e79c-c194-40e7-8da4-3e2856863fe6","resolution":{"observed_at":"2026-08-03T04:35:18.822103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:18.905334Z","title":"Viewing bias matters in 360° videos visual saliency prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:18.905334Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:b60be49bccfcee01f6288c4a18b7eef945976be3bca9423c18adb4f1ba781362","observation_id":"e889177a-40d2-4897-8fc5-305f8fddf0c1","resolution":{"observed_at":"2026-08-03T04:35:18.905334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:19.054600Z","title":"Atsal: An attention based architecture for saliency prediction in 360 videos,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.054600Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:aa2e0dd19f385e78e275b6c14d7b0dcbac271d92ce85310c4d5c0a293a7ac3ff","observation_id":"1971f934-4d99-4aeb-a7b4-2df4c0027e6c","resolution":{"observed_at":"2026-08-03T04:35:19.054600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12525","last_updated":"2022-01-29T08:32:19Z","snapshot_observed_at":"2026-08-06T18:53:06.242707Z","submitted_at":"2022-01-29T08:32:19Z","title":"Spherical Convolution empowered FoV Prediction in 360-degree Video Multicast with Limited FoV Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12525","snapshot_observed_at":"2026-08-03T04:35:19.243243Z","title":"Spherical convolution empowered fov prediction in 360-degree video multicast with limited fov feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.243243Z"},"links":{"cited_paper":"/paper/2201.12525","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:bdc6399cab93b7e063d9820994fde29a2d7eb7cdc3111e5fb8a885efa7d874ba","observation_id":"f5658258-e397-4859-84be-0025876a8ac3","resolution":{"observed_at":"2026-08-03T04:35:19.243243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:19.366429Z","title":"Predicting 360° video saliency: A convlstm encoder-decoder network with spatio- temporal consistency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.366429Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:81356384fb433ebab3a74dd4f6036d2ef1fa55728f14511265d2c44095d2ccb6","observation_id":"be61d621-ccc4-4bb7-b815-9e51be71fc1f","resolution":{"observed_at":"2026-08-03T04:35:19.366429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:19.530337Z","title":"Svgc-ava: 360-degree video saliency prediction with spherical vector-based graph convolution and audio-visual attention,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.530337Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:583ce4350281fd930c8e380ae01f70331210d3de16285a68a6e490511835c601","observation_id":"74bcf3dd-bee7-469c-bd01-cb1e4b42f423","resolution":{"observed_at":"2026-08-03T04:35:19.530337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:19.638936Z","title":"Saliency prediction network for360 ◦ videos,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.638936Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:78b360df0d99b6da4106daa0034b68303f3c26d623de702ce238500a2e065b61","observation_id":"64609bb2-fb09-4e65-aef9-f44b3b396a75","resolution":{"observed_at":"2026-08-03T04:35:19.638936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:19.757444Z","title":"Sst-sal: A spherical spatio-temporal approach for saliency prediction in 360°videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.757444Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:44a62c50abf4849b1eda392cd4158bc10a0d30131616dc1a6a2ad463233ca60a","observation_id":"ce0482b4-7416-4261-9043-6fcde61bb71f","resolution":{"observed_at":"2026-08-03T04:35:19.757444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:19.938870Z","title":"360spred: Saliency prediction for 360-degree videos based on 3d separable graph convolutional networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.938870Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:52891db84c870492e3414ffb994a80d7d7130e8c543738e7a11a7ed3186fb9d5","observation_id":"91845234-4e68-4bae-8b4d-13ae2b2891fd","resolution":{"observed_at":"2026-08-03T04:35:19.938870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:20.042202Z","title":"Rotation equiv- ariant graph convolutional network for spherical image classification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.042202Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:de7243545bc10bbae461ff8e8bd469b330583bbf3b75330bfa9030b770f96ce0","observation_id":"59c92916-997f-481e-9726-46f77e45a73a","resolution":{"observed_at":"2026-08-03T04:35:20.042202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:20.109066Z","title":"Viewing bias matters in 360° videos visual saliency prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.109066Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:555ec53ff06ba50468d227f3153836bf59dc77de96fa40f85a899c63a6d42cc7","observation_id":"05342dff-f92a-4e2f-8b27-fb86bb643ac9","resolution":{"observed_at":"2026-08-03T04:35:20.109066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-03T04:35:20.179191Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.179191Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:9745bc9f8a39f3ae9fa012e3d8ae6f51832828aaf855dc91058bc575d4c0d538","observation_id":"3ae7d31a-b3a4-4e2f-aa70-c7996eeb702f","resolution":{"observed_at":"2026-08-03T04:35:20.179191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:20.341638Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.341638Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:6832d8ff9b48f0e343a98d16d27145279c276152db7188274b6f1098f964defa","observation_id":"70f77c94-44ab-4752-ab26-b8ad13b2496c","resolution":{"observed_at":"2026-08-03T04:35:20.341638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.05442","last_updated":"2018-10-16T04:41:24Z","snapshot_observed_at":"2026-07-06T05:07:29.254936Z","submitted_at":"2016-08-18T22:23:13Z","title":"Semantic Understanding of Scenes through the ADE20K Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.05442","snapshot_observed_at":"2026-08-03T04:35:20.467526Z","title":"Semantic understanding of scenes through the ade20k dataset,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.467526Z"},"links":{"cited_paper":"/paper/1608.05442","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:49c26e19f2901122cfea8b7d350994e8d85b691eb9e68428989e305a348649ad","observation_id":"36f9b216-9576-40c6-8996-1773fe8955b3","resolution":{"observed_at":"2026-08-03T04:35:20.467526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-03T04:35:20.571975Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.571975Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:2c0afba70e61b3c9b016b302e86fa8f3f86aa6afbae91fa59f68aa17820f91e7","observation_id":"09feb26e-5627-4a97-a9fb-e386cda8e1cf","resolution":{"observed_at":"2026-08-03T04:35:20.571975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:20.663292Z","title":"Torchvision: Pytorch’s com- puter vision library [software],","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.663292Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:015dfea2452b41f12a4deb8a2ea8a2db4e7fe68583998c9eab6e8acf319f5a27","observation_id":"eb280d64-8110-4318-b8f9-70219d2fbf80","resolution":{"observed_at":"2026-08-03T04:35:20.663292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:20.779430Z","title":"What do different evaluation metrics tell us about saliency models?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.779430Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:1fbdf7dac0ac831236697eea249bbbcb60d4739df5fd4e656abb6f4c95e8ecea","observation_id":"444b580d-52a6-41b9-b6e7-bae4e0bc4f01","resolution":{"observed_at":"2026-08-03T04:35:20.779430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:20.884050Z","title":"Introducing un salient360! benchmark: A platform for evaluating visual attention models for 360° contents,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:20.884050Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:ec657d872fe4f13e083410166a500039836048437885f4cc54a53d4d80d50c49","observation_id":"52b37c03-9a92-4e40-a030-0ffacf9308ec","resolution":{"observed_at":"2026-08-03T04:35:20.884050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10600","last_updated":"2020-11-20T19:19:48Z","snapshot_observed_at":"2026-08-04T09:04:43.708573Z","submitted_at":"2020-11-20T19:19:48Z","title":"ATSal: An Attention Based Architecture for Saliency Prediction in 360 Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.10600","snapshot_observed_at":"2026-08-03T04:35:19.137042Z","title":"Available: https://arxiv.org/abs/2011.10600","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:19.137042Z"},"links":{"cited_paper":"/paper/2011.10600","citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:3d7673297fa9e14d08f13e049545014fc15ab01c9ab0583e2922a8a925478f26","observation_id":"f5e1b73e-a736-41f3-9f5d-4a25ae3666f8","resolution":{"observed_at":"2026-08-03T04:35:19.137042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:35:15.543249Z","title":"Available: https://www.mdpi.com/1424-8220/23/8/4016","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T04:35:15.543249Z"},"links":{"citing_paper":"/paper/2602.04584"},"observation_digest":"sha256:2fb914112d369c99d609686a81d7c394841a3ec6d952c860ff7e6bfaa0fc08b8","observation_id":"916a5a94-a711-44e7-94b3-b6a91aad73bc","resolution":{"observed_at":"2026-08-03T04:35:15.543249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.04584","last_updated":"2026-07-13T10:58:45Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T10:30:59.073182Z","submitted_at":"2026-02-04T14:11:00Z","title":"SalFormer360: a transformer-based saliency estimation model for 360-degree videos"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":55,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2602.04584."}