{"as_of":"2026-08-13T03:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee772c78cc8b7288236b8ccf6ffcfbd249230b23c4316b15bdd854600e57598d","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:45:38.580328Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:27:16.709927Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T06:00:58.830819Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18386","snapshot_observed_at":"2026-08-12T21:27:16.709927Z","title":"Switch-a-view: Few-shot view selection learned from edited videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08753","last_updated":"2025-04-10T02:02:49Z","snapshot_observed_at":"2026-08-12T23:13:31.276750Z","submitted_at":"2024-11-13T16:31:08Z","title":"Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T21:27:16.709927Z"},"links":{"cited_paper":"/paper/2412.18386","citing_paper":"/paper/2411.08753"},"observation_digest":"sha256:1b86c5afc4b4b1d7505a1f36b5eb3b9939cbdc87b97797552ff14090e5890d89","observation_id":"a9ae5bc4-44f2-43e1-b13f-e77415b31e02","resolution":{"observed_at":"2026-08-12T21:27:16.709927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"cited_work":{"arxiv_id":"2412.18386","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18386","snapshot_observed_at":"2026-08-07T06:00:58.830819Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","venue":"cs.CV","work_id":"92c30ec4-75ee-4783-91d4-f57009591326","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-09T07:19:17.693738Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":188,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.559413Z"},"links":{"cited_paper":"/paper/2412.18386","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:c1438d716ace05cf1608a82f16487336010343c44f7a17926506b80532d3bcc7","observation_id":"4797b74f-9155-47ed-84a9-277a0af256dd","resolution":{"observed_at":"2026-08-07T06:00:58.834429Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18386/citation-record","integrity":"/paper/2412.18386/integrity","json":"/paper/2412.18386/citation-record.json","paper":"/paper/2412.18386"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.582982Z","title":"A dataset for developing and benchmarking active vision","venue":null,"work_id":"1110831a-8c9f-406f-802c-b23885e89752","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.291451Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:bd1ef83b35e853d58ab6e7c09a57da49e37c17214f3a15412afd1ac5430e33ad","observation_id":"64959c63-0154-46d7-b7f5-969def484dc7","resolution":{"observed_at":"2026-08-11T04:45:39.587961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.568090Z","title":"Automatic editing of footage from multiple social cameras","venue":null,"work_id":"864dcd27-b267-4c83-8d03-5278575aa89f","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.296643Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:965834d60819de83b9e941ed178584e6f07b7b500ec01363d70a9905d5da52be","observation_id":"c4e0d9cd-a624-4119-b945-b64fa50a35d6","resolution":{"observed_at":"2026-08-11T04:45:39.573058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.553262Z","title":"Video-mined task graphs for keystep recognition in instructional videos","venue":null,"work_id":"60a93863-dba9-4044-b619-ead5eb21f3db","year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.302713Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:13285e36e1946fa4fd29b33cee3771877fc2ffa686ad9fc2e0997debb1be72d4","observation_id":"2eb52fd6-db00-46b0-a2ce-cf1d2e572a28","resolution":{"observed_at":"2026-08-11T04:45:39.558244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.538407Z","title":"Contrastive learning for unsupervised video highlight detection","venue":null,"work_id":"70b46c9b-0e48-4d19-9253-33bcc0c75ad1","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.307900Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:47be1a1533deef590fdb31a238540d6ce4a15ed385d21611805cffd975df23c0","observation_id":"6b6f8818-2662-495e-89a2-097f7ee5bedf","resolution":{"observed_at":"2026-08-11T04:45:39.543322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.523457Z","title":"Pyscenedetect","venue":null,"work_id":"f8a091e1-12df-4ff0-b55d-d74793602895","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.312803Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c245bf62849e12569f47d8c2b699ccf1610cfefb7e04050dee7df6bfea11b621","observation_id":"172c3994-fee2-4760-9e4e-989073a25180","resolution":{"observed_at":"2026-08-11T04:45:39.528537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.507275Z","title":"Enhanced interactive 360° viewing via automatic guidance","venue":null,"work_id":"70c64c0d-72c2-4052-a574-e409f01e5044","year":2020},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.317427Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:71dbe5742d7c4c0b410aedbe2884e3e6e1353c914626b5ba8344997b504cfd85","observation_id":"e8cd8aaf-4b3c-4a1f-952c-e4cbc88341cb","resolution":{"observed_at":"2026-08-11T04:45:39.512829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.492030Z","title":"Learn- ing sports camera selection from internet videos","venue":null,"work_id":"47331305-ef89-4674-87b5-200172e504a3","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.322157Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:03f4a6f6b4c65300c05f4561af7f8a69529f9c7d2c19cea210ae3de0d03560b7","observation_id":"e83fcaf9-c70b-40dc-b425-cf5236eabb52","resolution":{"observed_at":"2026-08-11T04:45:39.497577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.476528Z","title":"Geometry-aware recurrent neural networks for active visual recognition","venue":null,"work_id":"53b35d7e-73b5-4933-bb3c-2d58bf975084","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.327418Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:6e2ae99826395d17de5b36568c8799fb131baccee73814c5063f72097a237df6","observation_id":"f0755c91-8814-4c12-aad0-2113fe5e3e8c","resolution":{"observed_at":"2026-08-11T04:45:39.481439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.08664","last_updated":"2017-11-23T12:06:20Z","snapshot_observed_at":"2026-08-04T01:34:38.975772Z","submitted_at":"2017-11-23T12:06:20Z","title":"Self-view Grounding Given a Narrated 360{\\deg} Video","version":1},"cited_work":{"arxiv_id":"1711.08664","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.08664","snapshot_observed_at":"2026-08-11T04:45:38.726925Z","title":"Self-view Grounding Given a Narrated 360{\\deg} Video","venue":"cs.CV","work_id":"bff20ab2-e2a7-443f-b94e-91c2dacbfbde","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.332092Z"},"links":{"cited_paper":"/paper/1711.08664","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:fadf57f9996daa93e04bfb09ac5ea6d388e48eaf45867e97754040a40ac69637","observation_id":"3d547111-4c61-4fbe-ae1d-9b1fa17a62d2","resolution":{"observed_at":"2026-08-11T04:45:38.734482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.461066Z","title":"Video co-summarization: Video summarization by visual co- occurrence","venue":null,"work_id":"7b0ab431-0ce8-437e-8c3d-c8ba983cb5e9","year":2015},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.337075Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c5fcb9069b801a5a9861cb05a3a5fd3353446161848380912848b9b0b4c6f086","observation_id":"942680e6-327f-422c-b288-2529a3bd7ca2","resolution":{"observed_at":"2026-08-11T04:45:39.465739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.446364Z","title":null,"venue":null,"work_id":"e8d37ccc-e79a-4222-8827-4da5d82a174d","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.341521Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:1395474e6d6487c4ccee2c426fd01fb55181ea9c8438658b3c6d8648ed2a7bda","observation_id":"8e6920c8-be44-440b-ac3f-0dc795573c71","resolution":{"observed_at":"2026-08-11T04:45:39.451035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.431668Z","title":"Multi-view active fine- grained visual recognition","venue":null,"work_id":"002207df-0443-45d9-b985-d2f65af434e8","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.346175Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:e24270b7682e43ab4cb3cdcc01e8b3841f7594af72dccf59c2a8701ad00578b6","observation_id":"5409d61a-89cd-43c9-aa35-881cfa294e47","resolution":{"observed_at":"2026-08-11T04:45:39.436541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.416778Z","title":"Multi- stream dynamic video summarization","venue":null,"work_id":"5df5515b-a0c2-46bc-8f59-8ea5c715c088","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.350663Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:07b62bbae34a5a887f20ef7afb5cd143c12d0ee3eaa9cb1be1a5f9c1f2d7c499","observation_id":"170e58b2-cd15-4daa-866c-653a343f2495","resolution":{"observed_at":"2026-08-11T04:45:39.421366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.401792Z","title":"Slowfast networks for video recognition","venue":null,"work_id":"4eaceaef-99eb-4d07-b30d-4188e520e6ea","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.354969Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:54b2dff375d9fe87e7c4d0191ee51de307c05aec9d7450cc36a0a623a9ac6b86","observation_id":"bf86aa3d-3d00-4cb7-8405-9c276d472ec2","resolution":{"observed_at":"2026-08-11T04:45:39.406584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.359513Z","title":"Masked autoencoders as spatiotemporal learners","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.359513Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:07f7e953bc0211a3c61463118ffb5dc515de1494d4d8067a6405765a201df923","observation_id":"d241242a-4f11-4770-9f15-1e5fb6b9a2a5","resolution":{"observed_at":"2026-08-11T04:45:38.359513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.377121Z","title":"Foote and D","venue":null,"work_id":"31759d34-4b59-4b5c-8a75-c78637ddd248","year":2000},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.364044Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:2b728d9844d7dfcd9f230bdc006aad0d78ab240d8a6a7d103d5c8f0d419d3a96","observation_id":"99f89d8a-7f91-44fe-be7f-77e1397e2478","resolution":{"observed_at":"2026-08-11T04:45:39.381626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.363057Z","title":"Towards virtual videog- raphy (poster session)","venue":null,"work_id":"fe702b4a-6aa0-461c-a0c3-ed9866fad8ec","year":2000},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.368480Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:4fb2b227183d15a55ac1b4e4f459580a83667f5ded63c358a46300074f81ca35","observation_id":"bf500d37-7011-4d4d-8e29-ff073dcbea60","resolution":{"observed_at":"2026-08-11T04:45:39.367644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.345950Z","title":"Diverse sequential subset selection for supervised video sum- marization","venue":null,"work_id":"df01077a-8687-40f2-ab69-5772f9c234ad","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.372909Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:69d6d0f40a3bbfb8a177fe4d698d267860e906acf7dd8c6bc7e4e784b92d50e1","observation_id":"65d67ff1-1f17-46d0-bac8-c347134eb0c3","resolution":{"observed_at":"2026-08-11T04:45:39.352633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18259","last_updated":"2024-09-25T21:55:38Z","snapshot_observed_at":"2026-08-08T17:40:49.067743Z","submitted_at":"2023-11-30T05:21:07Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18259","snapshot_observed_at":"2026-08-11T04:45:38.377505Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.377505Z"},"links":{"cited_paper":"/paper/2311.18259","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:beccf51119178e2fda64f1c3e206722f31727dda8f48aaae8256df07a7b62aa2","observation_id":"40e9cb03-c4a9-4446-b201-15841017118b","resolution":{"observed_at":"2026-08-11T04:45:38.377505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.331428Z","title":"Creating summaries from user videos","venue":null,"work_id":"7a7fa733-fd01-4df7-a2a2-8e2ee266cc5a","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.382729Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:8c8b0821f3e5e78532b8089351399f5c1379a46ff62a0dce976417021bacd7f0","observation_id":"8d00574a-2683-476e-9098-d27b27319123","resolution":{"observed_at":"2026-08-11T04:45:39.336203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.315429Z","title":"Align and attend: Multimodal summarization with dual contrastive losses","venue":null,"work_id":"b02e981a-e520-408c-9adb-f25dc0ab87fa","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.386769Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:0c5ae5ca6c1c99220a007a5113157acb4fbc8561209ca0ecac5189d67ee87427","observation_id":"f7beef42-a4ac-416a-888c-e91cc2123812","resolution":{"observed_at":"2026-08-11T04:45:39.320195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.301228Z","title":"Virtual videography","venue":null,"work_id":"39d9ea3f-87bd-4571-b9ad-6b6cde206565","year":2006},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.390861Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c60c4ef325199fa53fdcd1a3eeae6e89114e1007a22a3f735c7e3617a3017e8c","observation_id":"77b75100-b675-4ed8-a9f1-afe08bc6530e","resolution":{"observed_at":"2026-08-11T04:45:39.305649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.285971Z","title":"Deep 360 pilot: Learn- ing a deep agent for piloting through 360deg sports videos","venue":null,"work_id":"84901977-e34e-4ed6-8c40-8b56cc809359","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.394904Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:102afe67189e607d49e5b9c0ea34e96d408c3c9389354adcdccd2bbb839aff91","observation_id":"d20baaf3-d5a4-4d1a-8246-8581798b6c0b","resolution":{"observed_at":"2026-08-11T04:45:39.290999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.271920Z","title":"End-to-end policy learning for active visual categorization","venue":null,"work_id":"7b92ee17-182f-4a56-a58d-33b828b87b93","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.399043Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:29fbc4e07d4c5e5f65a1d59ffa781ef406943cb4087ee43a683e40da968d92c4","observation_id":"0c91de0b-dd0d-41c7-baaf-f52dd0939813","resolution":{"observed_at":"2026-08-11T04:45:39.276690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.258805Z","title":"Matsushita, Xiaoou Tang, and Xue-Quan Chen","venue":null,"work_id":"b4dc2841-14a8-446d-b7d3-161e12bc4d66","year":2006},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.403340Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:37bfa380be15e885860764d6b07736962c378cba7c6680f76ff69d139b6c7511","observation_id":"9d80bcb7-397f-4b3b-8285-1ad8c4f8932a","resolution":{"observed_at":"2026-08-11T04:45:39.262867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T04:45:38.407479Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.407479Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:db056db3bb2f46b6af641f52b1066b995ae05325009a73cfc5ef9729efe60b57","observation_id":"69ac8b99-ec3e-497d-b179-95fc419abde4","resolution":{"observed_at":"2026-08-11T04:45:38.407479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.242454Z","title":"The measurement of observer agree- ment for categorical data","venue":null,"work_id":"5dcff161-0eab-43ba-849e-06c2b8166e17","year":1977},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.412080Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:516da8c0d360c737552ffe666e2b17e952ca7f101ca1545710a1c2dd487e5856","observation_id":"85a58ab5-35e5-4d02-a993-9bdbb8202843","resolution":{"observed_at":"2026-08-11T04:45:39.247034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.227741Z","title":"How local is the local diversity? reinforcing sequential deter- minantal point processes with dynamic ground sets for super- vised video summarization","venue":null,"work_id":"2d30317a-53a3-46e6-867c-48711b9a20fc","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.416463Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b62ccbaec4bec7bb10f666017b5d3de5feb3e91a9d4a66b28c2f82a11d887343","observation_id":"00e36341-22ea-40d5-8bba-8e45a3007e2e","resolution":{"observed_at":"2026-08-11T04:45:39.232664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.211697Z","title":"Ego-exo: Transferring visual representations from third- person to first-person videos","venue":null,"work_id":"1473be4b-5874-4a6a-9376-902bff71eafb","year":2021},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.421252Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:d96ea55223fef307b68cfcd89bd267f8ce470ed562a8f89234c7a5361f147357","observation_id":"dc79eb1d-376d-4970-b09a-cb1c195b9fc8","resolution":{"observed_at":"2026-08-11T04:45:39.217044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.196714Z","title":"Learning to recognize procedural activities with distant supervision","venue":null,"work_id":"0af9d120-1479-4e12-8a67-ae5f27b51f7e","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.425145Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:84c74b10ec36fc27d2f837230e90a1c3fdd9bee7adca64989f5d6f1cac135522","observation_id":"695b4b7a-8c21-450f-89ad-84b5ac109db0","resolution":{"observed_at":"2026-08-11T04:45:39.202108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T04:45:38.429299Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.429299Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:0438910f06afa3bd501018253acc54b957522585b381a3d3e722b08f5e474e4f","observation_id":"f28b5899-7d4e-469c-8aa6-c4fd557c96af","resolution":{"observed_at":"2026-08-11T04:45:38.429299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.182027Z","title":"Story-driven summarization for egocentric video","venue":null,"work_id":"182e272e-eedf-4d31-a821-006f5dd55047","year":2013},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.433533Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:48624d361be3720a4bc0917729a4918d01cb0fdabd550ce13a2b07be1c1da7fd","observation_id":"891de21f-ec13-4572-95ee-43168288f3cb","resolution":{"observed_at":"2026-08-11T04:45:39.186564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.168028Z","title":"X-clip: End-to-end multi-grained con- trastive learning for video-text retrieval","venue":null,"work_id":"70a1bcca-fc65-448a-bb2f-487224bfbec0","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.437315Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c80d7dfc6e77ff68a0621a7c01719f391e45a9ad9120e565a7d89e4f85a781a3","observation_id":"7282ff56-e643-4ea7-8463-b431c64cfc81","resolution":{"observed_at":"2026-08-11T04:45:39.172638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08753","last_updated":"2025-04-10T02:02:49Z","snapshot_observed_at":"2026-08-12T23:13:31.276750Z","submitted_at":"2024-11-13T16:31:08Z","title":"Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08753","snapshot_observed_at":"2026-08-11T04:45:38.441181Z","title":"Which viewpoint shows it best? language for weakly supervising view selection in multi- view videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.441181Z"},"links":{"cited_paper":"/paper/2411.08753","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:f0213939fc110ec8050620f7f9fbc389f62942b7e0f75bc15e500f690c0d708a","observation_id":"6cd707ae-c6d6-4b32-b3a1-eec071956336","resolution":{"observed_at":"2026-08-11T04:45:38.441181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.152187Z","title":"Which viewpoint shows it best? language for weakly supervising view selection in multi-view videos","venue":null,"work_id":"42fe4e37-047a-45f8-8124-247663c49b7d","year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.445420Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:558ca97a6da24a97e9957fa7a9cd14b239ea856643da3e3835c91b3ab0bf30d6","observation_id":"c2bdd9ec-1cb6-468d-b573-16fa47bf731b","resolution":{"observed_at":"2026-08-11T04:45:39.157639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.137537Z","title":"Learning to ground instructional articles in videos through narrations","venue":null,"work_id":"af5aff0b-7654-4101-849c-a90abbe76296","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.449878Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:586cf07a45b41dd078880816adde9798ee7da66f59db84e197b2530c6990957b","observation_id":"b563e8e4-be47-43e1-a297-8a664fd6071a","resolution":{"observed_at":"2026-08-11T04:45:39.141745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.122577Z","title":"Howto100m: Learning a text-video embedding by watching hundred mil- lion narrated video clips","venue":null,"work_id":"cd62266c-97b2-4797-9f11-04c886f6b742","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.454179Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:91b160f01c46f65ccbeed8e46df2a196cbf496e752efd00d3f2c627b23d42af2","observation_id":"e0045961-888f-4944-acff-dcc268355981","resolution":{"observed_at":"2026-08-11T04:45:39.127490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.107149Z","title":"Tl; dw? summarizing instructional videos with task relevance and cross-modal saliency","venue":null,"work_id":"56f726cf-8b8c-4662-81a7-913ca4da7c03","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.458455Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:87b5540172052f34f6808d9e475771ad5e6ff2967c220a1cdeed54ed35f1fcca","observation_id":"da6c7d48-ccd6-4e6c-96dd-96b4e51b6dfc","resolution":{"observed_at":"2026-08-11T04:45:39.111579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T04:45:38.462840Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.462840Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:d028d2df762cb4063a05a38726d2b268557191beaa28b448ec4e2840113f5129","observation_id":"3445b630-9241-4389-946d-f9a648bccac7","resolution":{"observed_at":"2026-08-11T04:45:38.462840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.093176Z","title":"Collaborative summarization of topic-related videos","venue":null,"work_id":"6de5e2ba-8d24-4d41-ae79-47ceb34e3278","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.467272Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:6e18a1c0c9a1b1320c85735f97f5f60c8a86bfae3990752d8d8d08ca6c2cd6c9","observation_id":"99e98174-1800-4762-a9f9-4fa92ab59507","resolution":{"observed_at":"2026-08-11T04:45:39.097512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.078773Z","title":"Category-specific video summarization","venue":null,"work_id":"7d03915d-ecec-49f8-bc9d-7ead1a0acfbe","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.471747Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:99be199245f05bc3c21a3b0f81c446a71656f6e009a2f0a2a92851896d0285e9","observation_id":"4ff8016f-68e2-4eae-8dbb-95f44c2c9b9a","resolution":{"observed_at":"2026-08-11T04:45:39.083334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.054899Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"ce6f3350-b637-4b2c-9617-d76dcc805207","year":2021},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.480337Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:d84397e48f4f387525b310de3eeea6362df737d4468ef18651cd5b530dbe4c28","observation_id":"5fec6bd5-38f3-47d0-8dc2-82921d33016e","resolution":{"observed_at":"2026-08-11T04:45:39.059302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.040899Z","title":"Emergence of exploratory look-around behaviors through active observation completion","venue":null,"work_id":"b91c1ea9-a4c5-4158-9f9e-7f58a004bc1e","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.484752Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:1459e70794d446d7850de4a614070af39dcd6d8a6917369f8bb3599030fcedb9","observation_id":"4b2171b6-6ad3-43d6-8e1d-d34f541708f8","resolution":{"observed_at":"2026-08-11T04:45:39.045848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.026028Z","title":"Video sum- marization using fully convolutional sequence networks","venue":null,"work_id":"6c7d2d3f-2cf8-402c-87c7-d5efa7927b64","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.489210Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c57dadcd8c025e39fc2d5756e835d178501f78b64f0572e64f7e16f7fe64c5c5","observation_id":"c073d3ed-268b-4a50-bd6b-d0adc4bbba6b","resolution":{"observed_at":"2026-08-11T04:45:39.031283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.010778Z","title":"Adaptive video highlight detection by learning from user history","venue":null,"work_id":"e1126b51-0d2e-4928-ba46-243a8310cb6d","year":2020},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.493706Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:64c201568450c6adc18a1de99437e53faf0c948a3895e7ff5902fe404518dab8","observation_id":"893ff574-dd29-42e0-8106-f797cf532c4f","resolution":{"observed_at":"2026-08-11T04:45:39.015778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.994677Z","title":"Chowdhury","venue":null,"work_id":"53b68a7c-4fd8-4873-9dc0-188cfe84dbc4","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.498003Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:0d2d173d858e15c0c725131ecdcad4909685960020c156089a97b1e1159f26e2","observation_id":"183401fd-1ed4-4f30-8cbd-1b59eebb45e8","resolution":{"observed_at":"2026-08-11T04:45:39.000262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.979466Z","title":"Attend and segment: Attention guided active semantic segmentation","venue":null,"work_id":"5b9e7733-b101-4c8e-9b95-03fce6f13b5f","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.502701Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:d69a6446b7006b7edb5937ed97ecaf173c14e94c9ec2eb5ccea58f29f5573e91","observation_id":"6deadb2a-02ff-4c02-b7df-03a41ba09a82","resolution":{"observed_at":"2026-08-11T04:45:38.984416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.963961Z","title":"Glimpse- attend-and-explore: Self-attention for active visual explo- ration","venue":null,"work_id":"a2126054-d33b-4a25-bc24-7feeabb323ad","year":2021},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.507178Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:338c96be409705f6da4cb53123997a74a99c9dbbdce0034977f027b1cc764ff5","observation_id":"cd0d29b3-45a8-44ee-b574-8945f76e6e0c","resolution":{"observed_at":"2026-08-11T04:45:38.968911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.947460Z","title":"Actor and observer: Joint mod- eling of first and third-person videos","venue":null,"work_id":"de494a2b-04aa-4614-9236-9318de0add7b","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.511510Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:03303692ef0cc3d5ac0b7f5d6fa4c7962793f68c0fca594ca1d172142ef10a47","observation_id":"9496558d-5977-4288-9852-97e83e3968e4","resolution":{"observed_at":"2026-08-11T04:45:38.952569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09626","last_updated":"2018-04-30T16:57:00Z","snapshot_observed_at":"2026-08-07T16:08:52.487917Z","submitted_at":"2018-04-25T15:30:27Z","title":"Charades-Ego: A Large-Scale Dataset of Paired Third and First Person Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.09626","snapshot_observed_at":"2026-08-11T04:45:38.515942Z","title":"Charades-ego: A large-scale dataset of paired third and first person videos","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.515942Z"},"links":{"cited_paper":"/paper/1804.09626","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:ede1fdf7efe303f1dd8abaf062814290c35ee1f7ee084cb8ff1baa70f63cce0b","observation_id":"248d8f1a-60f0-45cc-ac4d-bba43709a442","resolution":{"observed_at":"2026-08-11T04:45:38.515942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.932512Z","title":"Video skimming for quick browsing based on audio and image characterization","venue":null,"work_id":"704a838d-fddd-4649-a922-e4e47745dd01","year":1995},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.520968Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:61591bf7d4a5a3226f4adef0936fbbf0fdc118be5ee0f475f3a1d2eceff5a4ee","observation_id":"e5ec38e7-a8bc-489f-99c3-67f48092fe04","resolution":{"observed_at":"2026-08-11T04:45:38.937314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.917210Z","title":"Tvsum: Summarizing web videos using titles","venue":null,"work_id":"be6814e6-2960-400c-a571-6c804bfab341","year":2015},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.525341Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:09f528930fe139ce67369d852483e9c63cb66a53619fe32444013e4799ed03b8","observation_id":"df7ec7ca-b5b9-4f6a-9954-48cd9f40242d","resolution":{"observed_at":"2026-08-11T04:45:38.922045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.902476Z","title":"Pano2vid: Automatic cinematography for watching 360 10 videos","venue":null,"work_id":"7621b0c5-9e5e-40f8-a311-c84750c273ab","year":2016},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.530022Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:f4a86163d2ea6ae527b9c2c5e3b46f5bfbf7058298b6f78bc631b53903154595","observation_id":"9d7f9bc6-1371-4a73-8778-c1c4e7d0b8b4","resolution":{"observed_at":"2026-08-11T04:45:38.907197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.888432Z","title":"Foote, D","venue":null,"work_id":"7b40ae75-c87e-4ffc-865f-deb15f704404","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.534644Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:ba0e293dcc064f590c2c2c8a4dd9916e3c13bce442db88b086c812dfe6cf9983","observation_id":"30376112-72e8-4a77-b535-6f527e6ef36c","resolution":{"observed_at":"2026-08-11T04:45:38.892805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.538720Z","title":"Coin: A large-scale dataset for comprehensive instructional video analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.538720Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:e3ae80116fc502422ea5510d4a02e13abd64928b0b1ce7032edc08e8b09df71a","observation_id":"10379f0d-71c6-4d45-b595-7bd70f676ae1","resolution":{"observed_at":"2026-08-11T04:45:38.538720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T04:45:38.542833Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.542833Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:21dc8efee136995e37f6575dee3b403405684242fd0492b5185bca7492449c65","observation_id":"4bbcaa26-43c9-4c57-b38a-004442ce4163","resolution":{"observed_at":"2026-08-11T04:45:38.542833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.864250Z","title":"A closer look at spatiotemporal convolutions for action recognition","venue":null,"work_id":"9903fa31-eea1-4af9-843b-0b80dca95903","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.546893Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:4b5c759be0b6407528ba669a4a998b8a712dda14c65822ebb134e3cb9beb017c","observation_id":"2d364283-4996-4fa9-bd66-977e9d31f4dc","resolution":{"observed_at":"2026-08-11T04:45:38.868928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.849781Z","title":"Attention is all you need","venue":null,"work_id":"0d721bd2-dc63-423e-8ced-88974518c27e","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.550868Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:ef521bce746ef5441ca307e54a0371aec2970ac2796093b2b6981ff3fdee944b","observation_id":"6851d7c8-228d-4771-abe5-10f23bfb59fb","resolution":{"observed_at":"2026-08-11T04:45:38.854520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.833771Z","title":"Internvideo2: Scaling foundation models for mul- timodal video understanding","venue":null,"work_id":"24327a4f-bc67-47e7-91b2-afbe3798b818","year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.555224Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:dcf42b833466c510bcb1a220cc12b0c9d90385f40db62780bc59c152766fba73","observation_id":"340d896e-2f61-49da-b820-1fa9938bf79c","resolution":{"observed_at":"2026-08-11T04:45:38.839264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.818402Z","title":"Snap angle prediction for 360° panoramas","venue":null,"work_id":"189945ee-7791-42cf-a1d0-696dac077822","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.559414Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:118a20c2e3b4e3c14056729e0ec6e8759bb5debe96f97ebe57c278bd787ca943","observation_id":"6670a0f9-8674-4eb7-ba73-a9ad3d8ec245","resolution":{"observed_at":"2026-08-11T04:45:38.823638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.801991Z","title":"An au- tomated end-to-end lecture capture and broadcasting system","venue":null,"work_id":"368eba68-9b46-4ee5-a4b0-5e8256ddf829","year":2008},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.563461Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:8ee892ee4b37ecc322127eeb8d29105c1bd1cdc9db343657895b5174e6a8238a","observation_id":"daf8168b-5995-4576-b39e-633773dec8c9","resolution":{"observed_at":"2026-08-11T04:45:38.807267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.787171Z","title":"Summary transfer: Exemplar-based subset selection for video summarization","venue":null,"work_id":"d71ed157-87f9-4467-b34b-f175b70ffc7d","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.567925Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:51150121aecc9c329f6813f509932ee5f1912f1f23ef9aed94b20c66923b6a97","observation_id":"1954ef1f-6365-4c69-84b1-48bcdd080ec6","resolution":{"observed_at":"2026-08-11T04:45:38.791989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.773184Z","title":"Learning procedure-aware video represen- tation from instructional videos and their narrations","venue":null,"work_id":"77f1e8e0-15d4-465d-a8d2-c897ced091ec","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.572278Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:a15b2f79d2cb4b11bd42ea9cfcca6ac9e613a3130ba8e8e104f968499f98da99","observation_id":"f28b4b55-d3e5-4bbe-921f-d46a8f33b90b","resolution":{"observed_at":"2026-08-11T04:45:38.777370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.758502Z","title":"Procedure-aware pretraining for instructional video understanding","venue":null,"work_id":"948c68b6-44e4-4cff-9054-310d6ad6a251","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.576335Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:440833b793d49d45b0c9afd1b9addba651b96bbd270dcb41b61c4501170b7d88","observation_id":"2f82d15f-d141-4d46-b673-269d50af8776","resolution":{"observed_at":"2026-08-11T04:45:38.762898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.744956Z","title":"closeup\" and “wide","venue":null,"work_id":"294e07e6-b774-4843-9748-88e25564f58c","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.580328Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:7f326dd0bca432821b5718d4f3758efc5bb1d8a15eda3ac272594f6bea378797","observation_id":"eb4d8ab4-31bd-4faa-b530-6d88cb3ebba9","resolution":{"observed_at":"2026-08-11T04:45:38.749403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.475995Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.475995Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:74f5d876ea6bf599a3edf068d4b0d60113894ab27c25a453b60a6bf6576aad99","observation_id":"be92e6fb-f080-42ed-ad94-28a7dd3aba51","resolution":{"observed_at":"2026-08-11T04:45:38.475995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T23:13:41.357483Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":54},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 2 inbound Pith citation observations for arXiv:2412.18386."}