{"as_of":"2026-08-21T22:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c3bbdcc69130c5b65a026f2e8b91b1a0701e44f2a1dad645a75a81712570252","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:15:12.043189Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T08:50:05.980191Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"cited_work":{"arxiv_id":"2507.03578","doi":"10.48550/arxiv.2507.03578","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03578","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sun, Skanda Koppula, Dilara Gokay, Joseph Heyward, Etienne Pot, and An- drew Zisserman","venue":null,"work_id":"a691486a-249a-4101-9da5-7dfac5fe2e4f","year":2025},"citing_paper":{"arxiv_id":"2604.27351","last_updated":"2026-04-30T03:02:27Z","snapshot_observed_at":"2026-08-15T05:56:45.851308Z","submitted_at":"2026-04-30T03:02:27Z","title":"Heterogeneous Scientific Foundation Model Collaboration","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T08:50:05.980191Z"},"links":{"cited_paper":"/paper/2507.03578","citing_paper":"/paper/2604.27351"},"observation_digest":"sha256:645ce1a95439bdbe39921a044dbf60f5e8539ff90e874080173ce9ce69a7e974","observation_id":"6edd2d35-4385-4c45-b3be-0f917bf017c1","resolution":{"observed_at":"2026-05-09T04:30:10.750824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03578/citation-record","integrity":"/paper/2507.03578/integrity","json":"/paper/2507.03578/citation-record.json","paper":"/paper/2507.03578"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:20.107828Z","title":"Ac- cessed: November 7, 2024","venue":null,"work_id":"b12c5022-a924-4472-9cf3-a8629b420eaf","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:05.580535Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:dfb16ea48804b080685c7c4974727d6a77ce76ecd9a74af910872141f934b6d6","observation_id":"bd824d81-7dc1-43cc-ac65-1ed12877a45b","resolution":{"observed_at":"2026-08-06T20:15:20.203888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:05.667645Z","title":"Flamingo: a visual language model for few-shot learning.NeurIPS, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:05.667645Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:85bc0c141a09a675e6ab6d6b692bfa2907d00ea46af0c2dba918a216ab6df747","observation_id":"6a2b04ca-dfa7-44c2-af3b-62e48485b8d7","resolution":{"observed_at":"2026-08-06T20:15:05.667645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:19.838019Z","title":"Vivit: A video vi- sion transformer","venue":null,"work_id":"662fafec-8c7b-460a-bd92-72575cf1e30b","year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:05.740023Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:e1182471da8163fb234479af227089d6050ba5243a753bbf871a07e365e42de3","observation_id":"fbf94b98-3803-469a-aa91-306c0abe7191","resolution":{"observed_at":"2026-08-06T20:15:19.970633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:19.613833Z","title":"Foundation models defining a new era in vision: a survey and outlook","venue":null,"work_id":"96648239-e4ec-4d12-ad4f-d02fb5621762","year":2025},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:05.824314Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:553c07764848e8cd3fb9948525469e028ffc0a326063430d7764c2f92175e9d5","observation_id":"31912892-5277-4454-b46d-65e9b49d2e42","resolution":{"observed_at":"2026-08-06T20:15:19.717622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02366","last_updated":"2024-09-14T03:35:04Z","snapshot_observed_at":"2026-08-17T14:16:42.769713Z","submitted_at":"2023-12-04T21:47:10Z","title":"Evaluating General Purpose Vision Foundation Models for Medical Image Analysis: An Experimental Study of DINOv2 on Radiology Benchmarks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02366","snapshot_observed_at":"2026-08-06T20:15:05.903143Z","title":"Evaluating general purpose vision foundation models for medical im- age analysis: An experimental study of dinov2 on radiology benchmarks.arXiv preprint arXiv:2312.02366, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:05.903143Z"},"links":{"cited_paper":"/paper/2312.02366","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:2f5a18bd543a034f7720c71b6eeba11fea4a19b744c4c06f766f96ffe15e6b42","observation_id":"31bc2ae1-01bb-4158-a96c-c3dd1b7c4ac5","resolution":{"observed_at":"2026-08-06T20:15:05.903143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:19.347941Z","title":"Automated audiovisual be- havior recognition in wild primates.Science Advances, 2021","venue":null,"work_id":"c8fc3e77-9862-4634-a043-00843fcdc3c8","year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:05.978871Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:74dba00256798a9a1abb33e3f7b7b3645fbfd10adf9ff7f5095f5a48f511dab2","observation_id":"177c5610-3aae-4737-9e02-5adfa637b4ec","resolution":{"observed_at":"2026-08-06T20:15:19.461113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:19.077939Z","title":"Revisiting feature prediction for learning visual rep- resentations from video.TMLR, 2024","venue":null,"work_id":"fcd362a8-5d54-4c35-9e44-c34a394d2e9d","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.055180Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:4aed25ed91e82226b2094f6728ec63e08e90eb20ea16130595d9473a8efd99f1","observation_id":"07c27c2b-39d0-49ef-ae58-41c04cfc5e33","resolution":{"observed_at":"2026-08-06T20:15:19.186170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:18.750682Z","title":"Accurate medium-range global weather forecasting with 3d neural networks.Nature, 2023","venue":null,"work_id":"f1d042ad-b4a8-4245-8bdd-aaf960913507","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.132731Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:0e775ddc98d834061993b60ac31c66b05115b7c851d83773199418d27c855d6a","observation_id":"be6871d9-80ef-4685-bff0-8191cab3de06","resolution":{"observed_at":"2026-08-06T20:15:18.933296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13063","last_updated":"2024-11-21T20:14:58Z","snapshot_observed_at":"2026-08-16T13:51:17.742197Z","submitted_at":"2024-05-20T14:45:18Z","title":"A Foundation Model for the Earth System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13063","snapshot_observed_at":"2026-08-06T20:15:06.227485Z","title":"Bruinsma, Ana Lucic, Megan Stanley, Anna Vaughan, Johannes Brandstetter, Patrick Gar- van, Maik Riechert, Jonathan A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.227485Z"},"links":{"cited_paper":"/paper/2405.13063","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:edb5dcb9de533464445be93006e50e83d85a7af3a8c24a5a0f84e5ed0a8ccbe9","observation_id":"1ae80cd6-d83d-4367-a3e1-ec496b0cbe17","resolution":{"observed_at":"2026-08-06T20:15:06.227485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-06T20:15:06.291159Z","title":"Hudson, Ehsan Adeli, Russ Alt- man, Simran Arora, Sydney von Arx, Michael S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.291159Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:a3b50fdcb95fc3048480e67d413256de00b6f1b5257c781bd3441736682f8682","observation_id":"971561e2-ebf4-42d2-bbe5-26604c176105","resolution":{"observed_at":"2026-08-06T20:15:06.291159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-08-16T11:03:32.082173Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-08-06T20:15:06.382164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.382164Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:5136f8af54004cc7ce0f8f70a58c7df2fbf664cbb8f7ef1b7154e973a3e7872d","observation_id":"cd2fcdce-93e6-443e-a1d2-e60e744413ca","resolution":{"observed_at":"2026-08-06T20:15:06.382164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:18.503050Z","title":"Physical understanding of the tropical cyclone wind-pressure relation- ship.Nature Communications, 2017","venue":null,"work_id":"5d82683a-3cff-4ab8-a349-574142786352","year":2017},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.442121Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:7b8fab9e5fdd5efd9bb2274696181e5aef448f8297d87c1d14b714287800d408","observation_id":"b81a03e5-9d1e-4e90-8706-4351df16e912","resolution":{"observed_at":"2026-08-06T20:15:18.637272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:18.322999Z","title":"Fuxi: A cascade ma- chine learning forecasting system for 15-day global weather forecast.npj Climate and Atmospheric Science, 2023","venue":null,"work_id":"c6af4e10-9cdb-4367-b1c7-b9053164576a","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.551156Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:6445cae435d2e1d4750a5e9980ccd3416ef4870d6be7a560de1c6c24cde7c323","observation_id":"65eebbbc-3a56-42b6-962b-db02c3e4df9b","resolution":{"observed_at":"2026-08-06T20:15:18.399080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03014","last_updated":"2023-12-05T01:10:54Z","snapshot_observed_at":"2026-08-16T14:37:40.592836Z","submitted_at":"2023-12-05T01:10:54Z","title":"Foundation Models for Weather and Climate Data Understanding: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03014","snapshot_observed_at":"2026-08-06T20:15:06.651978Z","title":"Foundation models for weather and climate data understanding: A comprehensive survey.arXiv preprint arXiv:2312.03014, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.651978Z"},"links":{"cited_paper":"/paper/2312.03014","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:4ad3e3dd30f72aa81afb3ab0f88eaf1b2407b104cd1fac35f4ba11f1b2d4c2a1","observation_id":"ac1cfd27-df27-43a3-a35b-cdc13106ac53","resolution":{"observed_at":"2026-08-06T20:15:06.651978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:18.091882Z","title":"Vision–language foundation model for echocardiogram interpretation.Nature Medicine, 2024","venue":null,"work_id":"e2436291-64a8-4e4d-8403-d9e44f35a144","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.719954Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:43f04422d93a34551573ddff194ddf565bd659e8ea4c7020301d43632d3d4f34","observation_id":"476e6f64-51d9-4258-b43d-5789276f5f42","resolution":{"observed_at":"2026-08-06T20:15:18.202978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.935414Z","title":"TAP-vid: A bench- mark for tracking any point in a video","venue":null,"work_id":"d3e9292c-d80c-4dbf-9516-671279b47817","year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.818095Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:b305b35bb91eb1d2da774fefc6e83fb27d698bca044be2e467b0db12f532a1b2","observation_id":"4e973eb7-2fd0-42f3-a19a-7c2d9497246f","resolution":{"observed_at":"2026-08-06T20:15:18.008433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T20:15:06.897605Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.897605Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:9066fb635f2986515ed9c24e93ba120caa84ec139d80680cb89bf950b2edbd36","observation_id":"22fabec3-6b73-43cd-9b06-39c354fdaa94","resolution":{"observed_at":"2026-08-06T20:15:06.897605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05420","last_updated":"2023-06-08T17:59:08Z","snapshot_observed_at":"2026-08-21T05:48:15.644615Z","submitted_at":"2023-06-08T17:59:08Z","title":"Scaling Spherical CNNs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05420","snapshot_observed_at":"2026-08-06T20:15:06.967221Z","title":"Scaling spherical cnns.arXiv preprint arXiv:2306.05420,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:06.967221Z"},"links":{"cited_paper":"/paper/2306.05420","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:63aa4ce6b79df54373af5f1d3a81041f5dd6b65fc672e426135c85fb400e8373","observation_id":"d0409a3f-d82c-4489-9a12-4df4e48b98ff","resolution":{"observed_at":"2026-08-06T20:15:06.967221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.707605Z","title":"Detecting social actions of fruit flies","venue":null,"work_id":"cb64713f-88af-4924-84e1-d60922ffe6a7","year":2014},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.044858Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:1796cb868ec5fa27639d7bba9db5e1dd6aa74f42f5cdd04b7f28324eacf52284","observation_id":"f369b554-ef61-4911-a06b-8dce12553229","resolution":{"observed_at":"2026-08-06T20:15:17.806729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.489739Z","title":"PhilEO bench: Evaluating geo-spatial foundation models","venue":null,"work_id":"41dde1b6-2573-4270-8a39-4a06dd98a1cb","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.125168Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:3989c099f6f22ad25a616f705885021db93b87677a28e2845a350380d61d0f2c","observation_id":"4046dd7c-1dbe-445b-b3bd-f554810e089f","resolution":{"observed_at":"2026-08-06T20:15:17.614153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09045","last_updated":"2025-02-07T02:39:32Z","snapshot_observed_at":"2026-08-20T21:19:50.737405Z","submitted_at":"2025-01-15T08:52:28Z","title":"Spatio-Temporal Foundation Models: Vision, Challenges, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09045","snapshot_observed_at":"2026-08-06T20:15:07.200014Z","title":"Spatio-temporal foundation models: Vision, challenges, and opportunities.arXiv preprint arXiv:2501.09045, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.200014Z"},"links":{"cited_paper":"/paper/2501.09045","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:9707b66d78113258689cbf730d3cc973690f1092c1a51b224c77787e09ba41a1","observation_id":"959d5ff8-01a3-4ece-9553-accb8c0b727e","resolution":{"observed_at":"2026-08-06T20:15:07.200014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.380931Z","title":null,"venue":null,"work_id":"5b37ff35-cb86-4041-9d3c-c7d86f5f8131","year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.248357Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:3dfefdab02def721e0b66845fa009485eba6f75b7dfe871b5472741709d5b389","observation_id":"26e955b2-7fab-4b58-b9b1-a93f9e762d30","resolution":{"observed_at":"2026-08-06T20:15:17.429755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.283760Z","title":"Self-supervised learning for en- doscopic video analysis","venue":null,"work_id":"3bff17a1-8a02-4998-b209-a79d0fe6a797","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.291237Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:3ee0ffa5af021905709be91d2c61ef9f4c5a6e64aba08561eb1fb01fea4b12b3","observation_id":"48ce0fba-8cd9-4e4a-9b59-88254ec69122","resolution":{"observed_at":"2026-08-06T20:15:17.323240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.203912Z","title":"LoRA: Low-rank adaptation of large lan- guage models","venue":null,"work_id":"d07eb0b9-453e-4768-884d-824d590b1617","year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.342283Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:8bb61693337eeca68f798ec6078e74d22f5c0e248bce208fad637dfa74be3f41","observation_id":"f9c273d3-d4b6-4a99-bef4-3805254a21f1","resolution":{"observed_at":"2026-08-06T20:15:17.228572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:17.091621Z","title":"Foundation models for spatiotemporal tasks in the physical world","venue":null,"work_id":"6c7c160f-4a55-4df7-bcbc-04ed394f50d6","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.401467Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:650f2f30e9b5c6e50c5dcf98962ad49ee2a52f9c5cc4eb836460df194344d5c1","observation_id":"1ce275c9-d50a-4cfb-a957-6a215b1f2aab","resolution":{"observed_at":"2026-08-06T20:15:17.134679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.977229Z","title":"Animal-bench: Benchmarking multimodal video models for animal-centric video understanding.NeuRIPS, 2024","venue":null,"work_id":"79221269-d34b-4cd6-ac30-01e8f2ed3f0d","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.463576Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:c6aae4c867853f8aa81ba75e458b3a253b28ff9097766be2e36f3f367a64dfd3","observation_id":"caca4562-e55d-4a82-9029-071207f5c368","resolution":{"observed_at":"2026-08-06T20:15:17.033611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-20T22:03:51.775198Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-06T20:15:07.522439Z","title":"The kinetics human action video dataset.arXiv preprint arXiv:1705.06950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.522439Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:c0aa7742ef9cb383ced6e7572cc3508563b8aed7014c853f5ae0f938f325b56a","observation_id":"13b7153f-c29c-41cd-a07c-db2b09a2c61d","resolution":{"observed_at":"2026-08-06T20:15:07.522439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07575","last_updated":"2022-02-15T17:02:07Z","snapshot_observed_at":"2026-08-20T13:01:54.570604Z","submitted_at":"2022-02-15T17:02:07Z","title":"Forecasting Global Weather with Graph Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07575","snapshot_observed_at":"2026-08-06T20:15:07.599701Z","title":"Forecasting global weather with graph neural networks.arXiv preprint arXiv:2202.07575, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.599701Z"},"links":{"cited_paper":"/paper/2202.07575","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:ba1a23b78494f0e5904be71a710a06d12d83c86dc57d1ec7ece2e37047756dcf","observation_id":"ad4367af-f079-47d4-ab1e-b69a2b96adf5","resolution":{"observed_at":"2026-08-06T20:15:07.599701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.887673Z","title":"Digital typhoon: Long-term satellite image dataset for the spatio-temporal modeling of tropical cyclones","venue":null,"work_id":"227a61a7-67ea-41c1-9e32-34a419ef96cf","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.691648Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:c46594e4bb818e7de56ba877b9e1776956af72a3c3c2762783d2d2020e81cb4d","observation_id":"29db881c-a7d5-46c6-b045-ee2a415dbb04","resolution":{"observed_at":"2026-08-06T20:15:16.921505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.801468Z","title":"Neural general circulation models for weather and climate.Nature, 2024","venue":null,"work_id":"9a3cb09c-1564-4dc5-97a5-c6f1057a3778","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.747640Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:a8e3aea0c6ab09830da074a10b6f8d19195431c069bbb72778ae049991386b9e","observation_id":"eb300df2-19d3-4809-a1f6-eac1c473ccc1","resolution":{"observed_at":"2026-08-06T20:15:16.821803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.699824Z","title":"Four- castnet: Accelerating global high-resolution weather fore- casting using adaptive fourier neural operators","venue":null,"work_id":"cca4176d-81fa-42c6-81c5-99f803675534","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.798101Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:75d3122209d3af0d7216038e3c7467a13c823495aba9c81e783887ce9d2d118f","observation_id":"9b212f4e-87cd-4a97-9559-802aacf37343","resolution":{"observed_at":"2026-08-06T20:15:16.742060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.583057Z","title":"Learning skillful medium-range global weather forecasting.Science, 2023","venue":null,"work_id":"c639fbf1-0492-4797-ac91-c5a9828d6d11","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.848445Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:972dc4eed89a198b5f4d42e37befb7d72533b1c18f21cbf81831ab5eb6c7fd96","observation_id":"cdb3a037-ecd8-47df-ba76-63e67dfaf786","resolution":{"observed_at":"2026-08-06T20:15:16.629854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06491","last_updated":"2024-07-09T01:49:08Z","snapshot_observed_at":"2026-08-16T13:35:56.977939Z","submitted_at":"2024-07-09T01:49:08Z","title":"VideoEval: Comprehensive Benchmark Suite for Low-Cost Evaluation of Video Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06491","snapshot_observed_at":"2026-08-06T20:15:07.890675Z","title":"VideoEval: Comprehensive benchmark suite for low-cost evaluation of video foundation model.arXiv preprint arXiv:2407.06491, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.890675Z"},"links":{"cited_paper":"/paper/2407.06491","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:869007b4e859aa25e4e2d1d01258eddc131db0c72b89d8a3297f0d5906f1b286","observation_id":"a8ace931-45ae-41a2-bcf2-826ac6c4ec44","resolution":{"observed_at":"2026-08-06T20:15:07.890675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-06T20:15:07.974974Z","title":"Video-llava: Learning united visual rep- resentation by alignment before projection.arXiv preprint arXiv:2311.10122, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:07.974974Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:03e34583c684d00c51d9ded4319b0fa719257495de430a72c73007e8a18a8841","observation_id":"1ea49c43-1657-4f6d-b902-8afa32629b3c","resolution":{"observed_at":"2026-08-06T20:15:07.974974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.495489Z","title":"Discriminative correlation filter tracker with channel and spatial reliability.IJCV, 2018","venue":null,"work_id":"59ba73e6-59ef-411e-80ac-606b7c8ef0be","year":2018},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.019430Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:67d1783fab9a1121075d1c8d43b617de8e9a98c8ccc4834b4ac4b3a5c24e8f60","observation_id":"96e8d6c8-6b94-4a7c-858a-41c6d6ec7f7d","resolution":{"observed_at":"2026-08-06T20:15:16.537610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-06T20:15:08.104009Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models.arXiv preprint arXiv:2306.05424, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.104009Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:79f49b8cc993315f30d5e0eb42598db629ba0ba71befa15b6e5e587d6fc9561b","observation_id":"c3dbb334-521f-4e1a-9a10-e5abb8f48053","resolution":{"observed_at":"2026-08-06T20:15:08.104009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03770","last_updated":"2024-05-06T18:09:48Z","snapshot_observed_at":"2026-08-16T13:54:55.899708Z","submitted_at":"2024-05-06T18:09:48Z","title":"Foundation Models for Video Understanding: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03770","snapshot_observed_at":"2026-08-06T20:15:08.167795Z","title":"Foundation mod- els for video understanding: A survey.arXiv preprint arXiv:2405.03770, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.167795Z"},"links":{"cited_paper":"/paper/2405.03770","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:e3133ae5994d7e9bb86c79564d3b8c014b064ab279bb14db332a0fbe6395b365","observation_id":"d21fed4b-9c62-4799-aaf2-71ddaa2232ec","resolution":{"observed_at":"2026-08-06T20:15:08.167795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.396337Z","title":"Martinez","venue":null,"work_id":"2270f214-ab73-4c4f-b271-df90038e3b42","year":2020},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.209219Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:b1896b21f6a772c3e8576e7eb5a070606e60c393aff16691da62e02812b4260f","observation_id":"80f7ab7f-4e9f-4b29-8eba-220e55327ab9","resolution":{"observed_at":"2026-08-06T20:15:16.444177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10808","last_updated":"2023-09-20T03:03:16Z","snapshot_observed_at":"2026-08-21T05:07:02.110034Z","submitted_at":"2023-09-19T17:50:27Z","title":"AI Foundation Models for Weather and Climate: Applications, Design, and Implementation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10808","snapshot_observed_at":"2026-08-06T20:15:08.267455Z","title":"Ai foundation models for weather and climate: Applications, design, and implementation.arXiv preprint arXiv:2309.10808, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.267455Z"},"links":{"cited_paper":"/paper/2309.10808","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:f4ad8f691f75519ca127a7fc0f18afd9576cffb35522d1b3c0d682720066bbdd","observation_id":"66004637-f84f-44eb-866f-e865db1de428","resolution":{"observed_at":"2026-08-06T20:15:08.267455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15823","last_updated":"2024-12-08T23:59:11Z","snapshot_observed_at":"2026-08-18T16:25:46.824953Z","submitted_at":"2024-08-28T14:34:45Z","title":"Benchmarking foundation models as feature extractors for weakly-supervised computational pathology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15823","snapshot_observed_at":"2026-08-06T20:15:08.318879Z","title":"Benchmarking foundation models as feature extractors for weakly-supervised computational pathology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.318879Z"},"links":{"cited_paper":"/paper/2408.15823","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:3af72508bd3d867cbf542cd2578d5ce071436824b67947a72f6f5d2ba077cc00","observation_id":"b2834046-b7cf-43e2-8989-cd980f10e2d0","resolution":{"observed_at":"2026-08-06T20:15:08.318879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.297551Z","title":"MFT: Long- term tracking of every pixel","venue":null,"work_id":"4e756c08-6529-4d70-b0ad-82b4959fd432","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.395898Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:a99b7deef4d4ba343f7b67eda6c34574846ea4bcb80e52bfacd4eab2c5b44cac","observation_id":"b8e85317-b503-41d0-bcba-93777c1c1d3d","resolution":{"observed_at":"2026-08-06T20:15:16.339892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:16.119518Z","title":"Foundation mod- els for science: Progress, opportunities, and challenges (fm4science)","venue":null,"work_id":"0d02381d-44ac-4a89-8924-0c39952d9009","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.451539Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:b87ffca1a228a389b90768e4ac5ec8fd4e4025b837aac92ba487fb6811d6fda4","observation_id":"8699e68e-0c2d-429b-9970-b407a41058f9","resolution":{"observed_at":"2026-08-06T20:15:16.208517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10343","last_updated":"2023-12-18T18:16:12Z","snapshot_observed_at":"2026-08-16T16:00:21.672298Z","submitted_at":"2023-01-24T23:19:01Z","title":"ClimaX: A foundation model for weather and climate","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10343","snapshot_observed_at":"2026-08-06T20:15:08.576726Z","title":"Climax: A foun- dation model for weather and climate.arXiv preprint arXiv:2301.10343, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.576726Z"},"links":{"cited_paper":"/paper/2301.10343","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:aeca31b4aac6bfed5d94f72ab14e0f45f0e385df8812f39b39d5a9b2f40b131d","observation_id":"2d177f38-e246-4d1e-bd41-ae456d558b16","resolution":{"observed_at":"2026-08-06T20:15:08.576726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:15.940618Z","title":null,"venue":null,"work_id":"aab4b11b-faa7-432f-9150-2919c289ae5d","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.723812Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:5e687f3bf173fb982a49a4ee54778b96dcdf842c79fdc5f85e3f5246a60e0179","observation_id":"1a0a1428-c683-4fb0-9a1f-05ed19bc4cbd","resolution":{"observed_at":"2026-08-06T20:15:15.998038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:15.794306Z","title":"Probabilistic weather forecasting with machine learn- ing.Nature, 2025","venue":null,"work_id":"2db82282-67e4-4a7f-9b07-ddfe28fa0657","year":2025},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.865527Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:041fd2cada99cdd67bf47472e458507d65ec1974193c16af0d8929ca5f6904ea","observation_id":"55248177-4ef0-4652-b9db-ca2174252667","resolution":{"observed_at":"2026-08-06T20:15:15.862129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:08.914035Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.914035Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:efbbb6ed403230df6024da71a24a2fe8f66d6d6214b8e90cd8da35ec244265dc","observation_id":"a1131a77-0892-410a-914c-6446c1324f2a","resolution":{"observed_at":"2026-08-06T20:15:08.914035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:15.609338Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"24900fc4-1a6f-4a47-96f8-1bd7b6b11f5c","year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.923024Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:acb4696ff5a04589d46e9d3ec3cc9db38df8adf1816e8533fe9af78e44f2a4dc","observation_id":"2050d16a-bba9-4017-ad11-da2171f4b141","resolution":{"observed_at":"2026-08-06T20:15:15.677463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:15.447273Z","title":"Weatherbench 2: A benchmark for the next generation of data-driven global weather models.Journal of Advances in Modeling Earth Systems, 2024","venue":null,"work_id":"b6378a08-eae7-4602-baea-d256b1589e96","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:08.964906Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:24c27089e4413e219672d1f3693fdc2458e559e9f18b6b71f1731e21fb7add11","observation_id":"c8d60469-e4e4-4e06-9768-4ae77aedc8b2","resolution":{"observed_at":"2026-08-06T20:15:15.508655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:15.319252Z","title":"Donti, Lynn H","venue":null,"work_id":"a41d578d-be22-456c-9bf7-1ac8cbe627a4","year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.037059Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:4e4e20a3f716762a0150545ae9e78760dc0c5eb5869cef3c07d1d15b1418a441","observation_id":"6708f4c8-d15e-4e0b-aeb5-770756e91fa7","resolution":{"observed_at":"2026-08-06T20:15:15.355224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05949","last_updated":"2024-04-12T22:30:54Z","snapshot_observed_at":"2026-08-16T14:11:22.136814Z","submitted_at":"2024-03-09T16:02:46Z","title":"General surgery vision transformer: A video pre-trained foundation model for general surgery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05949","snapshot_observed_at":"2026-08-06T20:15:09.177953Z","title":"General surgery vision transformer: A video pre-trained foundation model for general surgery.arXiv preprint arXiv:2403.05949, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.177953Z"},"links":{"cited_paper":"/paper/2403.05949","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:05f93a8654a8ab58b62aca76981144f11976fbf36b34d7b6e9cf6bb63a357d1b","observation_id":"0b04d748-7ade-4cfd-9a52-d7bced045dbb","resolution":{"observed_at":"2026-08-06T20:15:09.177953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:15.158419Z","title":"DiMaio, and Sep- timiu E","venue":null,"work_id":"7cc0e30d-dcc5-4541-8e39-674dc0cfa585","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.279894Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:e9fc1723b9986bdf5f03da93e76a6d7e6eea1db067504efe27bc5cee661762a7","observation_id":"90b742e2-ecd8-4d46-9486-abb9e0e85b47","resolution":{"observed_at":"2026-08-06T20:15:15.227769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06907","last_updated":"2025-01-12T19:27:51Z","snapshot_observed_at":"2026-08-17T08:59:08.530241Z","submitted_at":"2025-01-12T19:27:51Z","title":"Deep Learning and Foundation Models for Weather Prediction: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06907","snapshot_observed_at":"2026-08-06T20:15:09.405163Z","title":"Deep learning and founda- tion models for weather prediction: A survey.arXiv preprint arXiv:2501.06907, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.405163Z"},"links":{"cited_paper":"/paper/2501.06907","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:4039b3d6917abdcc49fa86143c3dc8df2487fff8cc6cb8747dbb3ca7c1d9ea5f","observation_id":"b70d863a-ee15-4d65-943d-9eac5bc8645c","resolution":{"observed_at":"2026-08-06T20:15:09.405163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:14.998003Z","title":"Us billion-dollar weather and climate disasters: Data sources, trends, accuracy and bi- ases.Natural Hazards, 2013","venue":null,"work_id":"ce9d0381-f292-44ed-b347-8e4cb4f834e1","year":2013},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.474388Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:e358ed07cb77d3b8a6c0d9f15fff79db3e4273059edb92a6e8cd2cfff15dd5af","observation_id":"f910b252-d73f-41a9-94b6-d92c44a0a3c2","resolution":{"observed_at":"2026-08-06T20:15:15.068904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:14.839973Z","title":"Toward collaborative artificial intelligence development for animal well-being.Journal of the American Veterinary Medical Association, 2025","venue":null,"work_id":"7e7e0bc8-30ad-480d-8bc0-d0e758dd347e","year":2025},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.557158Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:a1a9a4093d0f0ad5b939ebefd56e689d720b72053dbc033d5852e8e6af41eff2","observation_id":"f188940f-3cde-4e8b-b72e-b28c17b08689","resolution":{"observed_at":"2026-08-06T20:15:14.921165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:14.668273Z","title":"The multi-agent behavior dataset: Mouse dyadic social interac- tions","venue":null,"work_id":"85659510-4362-47df-a0c3-a6501b182ba6","year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.654254Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:55e41cc7c3642e965b365e30acd5a372a9117a4a33edfe4f380b1dc96c5782c9","observation_id":"b5d909ec-489f-494a-a919-37b60c19a12d","resolution":{"observed_at":"2026-08-06T20:15:14.695809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:14.517253Z","title":"Sun, Ann Kennedy, Eric Zhan, David J","venue":null,"work_id":"eb80d462-6106-4dbb-b454-c27c8b673ec2","year":2021},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.759835Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:6fd93180f2f1cceea55acdefe834e3a135a8ba04c53d86d99d39d8982dde9cbc","observation_id":"5804aeea-28a1-4797-a42f-434341e2816d","resolution":{"observed_at":"2026-08-06T20:15:14.586124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:14.384490Z","title":"Video foundation models for animal behavior analysis.bioRxiv, 2024","venue":null,"work_id":"94f46100-2b75-4fc0-920d-48dd52fd0c7d","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:09.885346Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:920a05ca008008af7e91d8070d59ffd6cb97dceeb278ef468d1fb3949e4b50b1","observation_id":"d4df4856-8a21-4efd-91da-12329f318bf3","resolution":{"observed_at":"2026-08-06T20:15:14.422314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T20:15:10.047549Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:10.047549Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:fa87d506da2f3124e9c15411d56c7889b6072706cad93f554d8fa85b114456e3","observation_id":"931d0775-ffd5-4e86-8082-01c8e024809f","resolution":{"observed_at":"2026-08-06T20:15:10.047549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:14.188981Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"df62d8a9-2033-427e-b515-f5631ce5fa45","year":2020},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:10.241819Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:b7c80b013fddb33e64dc48f9b562aab8549a649c1a54b063d27e52a375285ca1","observation_id":"8885c466-ae5e-42fc-8e28-fd31a0b7c973","resolution":{"observed_at":"2026-08-06T20:15:14.307684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:13.960997Z","title":"Videomae: Masked autoencoders are data-efficient learners for self-supervised video pre-training.NeurIPS, 2022","venue":null,"work_id":"a5949ac9-710f-4983-be97-d47e07f057be","year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:10.375407Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:2368e906d2aba5d44b1c4cead2d185a927c61c9eae7f4c65245b3e05cb92134e","observation_id":"eb94b3de-0f8b-45e2-a3a0-71a8be4ce5e6","resolution":{"observed_at":"2026-08-06T20:15:14.041844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:13.806996Z","title":"Bergen, Carla P","venue":null,"work_id":"159a95f5-2b04-4349-90a8-bc5d49bbdadb","year":null},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:10.479154Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:73a923149f0056f80b4c8fa52ab1459eec8b55516f3e8b6fd8c333e2d7bdda5f","observation_id":"11c50058-3935-418a-aa86-1c5697c77402","resolution":{"observed_at":"2026-08-06T20:15:13.887690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:13.631453Z","title":"Videomae v2: Scaling video masked autoencoders with dual masking","venue":null,"work_id":"e6d9875d-c890-4d81-a80b-5ff07994c269","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:10.628053Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:14dc7e37d372886b9c55cf2c2faf436eb7e2adecce7771d6b125e4bdf7e0ce17","observation_id":"0766bebb-ce4c-47d4-ad37-3e1914a5a427","resolution":{"observed_at":"2026-08-06T20:15:13.710702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03191","last_updated":"2022-12-07T12:20:55Z","snapshot_observed_at":"2026-08-19T18:30:11.337554Z","submitted_at":"2022-12-06T18:09:49Z","title":"InternVideo: General Video Foundation Models via Generative and Discriminative Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03191","snapshot_observed_at":"2026-08-06T20:15:10.801532Z","title":"Internvideo: General video foundation models via generative and discriminative learning.arXiv preprint arXiv:2212.03191, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:10.801532Z"},"links":{"cited_paper":"/paper/2212.03191","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:0ceac5b9f374e0beedde56f6a8d2f7e1079bb97615c62025ddbecde31d369d4d","observation_id":"8bfbe9db-ce8c-43be-b186-adac9a3252d1","resolution":{"observed_at":"2026-08-06T20:15:10.801532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:13.502497Z","title":"Foun- dation model for endoscopy video analysis via large-scale self-supervised pre-train","venue":null,"work_id":"b7ed9abd-b4e7-4db2-a5c1-e6176274df0f","year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.000082Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:809c0274f63ebf75b9d79f9cbf141e26d4354780165cc94a41b2ada5f776e3a6","observation_id":"acb0c8dd-bca3-40ce-a280-a3f7559d8d5a","resolution":{"observed_at":"2026-08-06T20:15:13.547204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15038","last_updated":"2025-04-13T05:58:18Z","snapshot_observed_at":"2026-08-16T13:07:49.511131Z","submitted_at":"2024-10-19T08:48:01Z","title":"A Multimodal Vision Foundation Model for Clinical Dermatology","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15038","snapshot_observed_at":"2026-08-06T20:15:11.091896Z","title":"A general-purpose multi- modal foundation model for dermatology.arXiv preprint arXiv:2410.15038, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.091896Z"},"links":{"cited_paper":"/paper/2410.15038","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:cf3b5deceb1d78c689a5e90655bffc5cb1c25719d7d3531db5788cedd2385d96","observation_id":"ca767c78-136b-4920-98e5-5caa724c9c94","resolution":{"observed_at":"2026-08-06T20:15:11.091896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:13.323263Z","title":"X- pose: Detecting any keypoints","venue":null,"work_id":"46c5beb8-c36a-46ae-9d67-ce2b6e473541","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.350163Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:5de3f5c4204187fea3a49a2d77678083c39ca17420e4a48f89efe619571341fa","observation_id":"1955884b-238c-418f-b897-9b1f7583f23d","resolution":{"observed_at":"2026-08-06T20:15:13.421602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:13.171559Z","title":"Superanimal pretrained pose estimation models for behavioral analysis.Nature communi- cations, 2024","venue":null,"work_id":"69d48b37-4ef3-4213-b8dd-db8b7afe2c6e","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.530401Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:b9342f5805fcc43a9697cd5a11e7a2c2a5c9512cf447819ed0b855c0df77009e","observation_id":"5812fcff-a851-4dac-a336-93cf7ff6a952","resolution":{"observed_at":"2026-08-06T20:15:13.228041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03166","last_updated":"2024-10-24T22:35:27Z","snapshot_observed_at":"2026-08-20T13:53:02.175115Z","submitted_at":"2023-07-06T17:47:52Z","title":"VideoGLUE: Video General Understanding Evaluation of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03166","snapshot_observed_at":"2026-08-06T20:15:11.653133Z","title":"Videoglue: Video general understanding evaluation of foundation mod- els.arXiv preprint arXiv:2307.03166, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.653133Z"},"links":{"cited_paper":"/paper/2307.03166","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:a9eebd1fb1ff492508c7fefb3af59619f125b8baf10886bbf50412b1e34a1749","observation_id":"badfa012-8105-4c44-a646-da33a4610bba","resolution":{"observed_at":"2026-08-06T20:15:11.653133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:12.970637Z","title":"A generalist vision–language foundation model for diverse biomedical tasks.Nature Medicine, 2024","venue":null,"work_id":"191846f5-5782-4595-b421-3b94b0b5c4cb","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.818165Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:5925cd2e1a3bc6d15d5f252aedcdc61f5e8c8453f1abaa393016d9142ca1ea36","observation_id":"84224969-cd44-49b8-a6d5-f99aa27039b9","resolution":{"observed_at":"2026-08-06T20:15:13.075011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:15:12.799220Z","title":"Videoprism: A foundational visual encoder for video understanding","venue":null,"work_id":"39defb60-65be-4037-8b29-a5ea979bcb3b","year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.897265Z"},"links":{"citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:dd48050146a3d03131ce181203452885b867055d74abf85e5848fa4661b5e414","observation_id":"4dcdcc90-6f9b-4b70-9a0b-871c01d1c545","resolution":{"observed_at":"2026-08-06T20:15:12.840958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12971","last_updated":"2024-06-04T18:16:52Z","snapshot_observed_at":"2026-08-19T07:26:35.142149Z","submitted_at":"2024-05-21T17:54:06Z","title":"BiomedParse: a biomedical foundation model for image parsing of everything everywhere all at once","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12971","snapshot_observed_at":"2026-08-06T20:15:11.959823Z","title":"Biomed- parse: a biomedical foundation model for image pars- ing of everything everywhere all at once.arXiv preprint arXiv:2405.12971, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:11.959823Z"},"links":{"cited_paper":"/paper/2405.12971","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:edde1513c2038c5e37dde03b27bbf1b3a09ff8097d5fd62eaac09f22169679e8","observation_id":"753dd348-577b-422b-8fc2-56070624a19d","resolution":{"observed_at":"2026-08-06T20:15:11.959823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-08-16T14:35:27.100627Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-08-06T20:15:12.043189Z","title":"circling","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:12.043189Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2507.03578"},"observation_digest":"sha256:a9d8420b69960145aebb59d0e6e9d071b0b5164c089d413e2c040325bf5892e1","observation_id":"6ccff515-fe59-4df5-b462-29fd71c62f08","resolution":{"observed_at":"2026-08-06T20:15:12.043189Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.03578","last_updated":"2025-07-04T13:48:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T23:34:44.931830Z","submitted_at":"2025-07-04T13:48:12Z","title":"SciVid: Cross-Domain Evaluation of Video Models in Scientific Applications"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 1 inbound Pith citation observation for arXiv:2507.03578."}