{"as_of":"2026-08-08T05:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d1d0d4ee04db6131de20eadeb9dfb73ff86195675283c63ccb59ef1e24042b50","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:29:57.716070Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T06:28:14.694168Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T15:28:34.337275Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"cited_work":{"arxiv_id":"2506.07850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07850","snapshot_observed_at":"2026-07-03T15:28:34.337275Z","title":"Rocky and Q","venue":null,"work_id":"d14dcb55-8792-4390-89c2-9d1a5d4eb756","year":2025},"citing_paper":{"arxiv_id":"2606.13497","last_updated":"2026-06-11T15:46:28Z","snapshot_observed_at":"2026-07-30T20:19:53.530896Z","submitted_at":"2026-06-11T15:46:28Z","title":"SPARC: Reliable Spatial Annotations from Robot Demonstrations at Scale","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T06:28:14.694168Z"},"links":{"cited_paper":"/paper/2506.07850","citing_paper":"/paper/2606.13497"},"observation_digest":"sha256:22d5c600e808f0d94ce70ddfe79e179eda0809e6903fcae42ed573d6e046b2a3","observation_id":"49f00d6d-32cd-4e9b-97a9-1697007ced46","resolution":{"observed_at":"2026-07-03T15:28:34.338844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07850/citation-record","integrity":"/paper/2506.07850/integrity","json":"/paper/2506.07850/citation-record.json","paper":"/paper/2506.07850"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.262734Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.262734Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b47a029e44b04d1daf977ef7c1f919d5e2bf6480b45dc93bb04bd617641e7eb2","observation_id":"141eb0cc-e367-4eac-8545-d8bc078a515d","resolution":{"observed_at":"2026-08-07T05:29:57.262734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.268357Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.268357Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:086df57e1ad41b1e4b8fb076796e4e2bd2190227b1adc6491466804c92930866","observation_id":"ca464e71-aefd-46a6-b77a-c4c58ac0942f","resolution":{"observed_at":"2026-08-07T05:29:57.268357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.273527Z","title":"Learning transferable visual models from natural language super- vision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.273527Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:87ed0217c1ff30b22291c4c77cc8322ec2ebbaa41c2484a80032bb7d2f7cacee","observation_id":"4493ab42-bbf1-461d-8b01-d4edd12ec425","resolution":{"observed_at":"2026-08-07T05:29:57.273527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.278118Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.278118Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1e29b48254cbe7782bc859ed4741dcfd041162d46830f803201f45e6d20097fc","observation_id":"269a7ba3-1575-4f2e-be58-7cdc5c292fc0","resolution":{"observed_at":"2026-08-07T05:29:57.278118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.282946Z","title":"On the opportunities and risks of foundation models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.282946Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:32f50c8dbfac78425507406a4821159eeb4441abf24d54d9cc6e1de0b5fa5469","observation_id":"07d54d86-0fcb-4d21-973f-df87082f29c8","resolution":{"observed_at":"2026-08-07T05:29:57.282946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.287611Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.287611Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c07dc01eae360ae87d04a71949c9ed7d67b527fd73bd584736424df728ac4107","observation_id":"36205894-e44e-45fb-ba09-ae733d85476b","resolution":{"observed_at":"2026-08-07T05:29:57.287611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.293031Z","title":"Coca: Contrastive captioners are image-text foundation models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.293031Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c9d15606ac1f11a490d45ff3c5617fd93da754d1b3f798f89d9e2d560850b229","observation_id":"7a05e676-81b4-40f4-8f65-b523e842a170","resolution":{"observed_at":"2026-08-07T05:29:57.293031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.297251Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.297251Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c2313db08f878f9ba39abd9ab963cb0bb1554d077d40c650bfccd766da895022","observation_id":"c4e4e5a6-adbe-4db5-ab6d-7c2189296ae8","resolution":{"observed_at":"2026-08-07T05:29:57.297251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.301671Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.301671Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e95869b31ad0d25b1ffae524165beb4a3ccbc3b4e7ae05851cbcb014177e3ac2","observation_id":"cbf1327a-3005-4230-b259-3309f126ff39","resolution":{"observed_at":"2026-08-07T05:29:57.301671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.306126Z","title":"Emerging properties in self-supervised vision trans- formers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.306126Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ca99004eb0ed8def7fc017e358d3ba521f768ab5d5baa7cdb344603a9abc540c","observation_id":"d3f8c4f1-8d2a-4382-81ee-be0c6736c1c6","resolution":{"observed_at":"2026-08-07T05:29:57.306126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.311005Z","title":"I was surprised by the great response to my recent post on small object detection—thank you for all the dms and shares","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.311005Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:cd2826c67b91f55cef642001783e5f389673821f5b9e824dbcfdb3a6a2fbe2d6","observation_id":"b1d3a19a-b7e5-4862-95d7-2d3a71f2afee","resolution":{"observed_at":"2026-08-07T05:29:57.311005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.315678Z","title":"Training data-efficient image transformers & distillation through attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.315678Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f396d4f52954f8ededcf1dca6c6ec0fdbd657313cf9ac5de046683bedd1e6688","observation_id":"c3517a28-e329-48fd-9ae6-63169e72ea86","resolution":{"observed_at":"2026-08-07T05:29:57.315678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.319788Z","title":"Review of accident detection methods using dashcam videos for autonomous driving vehicles,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.319788Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:814d20b016b26739d87bc1dacf3bcb06deae3d9d4da04c635ff77838f4fc99da","observation_id":"5e33a63b-3166-47c1-840f-6a5f2c5172e8","resolution":{"observed_at":"2026-08-07T05:29:57.319788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.324938Z","title":"The pascal visual object classes (voc) challenge,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.324938Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1aa1adbd45790f344cab01e0350f3b4502020026400cda3b989e6b88bf7a3147","observation_id":"cb8b6d95-f05e-45a7-9732-065599a72f91","resolution":{"observed_at":"2026-08-07T05:29:57.324938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.329873Z","title":"Fast r-cnn,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.329873Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:7950539805b7f5ebf70abb3b43fd8888c0da6531f9055d5a8d0fa9f0ba766bc1","observation_id":"a9a116e5-7655-4e8f-a4df-64427648107f","resolution":{"observed_at":"2026-08-07T05:29:57.329873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.334174Z","title":"Mobilenets: Efficient convolutional neural networks for mobile vision applications,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.334174Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ab85315e3d6eb85767a519b9923ed9f9a200f1f2fea24ebd6a0fc5e5519a8740","observation_id":"3eb8f8f1-09a9-4de4-8237-c9b540a3aab6","resolution":{"observed_at":"2026-08-07T05:29:57.334174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.339404Z","title":"Vision meets robotics: The kitti dataset,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.339404Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e70fdc111ab2c145412782f00eb5f0be5600a5460430288b8745a3658f331e60","observation_id":"e2e4675c-7a3e-4f3c-ad70-33b83dd4d98c","resolution":{"observed_at":"2026-08-07T05:29:57.339404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.343647Z","title":"Masked generative distillation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.343647Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:836f0072f9c2f23087a28113f88a27b7b95cda4e28e5fb4d7ab80a91d496a4e3","observation_id":"4b663b4c-4a0e-4ff2-8e05-730f09cc1705","resolution":{"observed_at":"2026-08-07T05:29:57.343647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.348366Z","title":"How to train your vit? data, augmentation, and regular- ization in vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.348366Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:da5d58610ba583ddb81a5faafcbb12cb9e57c3923267ede877e32dc3ded17824","observation_id":"2d2772ad-d95d-4746-b2ad-e380bb296ab7","resolution":{"observed_at":"2026-08-07T05:29:57.348366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.352832Z","title":"Afreeca: Annotation-free counting for all,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.352832Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:dc140fab5ee0809bceda7d25eaabf5c8006ba3533fcd69715b3d09343457f130","observation_id":"049b3453-746b-4aac-bb7e-30d867ecb36f","resolution":{"observed_at":"2026-08-07T05:29:57.352832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.357710Z","title":"Open-vocabulary point-cloud object detection without 3d annota- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.357710Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:0c24b48b03531fddd893612103334ceb10441271061a7aca1dba746c74da96a4","observation_id":"edc39b9c-1ae5-44b7-914d-7939eed7d367","resolution":{"observed_at":"2026-08-07T05:29:57.357710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.362659Z","title":"Emernerf: Emergent spatial- temporal scene decomposition via self-supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.362659Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e5673cfb09f2755a36cd2f04bcf6649640213c628feae9fee7ffc1ab9b77e8ab","observation_id":"33041f99-8c1f-42a0-b604-4abe7663b2c6","resolution":{"observed_at":"2026-08-07T05:29:57.362659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.367022Z","title":"Stereo4d: Learning how things move in 3d from internet stereo videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.367022Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3611ad2cbfe2c85502e6f052c587f93a13695d1fc7945c07cf5492b017500869","observation_id":"233047e2-9342-4cbc-a3b6-f642a7179426","resolution":{"observed_at":"2026-08-07T05:29:57.367022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05745","last_updated":"2023-12-10T03:56:06Z","snapshot_observed_at":"2026-07-06T16:59:19.436466Z","submitted_at":"2023-12-10T03:56:06Z","title":"Open World Object Detection in the Era of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05745","snapshot_observed_at":"2026-08-07T05:29:57.371437Z","title":"Open world object detection in the era of foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.371437Z"},"links":{"cited_paper":"/paper/2312.05745","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:847e385f9633fc3eb9b28041cc444226d9e8a5791744eab72bad07b0f4ec2be5","observation_id":"490b2d99-cafd-4c36-9281-bb337f0a8503","resolution":{"observed_at":"2026-08-07T05:29:57.371437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.376168Z","title":"Yolo-world: Real-time open-vocabulary object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.376168Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:404c0ecb66fbe5b64ca7c9fcdebc270332caf9a0b149622b22ca677a7dfbb4d4","observation_id":"0cb95db0-1b79-4fc6-8402-8dd10f385721","resolution":{"observed_at":"2026-08-07T05:29:57.376168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.381437Z","title":"Sapiens: Foundation for human vision models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.381437Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:aa6d5fa01ca0815ea82a9a475c9d4225391a07c7faa5edf1385e51a0e8ec239e","observation_id":"331f31a7-8fa9-489e-b121-312e93e292af","resolution":{"observed_at":"2026-08-07T05:29:57.381437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.386502Z","title":"Detrs beat yolos on real-time object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.386502Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:004f1217f9542343eb10489f5af595562c6ada46c32b5024ba091244a39594b0","observation_id":"fc34242f-3b7a-4128-82b8-2e2d46869cbc","resolution":{"observed_at":"2026-08-07T05:29:57.386502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.391059Z","title":"Dino-x: A unified vision model for open-world object detection and understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.391059Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:13ec4d61ce55ef4a015ef1982d13a2ade8da810977ab7b43cd28b31cdce94943","observation_id":"88ef4513-b520-4d05-a8aa-59e62f80199d","resolution":{"observed_at":"2026-08-07T05:29:57.391059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.395200Z","title":"Prompt-guided detr with roi-pruned masked attention for open-vocabulary object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.395200Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c21571321a5006abccdbbba0ee48376d7df71ef476738b22d6eb225df94fb7f8","observation_id":"bc88f3d9-4476-49d7-985d-b15702220d42","resolution":{"observed_at":"2026-08-07T05:29:57.395200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.399664Z","title":"Detclip: Dictionary-enriched visual-concept paralleled pre- training for open-world detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.399664Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:380532bcc30408d69aeec046bbb66c6135e41cccc824a201919c1380fd58e346","observation_id":"eb7f98fd-a0ce-47ec-b9e4-4834e90f355a","resolution":{"observed_at":"2026-08-07T05:29:57.399664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.403899Z","title":"Aligning bag of regions for open-vocabulary object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.403899Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:09e17a6cb863db53022983b86bd6c1e1144b09418069ce83014673e8737376c2","observation_id":"78bbcda0-b63c-4cd2-b6d2-24c874619e65","resolution":{"observed_at":"2026-08-07T05:29:57.403899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.407976Z","title":"Detclipv2: Scalable open-vocabulary object detection pre-training via word- region alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.407976Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:6e8a657eda20416a8ef827d8da6c0ea07c7fd7ac3d2e98bdf0f72216b2f8c2cf","observation_id":"53d379cd-3e7a-4d36-bfb5-3fa3c0f89319","resolution":{"observed_at":"2026-08-07T05:29:57.407976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.412248Z","title":"Fmgs: Founda- tion model embedded 3d gaussian splatting for holistic 3d scene understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.412248Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:26b312a5746aa19db62546e6ce28325ceac2d343206e4789b2df892a03492330","observation_id":"53d136b4-1885-484d-88de-d2b98b1ec9d3","resolution":{"observed_at":"2026-08-07T05:29:57.412248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.416393Z","title":"General object foundation model for images and videos at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.416393Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:6c6fea9c01857eb97888ec581f81527ade1b35d5010767c21620ac4d47b2a720","observation_id":"c79b529f-c13e-4f40-b47a-23f04eb04430","resolution":{"observed_at":"2026-08-07T05:29:57.416393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.421003Z","title":"Region-aware pretraining for open-vocabulary object detection with vision transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.421003Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:9753a9ade77fed38e4bdaf3674136acdbc20f3f19226d41f7294589935e0483b","observation_id":"1b1457d4-00fc-4708-8b80-127a2b498948","resolution":{"observed_at":"2026-08-07T05:29:57.421003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.425477Z","title":"Open- emma: Open-source multimodal model for end-to-end autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.425477Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:dc68469b0be96003e1290121492925a885b2a831ff4aa0bf45c3a2c90c897666","observation_id":"2f01d0d1-213d-4d36-82d0-50b1eeedf3c8","resolution":{"observed_at":"2026-08-07T05:29:57.425477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.430265Z","title":"Simple open-vocabulary object detection with vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.430265Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:cfeb3bae9367555ff823e27105a07cd4e1ba11ae7094b716825b541190456ddf","observation_id":"25b93f84-86f5-4e31-bacb-1dfaed846daa","resolution":{"observed_at":"2026-08-07T05:29:57.430265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.434897Z","title":"Exploiting unlabeled data with vision and language models for object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.434897Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:91c59c448572ee70ab467f1e69d96ba7075495412e7d327bbdfe67ff06d42be2","observation_id":"d9c7a5f6-194b-419b-bdff-9cab8bf4d3ef","resolution":{"observed_at":"2026-08-07T05:29:57.434897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.439321Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.439321Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b841322860272f2ed1661e9cabbce152a077ca54c9c207594444c69f2e86c2eb","observation_id":"9b28feed-45e9-4b91-8cbc-ca09c78cfa52","resolution":{"observed_at":"2026-08-07T05:29:57.439321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-07T05:29:57.443879Z","title":"Sam 2: Segment anything in images and videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.443879Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:84b2f2df6801793cbb47f68a43c05604f3db0ea7c2d6d8b9b7ffa94589aa4512","observation_id":"c693f3e2-d783-4d90-961f-fea6cee403a5","resolution":{"observed_at":"2026-08-07T05:29:57.443879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.448363Z","title":"Slicing aided hyper inference and fine-tuning for small object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.448363Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5aeac06a1bd481561e3b6d19f608b213ad7d06af1b9cc5e3584d169bbddb5725","observation_id":"97c6e091-31f6-4e8f-a6d5-ab303e497ffb","resolution":{"observed_at":"2026-08-07T05:29:57.448363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.452930Z","title":"Bdd100k: A diverse driving dataset for heterogeneous multitask learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.452930Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:6fc2175f7b73eb9c1d9291a96b58d84cc27167a34741b1de56bb517e6f9aba0d","observation_id":"3afdfa69-558e-4277-b600-d6a4b2d14988","resolution":{"observed_at":"2026-08-07T05:29:57.452930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.457715Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.457715Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3d7070cd514f20f0e97c00784e1cea49c7b946f5c0988211e9b131baf9b66be4","observation_id":"1146a43c-65ad-4757-a020-b0e33dfc88d0","resolution":{"observed_at":"2026-08-07T05:29:57.457715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:59.021517Z","title":"Multiple adverse weather conditions adaptation for object detection via causal intervention,","venue":null,"work_id":"3d0f033b-47f3-4c15-a067-b1d23207d085","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.462249Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:9e706f8f0a9a5f21986f27bb77d8b34f1ef06e0bee14d9e4c7334bca733e0c95","observation_id":"1ef8f871-3560-4280-9e42-f9e57f6d9558","resolution":{"observed_at":"2026-08-07T05:29:59.026965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:59.007358Z","title":"Learning enriched features for real image restoration and enhancement,","venue":null,"work_id":"e28b44cb-0839-412c-afe6-5704358dbe43","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.466677Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e5c3dd0b524f28c0b6a3ed42c4e3d84e951bd12de5c06d85539517b72a928bd0","observation_id":"81036673-94cc-47ad-be23-4e90fec3a656","resolution":{"observed_at":"2026-08-07T05:29:59.011977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.992133Z","title":"You only need 90k parameters to adapt light: A light weight transformer for image enhancement and exposure correction,","venue":null,"work_id":"ce2e751d-8635-4c6f-9cf6-f921d70d4dd5","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.470918Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:27dff46a1893f7e7a0240327cb96e8faa4c4f244f1ce5154a39343b08ed68416","observation_id":"9916782c-d57d-44f9-adad-5ff847df7855","resolution":{"observed_at":"2026-08-07T05:29:58.997808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.977925Z","title":"Learning multi-scale photo exposure correction,","venue":null,"work_id":"a43f4a3a-a294-4388-b6ac-05b80d949345","year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.476080Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1c87ec46a36bb6f059f4631aecb710b72179e5d23e76256d24e36fae98f5cf0a","observation_id":"45fd805f-bd6b-4f8d-9b54-b05872d043e2","resolution":{"observed_at":"2026-08-07T05:29:58.982732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.963765Z","title":"Unpaired image-to-image translation using cycle-consistent adversarial networks,","venue":null,"work_id":"58a72075-193d-4a53-9b14-d64aa9fa27fa","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.480636Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:2eeb769fe9c23901e74079692c09e4b4ed9bb68b742c31e200b6b57fad07d142","observation_id":"fdd5693c-134c-467b-b7a3-ec5fd9e4025c","resolution":{"observed_at":"2026-08-07T05:29:58.968419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.949771Z","title":"Track- former: Multi-object tracking with transformers,","venue":null,"work_id":"d2ff7f25-24ee-4d2b-9203-ced72bb763b1","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.485241Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3f756dd4b66ea7287dd9aee613a0a1ee0f283cf14d2f3d7b8ea8ac3518a50c7a","observation_id":"8bfb6082-1d7a-4106-a8af-8a277fe8ec47","resolution":{"observed_at":"2026-08-07T05:29:58.954162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.933925Z","title":"Boosttrack: boosting the similarity measure and detection confidence for improved multiple object tracking,","venue":null,"work_id":"f7234517-923b-4bc2-a88c-fcadc3b98563","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.490389Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:41b6628225c9a498b29e113ed96ad1684292c6fe5dfbbd17670cbdda419f57c0","observation_id":"58c620b3-1d1f-4e50-afe7-66437e7f8221","resolution":{"observed_at":"2026-08-07T05:29:58.939675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.919425Z","title":"Bytetrack: Multi-object tracking by associating every de- tection box,","venue":null,"work_id":"26d0a678-27c9-42ac-8843-c60dd5e7ce7a","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.495250Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ad502d322f08de3f8d08cd9b55b69fc964e80426c4a3b1f843db73cea30da1b8","observation_id":"91e1de73-6aee-4ce5-a655-fda1cc12759d","resolution":{"observed_at":"2026-08-07T05:29:58.923966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.906089Z","title":"Diffmot: A real-time diffusion-based multiple object tracker with non-linear prediction,","venue":null,"work_id":"3229fe67-f562-4359-9fdc-d03e27a66f5c","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.499666Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:27a6c5256940d09a55f01940e5a4c22c5749eafe6ffe2e8ad0e78f26fdd46de9","observation_id":"0563de1b-60ef-4f71-9e84-9b81bc888e60","resolution":{"observed_at":"2026-08-07T05:29:58.910807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.892256Z","title":"Simple cues lead to a strong multi-object tracker,","venue":null,"work_id":"cec798b7-d039-49f6-b41f-b28036d0cd52","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.503887Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:41ce269ed3d81ea5b1fb97c2437cfc0e41a6bc9e709695f39b1e58ee95f3a1fc","observation_id":"47c2dce8-73e9-482a-a01e-36c85d962dc9","resolution":{"observed_at":"2026-08-07T05:29:58.896639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.878175Z","title":"Romot: Referring-expression-comprehension open-set multi-object track- ing,","venue":null,"work_id":"0ab4fa14-22cf-4aaa-9cff-d95cf47a64d7","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.508550Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:672ee104e9116d5f443eff399911c269d31c7d89e7cc10415c6d2829b131af18","observation_id":"ca4413ff-5f36-4ade-b6a9-f9d02fe52f41","resolution":{"observed_at":"2026-08-07T05:29:58.882851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.863651Z","title":"Samba: Synchronized set-of-sequences modeling for multiple object tracking,","venue":null,"work_id":"446aa016-2095-46bb-8583-696a68c78145","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.513088Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3a2b991c2264c09c790e924b70ad7ccb152ef9062339d464bbdab5958f0f905e","observation_id":"264d7d5e-3788-4926-8fdc-08ec25309c6e","resolution":{"observed_at":"2026-08-07T05:29:58.868490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.849409Z","title":"Sparsetrack: Multi-object tracking by performing scene decomposition based on pseudo-depth,","venue":null,"work_id":"58455b33-93f2-4d27-9398-03b1011ffc24","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.517371Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:732ba43fe0a089b328280ab745508bd2bb992eab4e4ca0e6e99affb6fe47bd02","observation_id":"66bdfd4a-406c-4fd4-a4de-3e72b105b8b5","resolution":{"observed_at":"2026-08-07T05:29:58.854008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.834679Z","title":"Unifying short and long- term tracking with graph hierarchies,","venue":null,"work_id":"a11e4101-5059-4cc3-887f-236fb1c63faf","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.521641Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8067bfee836332bc993d6728648b972e37376191fd2b49cc22e42a19097a5f90","observation_id":"b3f76947-01ba-465b-a0e7-da6b5a99dda0","resolution":{"observed_at":"2026-08-07T05:29:58.839244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.820137Z","title":"Matching anything by segmenting anything,","venue":null,"work_id":"1f72971a-d652-44df-9f05-abc66da781b6","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.526617Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1a235c504d7f015e3853f0ac819138642078826ad435140388f6aabba7e769ea","observation_id":"8519e4d7-16f9-4e3b-8c82-fa7895b6775d","resolution":{"observed_at":"2026-08-07T05:29:58.825360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.806422Z","title":"Joint modeling of feature, correspondence, and a compressed memory for video object seg- mentation,","venue":null,"work_id":"14f6e234-2a47-4656-a75c-ba7b3a3632f1","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.531185Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:cc825702b07caede334cf105471795326dc5d7210847e87b045803447dfee319","observation_id":"64e0327a-f25e-46ef-8aa2-89728e1e1bcc","resolution":{"observed_at":"2026-08-07T05:29:58.811130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.791272Z","title":"Putting the object back into video object segmentation,","venue":null,"work_id":"5200c39d-7ee7-4169-81cd-ea4b730ef290","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.535504Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ba26ef69c034e5e981a356cb210b089a5129688768f5f01d8d74c3d8c2c8ec9e","observation_id":"ef3b0cf6-6090-4e67-9a6e-eb290f128804","resolution":{"observed_at":"2026-08-07T05:29:58.796553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.774674Z","title":"Tam-vt: Transformation- aware multi-scale video transformer for segmentation and tracking,","venue":null,"work_id":"8a9e8feb-5ed7-416e-bdc8-97a77ed09191","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.540001Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b5cf7f7c12d11c514df462b665448c07e2cd8fd51e3978b62a894d1961036aba","observation_id":"84caad5f-208f-44c5-958f-9092c957c86e","resolution":{"observed_at":"2026-08-07T05:29:58.780135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.759539Z","title":"Videoclick: Video object segmentation with a single click,","venue":null,"work_id":"d7132e8f-b655-4cae-9276-c81b25d079d9","year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.544497Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3b2e270dbe765c9d3af22017d92c86ca1bde8c913ecbf4286f4bb135c4edea8f","observation_id":"816f34d1-afeb-46a7-a8c0-fa4172a15fde","resolution":{"observed_at":"2026-08-07T05:29:58.764851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.743930Z","title":"Tracking anything with decoupled video segmentation,","venue":null,"work_id":"529cacd1-7651-4970-b274-61dccc95fead","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.548958Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:55b92ba2ae46f682dd978b7270db7e6ee36761d0691d00df73ac314ae8f1c5ee","observation_id":"6e3a3064-84ac-49fb-a252-499cb01b38bf","resolution":{"observed_at":"2026-08-07T05:29:58.749321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.729231Z","title":"Segment anything meets point tracking,","venue":null,"work_id":"9797231d-a588-4952-ba61-9f5deb7ca75f","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.553195Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:9914ed16e54669e369dd6ad43711fb987644acdca463c92d928ec8e4d999ea95","observation_id":"c88fc593-8467-45cc-9ecf-6ab7c2b6f38e","resolution":{"observed_at":"2026-08-07T05:29:58.734308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.714537Z","title":"Occluded video instance segmentation: A benchmark,","venue":null,"work_id":"39dcec50-8092-47c3-bc28-d068f84a4fa6","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.557338Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:89e0cbacb5266fb0f31d778871dc22956441b2bbb63e9e21fbea4c48c06061bd","observation_id":"bf9cb5f8-cc62-4cdd-a3c7-cb383613eda1","resolution":{"observed_at":"2026-08-07T05:29:58.719088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.699718Z","title":"Towards open-vocabulary video instance segmentation,","venue":null,"work_id":"9848f3af-7502-4b93-8131-91c63c4a75bc","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.561868Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:18cef6f42f796cc9a18244a0483eccebd5bbccc008733a080522c4efe54d0c21","observation_id":"89cb77e5-ea89-4f34-88cd-f40f0399b2ec","resolution":{"observed_at":"2026-08-07T05:29:58.704843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.684784Z","title":"Dynomo: Online point tracking by dynamic online monoc- ular gaussian reconstruction,","venue":null,"work_id":"ddfb926a-af4d-4884-932d-055087f4dbc6","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.566440Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:086a950c4ae26c8304d367e67665d602a6fdc997a32d997c1733e25b5a0f684a","observation_id":"c50198bd-0d88-499d-89a3-e4185fbb5892","resolution":{"observed_at":"2026-08-07T05:29:58.690240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.670930Z","title":"Spatialtracker: Tracking any 2d pixels in 3d space,","venue":null,"work_id":"3a0c5798-6eb5-4d0b-92a1-077a76fd342a","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.570932Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5bd70fed19c250f9d97ef05eac365d8b16b5527eccd34ac68ec4de6f1aedb72c","observation_id":"c606cdf6-5506-483b-bea3-7e55aeb607f5","resolution":{"observed_at":"2026-08-07T05:29:58.675448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.657023Z","title":"Track4gen: Teaching video diffusion models to track points im- proves video generation,","venue":null,"work_id":"bb85f877-cd48-4684-830a-298013970457","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.575277Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e36bd66a5347be4684c9159106405c73ca07adaab573fd77ee90098ef1d7cb6d","observation_id":"3f62c37d-8d34-48d2-80e6-c16433b9d558","resolution":{"observed_at":"2026-08-07T05:29:58.661481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-03T21:35:04.144048Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-07T05:29:57.579631Z","title":"Cotracker3: Simpler and better point tracking by pseudo- labelling real videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.579631Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:51d2abf83fe6ce82afc8f1844eaa98d3c5802ad1feb3417a96b39970055b8f28","observation_id":"e4f83091-7b1f-419d-882a-8043b18292de","resolution":{"observed_at":"2026-08-07T05:29:57.579631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.641876Z","title":"Omnitracker: Unifying visual object tracking by tracking- with-detection,","venue":null,"work_id":"3d6da0db-7596-43f1-a132-b7f27812a3c2","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.584355Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:495ad3a5565471da111e7961dbb5c14cedbfa3cae2966d42276273b75fb603ae","observation_id":"8df8190a-0ce3-423d-aee6-54daa121903b","resolution":{"observed_at":"2026-08-07T05:29:58.647312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.627960Z","title":"Spam- ming labels: Efficient annotations for the trackers of tomorrow,","venue":null,"work_id":"f82d0d59-97a2-4e93-83ae-e8f9a7358537","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.588717Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ce729f6d0631ba037b452524ffcf3c3781d9316f4c83291a89b517ac2c462bdc","observation_id":"517e82b4-1b50-4f2f-86c8-b954cd74284a","resolution":{"observed_at":"2026-08-07T05:29:58.632365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.614514Z","title":"Better call sal: Towards learning to segment anything in lidar,","venue":null,"work_id":"070f7ee3-2ab7-444b-9cb0-c121affecae1","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.593013Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e444a78e0c3249eb9423c4301e6de4620e7a9d19e71bf1e2ba456a0b1153b351","observation_id":"2c475c12-6a97-40d8-ad89-b0752cc4567f","resolution":{"observed_at":"2026-08-07T05:29:58.618924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-07-06T19:58:22.387205Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18933","snapshot_observed_at":"2026-08-07T05:29:57.597591Z","title":"Efficient track anything,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.597591Z"},"links":{"cited_paper":"/paper/2411.18933","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:de3d7358ef569631b6bd52a310da3ca39e6b76f1a08f3da3523d6297b60d9d77","observation_id":"8f3a1dd1-010a-47c2-9401-55bfe408522f","resolution":{"observed_at":"2026-08-07T05:29:57.597591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.600815Z","title":"Ref- ereverything: Towards segmenting everything we can speak of in videos,","venue":null,"work_id":"06df9a07-8c53-4ded-8e25-89ba739d51fc","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.602394Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1bb41d23b3e60a58ceb8f8a3be2f4c0741ea1fcb98da095c6ee8ad9a0af1194a","observation_id":"bee51378-5c63-4c9b-aac5-3b0cfdd1a4fc","resolution":{"observed_at":"2026-08-07T05:29:58.605410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.585422Z","title":"Samurai: Adapting segment anything model for zero-shot visual tracking with motion-aware memory,","venue":null,"work_id":"ac619dc5-ac04-4f16-9a6d-a786ac00355c","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.606601Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ec1a681bc1ee534a646428f1a02e439782b7e6aabef7e4c010b82e6903a2eb35","observation_id":"69110601-d667-4a93-811f-41e58ed8cffc","resolution":{"observed_at":"2026-08-07T05:29:58.590896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.570989Z","title":"Smite: Segment me in time,","venue":null,"work_id":"236e5998-95f4-4493-b109-97fb9db3c499","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.610669Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:708ae76ad6fae805f3efde60e59251726b25f011e3755f3dabcdca7133d0554d","observation_id":"3f90fa2b-bfb3-4a23-9757-35defb0efd6e","resolution":{"observed_at":"2026-08-07T05:29:58.575993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.556324Z","title":"Deep multiple instance learning for image classification and auto-annotation,","venue":null,"work_id":"8235b59b-612e-48ec-8c52-f76948abcbde","year":2015},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.614838Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:88c9ccb760c375273a4389556f9f8525fee719a1f15742db7343e26bec67d586","observation_id":"69dc21d7-24c2-497e-85ce-b4b2e874e0fb","resolution":{"observed_at":"2026-08-07T05:29:58.560826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.540688Z","title":"Not all labels are equal: Rationalizing the labeling costs for training object detection,","venue":null,"work_id":"2dcaf1d8-776b-42f1-a7d3-8081b5742891","year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.619120Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:fce81308bd07e54dd322a1e2739d48072a9e6f29a01fe1f77dbd541651542c04","observation_id":"9a447e4e-c188-4eab-8fef-dacf1cb6f137","resolution":{"observed_at":"2026-08-07T05:29:58.546476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.525858Z","title":"Scaling open- vocabulary object detection,","venue":null,"work_id":"fdba341d-fa07-4b46-a20d-af33bca17b36","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.623371Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b65751d27cefe471525fc7446ae1223906280f2331f85b310e7b9cb1d522979a","observation_id":"6d28c945-c974-453e-a1d6-7f0d3215232d","resolution":{"observed_at":"2026-08-07T05:29:58.531148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.512130Z","title":"Detclipv3: Towards versatile generative open-vocabulary object detection,","venue":null,"work_id":"ecc58853-a9ee-43bc-b8ee-697a5af21436","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.627664Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:df34812891dc30b6475ea8c7dffeb0ea10bb4e09ece0a988fdbe89193cd7b72e","observation_id":"e3e9f6fd-d633-4cec-a05f-a10bd7794271","resolution":{"observed_at":"2026-08-07T05:29:58.516510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.497821Z","title":"Apovis: Automated pixel-level open-vocabulary instance segmenta- tion through integration of pre-trained vision-language models and foundational segmentation models,","venue":null,"work_id":"cd30ff79-787b-404a-93c2-1e39e5133558","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.631912Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:892dc1be828a2528e99f5f7ac25583ed9b32061dfdafdf12889512548c138833","observation_id":"89fb9a6d-966e-413f-9ccc-3646726d2494","resolution":{"observed_at":"2026-08-07T05:29:58.502773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.482970Z","title":"Towards real-time open-vocabulary video instance segmentation,","venue":null,"work_id":"c3971b32-ad96-49ba-b59e-40df1e6724ba","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.636201Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:608e6fe0947b10db305a0782dcddd227fbd9d9ff409831d35d95781863775a2e","observation_id":"c25acfe3-242d-4ef9-8b96-4372f40c7895","resolution":{"observed_at":"2026-08-07T05:29:58.488488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.467978Z","title":"Aide: An automatic data engine for object detection in autonomous driving,","venue":null,"work_id":"5186b515-8ba4-4bb4-95e0-e7617fd73a46","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.640450Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:eb786accd9acebfc48ea1545a31261f24db15792c1f389aaa0b0478226a69c58","observation_id":"7ae07312-23b3-4818-9881-1d6d7ea6018b","resolution":{"observed_at":"2026-08-07T05:29:58.473757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.454130Z","title":"Automatic labeling of objects from lidar point clouds via trajectory-level re- finement,","venue":null,"work_id":"26bf8e44-b76c-4104-8f0e-ef5ff9f8e9ad","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.645606Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ff9076bdd0ecf63581bd297b6cdbc4a10fb78a60176aaab420a6e9e7cbb54095","observation_id":"79e9f0b0-c5f0-4d54-991f-6e9e8b3ac182","resolution":{"observed_at":"2026-08-07T05:29:58.458559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.439699Z","title":"Cosmos world foundation model platform for physical ai,","venue":null,"work_id":"65304521-3f63-4df4-a436-68e57679429a","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.649770Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1824815d25f604bece258e82c8b6a38b1a5dbfb50b963f12262cf1ccd92ccfa5","observation_id":"a94816a4-697a-4e44-8524-57782251bd82","resolution":{"observed_at":"2026-08-07T05:29:58.444531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.425692Z","title":"Launch: Auto label images with roboflow,","venue":null,"work_id":"187f6e5b-52ad-4687-ba62-458d73c092ec","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.654079Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:18c3b48cc623aa383704b86eeacb90b0140b457024326a7f33097ea49e3a2329","observation_id":"ef4443e8-3f9c-43f4-ab77-8e4e6d4a821b","resolution":{"observed_at":"2026-08-07T05:29:58.430444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.412081Z","title":"Semi-supervised open-world object detection,","venue":null,"work_id":"d8a5801e-e08a-424a-a029-5df33ede103c","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.658690Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:24dd3e7df55b793f948df43054c0d5dd627e7b9dbc879cf357e52993fb08db94","observation_id":"9f0378ed-e1e9-49b9-aebd-ff2086420736","resolution":{"observed_at":"2026-08-07T05:29:58.416237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.398239Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise,","venue":null,"work_id":"f68c75ec-b1cb-40d1-a280-64b6072c9e4b","year":1996},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.662988Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5a2afb71b0e74d631eac7b3e318e3367c0544512a6a177acfed1edb7b405da3f","observation_id":"88c6090c-43b8-40d2-9100-1b30af70dab5","resolution":{"observed_at":"2026-08-07T05:29:58.402802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.383917Z","title":"Mot16: A benchmark for multi-object tracking,","venue":null,"work_id":"b3035f97-2f28-4ce6-b046-e992eb72ea62","year":2016},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.667378Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:97d2ff36792e4ec8d7c0d37fd144b3c47abdc326d7707ffdff95509a25981209","observation_id":"0f5e39e2-95ae-4a2b-a62d-8b00f75fe8b7","resolution":{"observed_at":"2026-08-07T05:29:58.388362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.02609","last_updated":"2020-06-04T01:53:18Z","snapshot_observed_at":"2026-08-07T01:25:20.195562Z","submitted_at":"2020-06-04T01:53:18Z","title":"Simple Unsupervised Multi-Object Tracking","version":1},"cited_work":{"arxiv_id":"2006.02609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.02609","snapshot_observed_at":"2026-08-07T05:29:57.895205Z","title":"Simple Unsupervised Multi-Object Tracking","venue":"cs.CV","work_id":"87a8e2f0-a0b2-4dac-8ac0-2f3f44cde86b","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.672311Z"},"links":{"cited_paper":"/paper/2006.02609","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:acc91ed9a2973c28800eb81ba22734270802c597ee3c43e490f6b294e3e8abc9","observation_id":"23ae04ab-125f-4eec-8f95-e237a5e09244","resolution":{"observed_at":"2026-08-07T05:29:57.900009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.02337","last_updated":"2020-12-10T04:11:29Z","snapshot_observed_at":"2026-07-06T10:20:37.263384Z","submitted_at":"2020-12-03T23:59:27Z","title":"Probabilistic Tracklet Scoring and Inpainting for Multiple Object Tracking","version":2},"cited_work":{"arxiv_id":"2012.02337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.02337","snapshot_observed_at":"2026-08-07T05:29:57.870208Z","title":"Probabilistic Tracklet Scoring and Inpainting for Multiple Object Tracking","venue":"cs.CV","work_id":"7c2a4221-539b-4d41-a1f1-957080b1b99b","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.677451Z"},"links":{"cited_paper":"/paper/2012.02337","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ee28454700a74def8e22600383c4590886adafea707f88bba3ec19147506137d","observation_id":"d21bd25a-5978-40b3-993f-d519487cd308","resolution":{"observed_at":"2026-08-07T05:29:57.877145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.369274Z","title":"Tracking objects as points,","venue":null,"work_id":"c27d43a2-97a2-400a-8f45-92befb45fe3b","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.682281Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4e2cebdde863ce9875cc2e9bfe020f7952266124cd15dd2d1f69b438ad395695","observation_id":"95a3436c-593d-4113-a857-a8fb5397f545","resolution":{"observed_at":"2026-08-07T05:29:58.374585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.354131Z","title":"Mot20: A benchmark for multi object tracking in crowded scenes,","venue":null,"work_id":"6cb63ae3-629c-48b4-99b5-34ea4dd1f592","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.686599Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:d084d848f31850e101f6cef65028c7dff9cc43841c17e80fdd8ade03156f2b10","observation_id":"c5080f07-314c-4f2f-94e7-b41a25a63ee7","resolution":{"observed_at":"2026-08-07T05:29:58.359120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.340340Z","title":"Dance- track: Multi-object tracking in uniform appearance and diverse motion,","venue":null,"work_id":"09e81ea6-3a78-448f-b426-4692a2ab4627","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.690983Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f5c9335fb311c541e8ba9da2b5adffdfd3560164dd7715c16c812b300eb21a7f","observation_id":"b524e032-ae8c-4426-bb30-6ebeef504211","resolution":{"observed_at":"2026-08-07T05:29:58.344860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.325487Z","title":"Framework for performance evaluation of face, text, and vehicle detection and tracking in video: Data, metrics, and protocol,","venue":null,"work_id":"a63f4ee8-7c44-413d-8ce0-640f44ae14cb","year":2009},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.695512Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4513ea01c609734d44e619e20b76cfbb80f4e4b4724c9ad3c9ffc8e2d4cef9e7","observation_id":"b6509b91-f2a5-4c15-b883-ad66031681f0","resolution":{"observed_at":"2026-08-07T05:29:58.330228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.310892Z","title":"Per- formance measures and a data set for multi-target, multi-camera tracking,","venue":null,"work_id":"bf622a4a-8500-45b1-a7a8-315ea0b969d9","year":2016},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.700395Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5b001242c291de3edc6e98028962fcc96a818cf29393a9694824a07f613d640c","observation_id":"9d47f9c7-04f0-40d8-ba6c-53a797016299","resolution":{"observed_at":"2026-08-07T05:29:58.315467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.295552Z","title":"Hota: A higher order metric for evaluating multi- object tracking,","venue":null,"work_id":"86bb5d7b-040b-4978-aa7a-1fcfe317a157","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.705433Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4d71caa19fd887461a8c36ad933f50b0bdef3d1ae94c3bc87b720d55288da560","observation_id":"245d57dc-c72c-4f0a-88bc-49cf1deabe72","resolution":{"observed_at":"2026-08-07T05:29:58.300986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.280748Z","title":"Tracking without bells and whistles,","venue":null,"work_id":"6c8c3bc4-10a4-403a-ab14-a11340e079c1","year":2019},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.711032Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5e29d580f5c3b4349948b571f2ff4f26ed956b70546b7f674bfa2943dbd21d55","observation_id":"80075588-6396-4742-9571-bf0f4c39c8e0","resolution":{"observed_at":"2026-08-07T05:29:58.285525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.265654Z","title":"Learning a neural solver for multiple object tracking,","venue":null,"work_id":"f4cb3800-9f97-42e6-bfb1-37a9e8adbd81","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.716070Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:2d79bb1ac8cb11df05a79c158fd6485fa2789beae48a1d18883b6249fcb34818","observation_id":"586c19e9-1e65-48ba-a8c9-8c2a8c2ff125","resolution":{"observed_at":"2026-08-07T05:29:58.270336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:21:42.167548Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":2,"verified_fuzzy":53},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 1 inbound Pith citation observation for arXiv:2506.07850."}