{"as_of":"2026-08-19T10:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5e6a5567415d595172f32fe332c1e535d4d8e8bd86c917b8a5d3a64db1dd0dc","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:23:45.181243Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08147/citation-record","integrity":"/paper/2608.08147/integrity","json":"/paper/2608.08147/citation-record.json","paper":"/paper/2608.08147"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.427909Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.427909Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:86b931fa8f279cb0b5092fc36140cb84f14017e373df89e77b52fab79b538a3d","observation_id":"4c32549a-13cb-42c3-9c88-5c8533d6dc12","resolution":{"observed_at":"2026-08-12T00:23:43.427909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.343263Z","title":null,"venue":null,"work_id":"b0d55bd7-4464-43d7-9db9-95ea51cc29d1","year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.444410Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:376a008cf5854c66fb8762c5868b660531520fd5cee3e73deac6711fe76ffc2d","observation_id":"9fa9f973-6b3b-4e3e-a0a6-780cf5c14496","resolution":{"observed_at":"2026-08-12T00:23:47.348784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10764","last_updated":"2021-12-20T18:59:59Z","snapshot_observed_at":"2026-08-18T18:30:41.010430Z","submitted_at":"2021-12-20T18:59:59Z","title":"Mask2Former for Video Instance Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10764","snapshot_observed_at":"2026-08-12T00:23:43.457322Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.457322Z"},"links":{"cited_paper":"/paper/2112.10764","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:05d2fbf72784777f28d69d32f0c752e2cddb0161a1cdef1b551bb68860663eee","observation_id":"ff261f16-f6ee-4523-bb13-442e9aadc9dc","resolution":{"observed_at":"2026-08-12T00:23:43.457322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.465354Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.465354Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:98ba8ab2212a8fd30663e88fd5e43a71d7a5bbf3f6ff5b68a6ce874f81dec46a","observation_id":"f4a4a46f-468a-4235-a5ee-7a927b74a91d","resolution":{"observed_at":"2026-08-12T00:23:43.465354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.297225Z","title":null,"venue":null,"work_id":"613dae90-ba1f-4b23-8c91-02ca3ed3dcb3","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.535199Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:f1d57a80551190593951fa03cd721b17b7115ba5d27359d4452fa6180dc00610","observation_id":"763013db-866f-45d6-b1ea-b8d3e4ac1314","resolution":{"observed_at":"2026-08-12T00:23:47.302624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.277212Z","title":null,"venue":null,"work_id":"54dde5ce-5be2-46b1-ab82-c96e4d0fea24","year":2018},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.570550Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:819f52f36ec2378860f1cc23f4daa5b51b4785995ee9f2776d83ea51004bc6b7","observation_id":"3d1ecc63-f5ca-473e-a735-bc266d02228b","resolution":{"observed_at":"2026-08-12T00:23:47.283737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.260483Z","title":null,"venue":null,"work_id":"008bdcea-c7bd-4bdc-aecf-30175a4fa61b","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.649272Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0f54cfe70b1e0067ac7facab945ee3c498170d2eb5e8101d482cca53052e7104","observation_id":"00af9993-906d-47ea-8925-c5a02ec86614","resolution":{"observed_at":"2026-08-12T00:23:47.265945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.240631Z","title":null,"venue":null,"work_id":"5b87e562-5d76-40ef-9e79-6ac72414113c","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.676331Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:d7c05944ff732895c62ab2200c4960ee1076ce35c2e0e55b92a35aca2fe3e208","observation_id":"2ab89764-c1e7-43b6-8e0f-36b0445dc6ef","resolution":{"observed_at":"2026-08-12T00:23:47.246304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.687375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.687375Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:6179afe6f5829fe251392f030158d4ad4aeb70e5967ac291ee81f4128b387c9d","observation_id":"081fb75f-f239-4410-b95a-1d9485476df4","resolution":{"observed_at":"2026-08-12T00:23:43.687375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.692883Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.692883Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b1b0736cc22d69bcd2212a2d070e12372467ef77296f33e34a15c4144d536857","observation_id":"a196497c-14a3-4d51-a63c-7548db47c40b","resolution":{"observed_at":"2026-08-12T00:23:43.692883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.11523","last_updated":"2026-07-13T13:09:45Z","snapshot_observed_at":"2026-08-15T01:01:51.688250Z","submitted_at":"2026-07-13T13:09:45Z","title":"Vinci2: Providing Proactive Assistance in Continuous Egocentric Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.11523","snapshot_observed_at":"2026-08-12T00:23:43.698528Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.698528Z"},"links":{"cited_paper":"/paper/2607.11523","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b91bce3c27a580559a190ad7d8b09f31cbbb459a86f6992eecc98eba36dcb267","observation_id":"c3aa9a52-be5b-44d8-a0fa-d8d671e59fcd","resolution":{"observed_at":"2026-08-12T00:23:43.698528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.704862Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.704862Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:fcd3e3b7bd80e2fc3f7653ff6db5f6a3faaa0b0c004fc15158aabcc515d2b445","observation_id":"9c511824-9850-4f74-88fc-8825aaf76f52","resolution":{"observed_at":"2026-08-12T00:23:43.704862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.709412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.709412Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0966b18d8f71ad1c0349da22bf84947db426b5a7cdd818c176f03b4c1031d302","observation_id":"8b6c1ea2-784d-48d6-aac2-a6863f5d5044","resolution":{"observed_at":"2026-08-12T00:23:43.709412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.200149Z","title":null,"venue":null,"work_id":"95161a27-3706-484d-aa00-6fa0dfa45062","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.815849Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:153c3c6ea6bafe4447ca0aab7ab2d3e8e26430f1012bdeb158cfac71d205cebe","observation_id":"24ec047a-6e78-4c8f-90f7-e7933eb601d5","resolution":{"observed_at":"2026-08-12T00:23:47.206213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:43.898118Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.898118Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:50c3c85f0b2ae142d577864ec4b40650c3146fbd5d968d3a584bc600ee21d83e","observation_id":"758d153a-1770-4c9d-94ea-27468da1a89e","resolution":{"observed_at":"2026-08-12T00:23:43.898118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-12T00:23:43.974152Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.974152Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0f92fa575c83503b4073e8b0b67ebe5df4f5926b4686ff74f1debea13a461d30","observation_id":"7056d056-fa54-4d9c-a185-8535ffaf2cf6","resolution":{"observed_at":"2026-08-12T00:23:43.974152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.184214Z","title":null,"venue":null,"work_id":"0532f637-ed74-4791-b847-ed7b24fdec50","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.003759Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:f6217d25ff1ae7b5e9ddf04e4136a336dc77f7d2dde824483ccd40030ab23a2d","observation_id":"276f969e-1047-48a7-95d9-c286f3d0eaf6","resolution":{"observed_at":"2026-08-12T00:23:47.189249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.039580Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.039580Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e3503272aaad331d2fadc05717dbd1fdf50702539ebea3f7fd671c0271ac0315","observation_id":"a7359f0e-16d5-47a3-b11a-bd246c53ce90","resolution":{"observed_at":"2026-08-12T00:23:44.039580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.054593Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.054593Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0a9aa145f1d2d020999cd4c6e1d73d83d1b9ce305acdad7ef12865b2bc1b3687","observation_id":"26b8e7fc-f26a-4ebe-8278-04ac5239fc4e","resolution":{"observed_at":"2026-08-12T00:23:44.054593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.060295Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.060295Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:55128fd6e1a78c6bcd8677747e86dcdba81ac31a4505fb73364655ba4336b5b5","observation_id":"c8810991-a84b-42fc-a065-c6999532c7a5","resolution":{"observed_at":"2026-08-12T00:23:44.060295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.069809Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.069809Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:854f1693433445fcb9e1d15f80db0edfebe7824bba3de1142023def2fadc36e1","observation_id":"e8d7d534-588d-4320-a112-30abe0b4d2ab","resolution":{"observed_at":"2026-08-12T00:23:44.069809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.064924Z","title":"In Proceedings of the AAAI conference on artificial intelligence, Vol","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.064924Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:856d2695bb0f7e5ca812b68fa6419aa9391406396398da7ffed28f5de35bb160","observation_id":"e267506d-e2cd-474a-9e61-73f491c231af","resolution":{"observed_at":"2026-08-12T00:23:44.064924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.304337Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.304337Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e5f76d4eeef301d0871a8b2db1cc9302f93b996bfd52efd90e1404201bbb902e","observation_id":"c90fbe91-0a72-4de1-ba9a-587368e38094","resolution":{"observed_at":"2026-08-12T00:23:44.304337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.177223Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.177223Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:fe37947f265762bf74d26f80c746991657329601549650b6a845b30229012123","observation_id":"2518938b-4cb6-416d-98fd-0887df492bc8","resolution":{"observed_at":"2026-08-12T00:23:44.177223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.052269Z","title":null,"venue":null,"work_id":"af5d3639-8329-4b5e-bcb3-60c0f74cebb5","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.321058Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:391429f76b8db32a2b3b0718a02fe49dfbc83d268fe40dd48edba91c764a8ab6","observation_id":"af1daff2-2390-40d9-86ee-641237e978e7","resolution":{"observed_at":"2026-08-12T00:23:47.057470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.036094Z","title":null,"venue":null,"work_id":"8a46fd02-b974-4353-95ae-fa112ab33767","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.325406Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:cbee3f25fe3047f83c6c010b015962a168289adbb44daf5e731dde7955a19b41","observation_id":"54e188d3-6498-495c-a7e9-1c182282a3f5","resolution":{"observed_at":"2026-08-12T00:23:47.041293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.069713Z","title":null,"venue":null,"work_id":"16215c8a-ecbd-4b79-a1ef-1cbd6f743cdf","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.315924Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:691cc922229139ca2a4ed4804b921627413a8eb3399aef7df53957299afe583e","observation_id":"19df8336-978a-4d22-9403-e437b863b8e7","resolution":{"observed_at":"2026-08-12T00:23:47.074259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.009274Z","title":null,"venue":null,"work_id":"ce7cbba3-251d-42b2-8241-a5a1ed38d72e","year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.457604Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3a0bff4ea01991c734953de2de307d1d78cc8836aa888c81965f889c4dd6be43","observation_id":"99d37dc9-33df-4cbc-bbaa-eeaea44116a5","resolution":{"observed_at":"2026-08-12T00:23:47.014282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.482466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.482466Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:fe8134627fa8469c846188d48922ec9380285f528334277ab28c5f49671d6d2e","observation_id":"52f8ef2f-7084-4a73-943e-22c4c01b38d1","resolution":{"observed_at":"2026-08-12T00:23:44.482466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.386644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.386644Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:0c70379434d135f51e9d0c37c2da16854f4b1701eb132de1b7bf74f563e2a2e6","observation_id":"e02fc491-881d-4bcf-ae89-3f7426715817","resolution":{"observed_at":"2026-08-12T00:23:44.386644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.961621Z","title":null,"venue":null,"work_id":"1deeaef2-6b02-4869-8bdb-e5232ca43850","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.509387Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b69d6290fa8374b7af977cd4d7f03545e4a4671d1c0b1aa98bde1f83edf43d77","observation_id":"248385f0-6fa3-4688-89d8-3b426bf79bd4","resolution":{"observed_at":"2026-08-12T00:23:46.967633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.943390Z","title":null,"venue":null,"work_id":"965bb919-f0a7-4fa6-9848-c24f07d9ef84","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.513839Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:59c7cd7dc47d5db804186e7e7bf69acf729868617d7775d2235500302c5151d3","observation_id":"dd1954c7-dc47-4b49-bcd6-1c2249c1585a","resolution":{"observed_at":"2026-08-12T00:23:46.948297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.497075Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.497075Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:d733f05f9df7eb18778df1338c2521350d4dbe73b846578fae328b0739c58503","observation_id":"79fa4491-911b-4300-87eb-04016732d339","resolution":{"observed_at":"2026-08-12T00:23:44.497075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.674016Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.674016Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:ab1bb479625d537104d8bdc45683952f7b6685e4c000f8a21babb194b0f004e1","observation_id":"9d1a9a82-9b3d-4673-9fca-16447be6741b","resolution":{"observed_at":"2026-08-12T00:23:44.674016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.679878Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.679878Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:355834b649e9bced87d35c14542f45e2df4669189aaa99cfe0b4b4e61acc6caa","observation_id":"d8818518-a551-4396-ba00-e0fb277fda82","resolution":{"observed_at":"2026-08-12T00:23:44.679878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.894905Z","title":null,"venue":null,"work_id":"1b4ce655-e058-471e-a028-72ec8ea6af05","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.684994Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:845cd981f64229b908d0f4a3e58756666880db0716c6282c60e48a70d4297727","observation_id":"df0f26c0-d27b-4555-8a67-6697869238d6","resolution":{"observed_at":"2026-08-12T00:23:46.900777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.926213Z","title":null,"venue":null,"work_id":"deda90ce-7db9-40de-93af-41641493956a","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.595147Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:5b54f63b07cdc0ea9017d8c79c22e2412a76b1b45199b02d84445cbbef0c6828","observation_id":"024c7347-44d6-4643-a5e2-158133d5200f","resolution":{"observed_at":"2026-08-12T00:23:46.931479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i9.37673","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.360776Z","title":null,"venue":null,"work_id":"eb9889e4-e301-4ca3-abb3-f6e80a3b0581","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.698742Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:4724b0449ed1d0a2fd03ca1719f31fb2597e23e2f58b43c2460cad5ca613ad8f","observation_id":"fdb2e965-204d-48bc-b119-a113ac355ac9","resolution":{"observed_at":"2026-08-12T00:23:45.365987Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:09.093835+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:09.093835+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.749572Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.749572Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:a082353d45f316ad71040331379639e1a026431e905bdb9b0c2a72466d44fa69","observation_id":"7d67049c-6762-42af-9fad-82cb8bb690db","resolution":{"observed_at":"2026-08-12T00:23:44.749572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.845009Z","title":null,"venue":null,"work_id":"62e520e5-8fa8-4a4b-b0f5-7f96a7d48d1b","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.799413Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3b31655a1d6ddc55fba0296c557e28481178ca8855eb988b4ab3670d8f70a8fd","observation_id":"80160fc7-5a3d-479b-880a-fde5a3a4538a","resolution":{"observed_at":"2026-08-12T00:23:46.850159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.875607Z","title":null,"venue":null,"work_id":"5b13ac81-19aa-44c6-81c4-007e9185ddcc","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.689762Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3b37e279d3aa541fa1fe51a59862984ec39f8b77453651d1ed223dbaa22c0622","observation_id":"479663d0-77a7-488c-84fb-eb68899a24e9","resolution":{"observed_at":"2026-08-12T00:23:46.881463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.827446Z","title":null,"venue":null,"work_id":"71cb81f2-be8b-4fb6-9a22-95b203be1368","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.811062Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e6d2796e7e1f9f202fefffdaa4106f8ef29e021237fca99fb282b50a10bfe890","observation_id":"77010a1f-961d-468d-91a6-dd919f91d51b","resolution":{"observed_at":"2026-08-12T00:23:46.832558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.816530Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.816530Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:fd01c6ab59038e0f002745f34bae02b9d605ff5c97611683bf5c2b3e16aa9b28","observation_id":"c8f8ee7c-6d86-428c-8671-28a3f176eeba","resolution":{"observed_at":"2026-08-12T00:23:44.816530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.795813Z","title":null,"venue":null,"work_id":"6490ba5c-0d4f-45b6-bcc3-0c6eb53e7ce1","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.821406Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:ff40c7b319da33577ac0f2d9a7025485aaa9b166e0d234c44075452adad9cadc","observation_id":"4f1d5d23-d20a-4512-b286-4ac9bfe333a2","resolution":{"observed_at":"2026-08-12T00:23:46.800723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.780168Z","title":null,"venue":null,"work_id":"713911dc-c7e8-4242-8ed2-f857f45cb856","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.850880Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:718bb0d63af9d05710f94700a1c0990fab4a981666e4261c24636f7c0bdb6021","observation_id":"ae2d4cbc-18cc-49e8-bf82-d8f56ceea403","resolution":{"observed_at":"2026-08-12T00:23:46.784361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02005","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.021109Z","title":null,"venue":null,"work_id":"01d74a19-2a3c-4799-ab43-7ad91f0b9c35","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.805064Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:6145612489e2b0dad19f3baa26c7a67d6595014fd420721bcef3b84b0d99ede6","observation_id":"3a5704d0-80e7-409c-9f7e-71f6f2929b1b","resolution":{"observed_at":"2026-08-12T00:23:46.029339Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32215","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.847548Z","title":null,"venue":null,"work_id":"988766e2-f593-4baa-a3b6-038e08b376a7","year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.876817Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:075d9798daa0bc7bd3501c2c2ffdd18e0cfcf6d1063e281cab02e042f32ae14d","observation_id":"ca1ba040-c522-46c8-ab13-fb859b1c5ebc","resolution":{"observed_at":"2026-08-12T00:23:45.855746Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.763624Z","title":null,"venue":null,"work_id":"b88d899f-e314-4c6f-90a1-0110a5062c76","year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.881907Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:9f3b97803443848a099d5fa9689065ac163b20a24a29c2eb4f5061da4a0a884d","observation_id":"5d2ee6a1-aa58-4de9-9058-6c20a2c17176","resolution":{"observed_at":"2026-08-12T00:23:46.769186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20501","last_updated":"2025-04-29T07:43:37Z","snapshot_observed_at":"2026-08-19T06:42:39.980624Z","submitted_at":"2025-04-29T07:43:37Z","title":"SAM-Guided Robust Representation Learning for One-Shot 3D Medical Image Segmentation","version":1},"cited_work":{"arxiv_id":"2504.20501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.20501","snapshot_observed_at":"2026-08-12T00:23:45.727719Z","title":"SAM-Guided Robust Representation Learning for One-Shot 3D Medical Image Segmentation","venue":"eess.IV","work_id":"48947905-b279-4877-80c7-ad28e7bebb13","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.887084Z"},"links":{"cited_paper":"/paper/2504.20501","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:008544ec7711c1e9c93081b803e19f6a79e816a893cfe1ab2ce08162dd3f1047","observation_id":"a6ce9f21-d8bb-4473-bd41-05611b9a2d77","resolution":{"observed_at":"2026-08-12T00:23:45.734721Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.745971Z","title":null,"venue":null,"work_id":"838104e8-b753-42dc-8219-d661677c29a5","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.892399Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e1534216dae43f156732a34e02383236568b6774cbb54b06682ac288e0be98b1","observation_id":"d8a95c51-c02f-47f0-821b-17b5f3d4b9dd","resolution":{"observed_at":"2026-08-12T00:23:46.751538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.871944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.871944Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b7de5b329ab27b47a78b926f9730b9f983f5e3c629f7a541c802cd1f74124bb8","observation_id":"7be6e76e-885a-42e3-b07a-b0df64074e0b","resolution":{"observed_at":"2026-08-12T00:23:44.871944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.902690Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.902690Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:7f9e2e3621732e42a1bf9be2675986dbd060509b5e2e590424b4e1efb1791290","observation_id":"80719521-5b82-4ce4-8aef-bc333893a903","resolution":{"observed_at":"2026-08-12T00:23:44.902690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.944358Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.944358Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:e3c2f21305b2020492a70d0842d295a8044b23c138f2c9e1d99adc9d3fb745fe","observation_id":"0b58bdeb-ad49-4a5a-8c93-47db8d11da77","resolution":{"observed_at":"2026-08-12T00:23:44.944358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.718451Z","title":null,"venue":null,"work_id":"8501e66b-4ca9-4e1b-9460-0dd24d887b1d","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.969437Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:29fd6dedc45ce9cc2cbaa52578992aca5571b5d0b322c1a7e2eb148496eee70f","observation_id":"645969e3-c088-4343-96c9-5f0191daeb0e","resolution":{"observed_at":"2026-08-12T00:23:46.724184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.975739Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.975739Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:c8117f4eb279a03bcd40d77bca4d46bfce0a4cc3e041d44cfbc1cf6b2b5dd56e","observation_id":"fe60e948-729c-4242-b97c-11cce0b4a2a9","resolution":{"observed_at":"2026-08-12T00:23:44.975739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2022/320","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.239461Z","title":null,"venue":null,"work_id":"06bc65fa-4081-4688-87f0-270988f50b30","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.896979Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:304721162dc7cf9d7d595c88fe8d06eddd6399b5d6566224de575adb88ffd4da","observation_id":"98f9ef58-8bf7-4c45-b092-4312e535bbd8","resolution":{"observed_at":"2026-08-12T00:23:45.284765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:09.206318+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:09.206318+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:44.988662Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.988662Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:c4dfe408ea18379c987f4e8c6cd5b480577624ab6e6644abc5c36294aec1f9f4","observation_id":"e88d7688-bcb3-4633-bba3-198536129fad","resolution":{"observed_at":"2026-08-12T00:23:44.988662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.670924Z","title":null,"venue":null,"work_id":"1697997a-f0a8-42ec-b1a3-5742da1f65f2","year":2023},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.034131Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b784fd1baa2e7a0d9018432d6f4eff60a4fdb32f8eb0d86022d6a75e651204ba","observation_id":"44237009-dcb3-4b2e-b397-fde7d39ad087","resolution":{"observed_at":"2026-08-12T00:23:46.676098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.652675Z","title":null,"venue":null,"work_id":"8e872c8b-cd39-4f19-9b4d-15dc945df737","year":2013},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.072839Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:87c9cc0fa0806bae45c9e4891fb9aec45e75883eb33bfb20ba8b58dcd167dea5","observation_id":"9531a00d-cb52-4a6f-b204-b413d25ed878","resolution":{"observed_at":"2026-08-12T00:23:46.659042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.16260","last_updated":"2026-06-28T11:36:31Z","snapshot_observed_at":"2026-08-18T10:17:14.598412Z","submitted_at":"2026-06-28T11:36:31Z","title":"AdaSurvMamba: Dynamic Fusion and Semantic Scanning for Multimodal Survival Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.16260","snapshot_observed_at":"2026-08-12T00:23:45.081316Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.081316Z"},"links":{"cited_paper":"/paper/2607.16260","citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:b35c7746a17d8fe652cda8234efa72b14e00068a49edbfe5039a51c79883b97b","observation_id":"59a2a0b9-5a5f-45fb-8fac-b578100c9f1f","resolution":{"observed_at":"2026-08-12T00:23:45.081316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.688248Z","title":null,"venue":null,"work_id":"9f2c1658-a39c-41fc-a004-47ba19316227","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.982956Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3bd028c1e450e5722acecb887f76e787b44b8842e2bfb8adf7b11c1d6452aa76","observation_id":"74900215-c9ee-4ec6-8fe2-5266755d4930","resolution":{"observed_at":"2026-08-12T00:23:46.695016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.618900Z","title":null,"venue":null,"work_id":"4a5c2d90-4d48-4c74-9f4a-369a44fbe065","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.095104Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:1551c0beeff929fe2c3b213252f64986f33ec5d6a82a8f75c5df268f631dc027","observation_id":"f034ec9b-4c60-4d51-91cc-54905dfa4a9f","resolution":{"observed_at":"2026-08-12T00:23:46.624002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.602819Z","title":null,"venue":null,"work_id":"93e26ccd-6352-41ca-a53a-b2c82f93c10a","year":2021},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.129421Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:72791d68da3c8b48aec43d6ef6053bf97f7e3ae0257524b7daeae26e737bbc8f","observation_id":"dd5f7f77-572b-46f1-a5eb-e600ab39bbe2","resolution":{"observed_at":"2026-08-12T00:23:46.607961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36894","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.539159Z","title":null,"venue":null,"work_id":"73978e43-28cb-4a40-9933-99c0f80a3883","year":2026},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.181243Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:df266284667fe97211d570898e06259deea8b1b11ee43b9ffd8d86927fbc3bce","observation_id":"369d9352-1ad3-4559-bc91-9b94d4b88b02","resolution":{"observed_at":"2026-08-12T00:23:45.594849Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.635070Z","title":null,"venue":null,"work_id":"db2220f9-4f2e-4ca4-81ca-0bcdf82ca8b1","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:45.088090Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:d0a95e5459b460b3c1a40bb08559f7309a311d9355605d2a8ad71cefafa8e310","observation_id":"54222d53-86b4-46bf-8b04-6363feb5e6e4","resolution":{"observed_at":"2026-08-12T00:23:46.639663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.98","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:45.376882Z","title":null,"venue":null,"work_id":"ed07172a-d561-4aea-9b80-49b299a31143","year":2025},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":1924,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.694096Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:9b97f1b0fdfbaed463c23b901d3e606d3914a87052abf8cc1a596885ee3d1254","observation_id":"8841dcb8-f18f-4c7d-a09a-51800b010239","resolution":{"observed_at":"2026-08-12T00:23:45.382444Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:09.41793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:09.41793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.098989Z","title":null,"venue":null,"work_id":"b9ccce22-282b-42f0-b6d8-37f09cb7652c","year":2022},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.241817Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:c0ed64dcaa37e3ae977b39de6d044b4d065a95278affa02cf02a04411b2364a3","observation_id":"973321e2-725f-4f7b-a9eb-94702676a8d5","resolution":{"observed_at":"2026-08-12T00:23:47.104132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:47.327175Z","title":"InEuropean Conference on Computer Vision","venue":null,"work_id":"4a9537fa-35b7-493d-a7e9-f7afadf3985c","year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:43.450851Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:d51cfd33c3e281e004c47fe356c702cabaf9a49ce83fe82fe9098e7c9777028b","observation_id":"2ce8b3ae-3968-48ec-a1d3-9694010fefe8","resolution":{"observed_at":"2026-08-12T00:23:47.332546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:23:46.980538Z","title":"InProceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"129aa59b-685b-4c17-a23b-ad0e9d1e0e23","year":null},"citing_paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T00:23:44.502635Z"},"links":{"citing_paper":"/paper/2608.08147"},"observation_digest":"sha256:3c485bdc871a7f19fa7d3084d197187b306be7d81e29a0b7e20a6023c953cdf0","observation_id":"331a7f7a-aa96-43cf-8be7-741e98cecff4","resolution":{"observed_at":"2026-08-12T00:23:46.986116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08147","last_updated":"2026-08-08T14:11:56Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-19T05:41:42.479098Z","submitted_at":"2026-08-08T14:11:56Z","title":"SAMOT: State-Aware Step Modulation and Optimal Transport Matching for Audio-Visual Instance Segmentation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":60,"verified_exact":5,"verified_fuzzy":2},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2608.08147."}