{"as_of":"2026-08-04T22:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ee30fdc4ae24a0597f49c6f8ba60e61b298add8d5ea88e34cb48453c30e440c","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:23:35.864870Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06405/citation-record","integrity":"/paper/2607.06405/integrity","json":"/paper/2607.06405/citation-record.json","paper":"/paper/2607.06405"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T08:23:34.359214Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:34.359214Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:9783c7d09ba148add6d2196afae19895a654a67ee752c4b194580fed88e64332","observation_id":"88100169-bcc7-4dbb-aff8-d976a1520203","resolution":{"observed_at":"2026-08-02T08:23:34.359214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:34.515487Z","title":"In: ICASSP 2020 - 2020 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:34.515487Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:0e642a517678ee1a9e64e936bb5d540422deab1a276b16ce7ae1c3930347b964","observation_id":"9efdea3c-64cf-4fce-a7f2-22e83f54a36b","resolution":{"observed_at":"2026-08-02T08:23:34.515487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:34.575467Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:34.575467Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:3a72aa3cde0b9a86a23fc8bdca17ec334f1d4056955f39698c228baceda26760","observation_id":"986b53e8-81e5-4d66-b799-8dcce7ac779e","resolution":{"observed_at":"2026-08-02T08:23:34.575467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:34.698219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:34.698219Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:003e5f63a875460c31451f261724b2de1e75518207f58be3b16f8cda50c3d3ea","observation_id":"dd93d474-4552-464a-87cc-7365a6fbb5b0","resolution":{"observed_at":"2026-08-02T08:23:34.698219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:34.836848Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:34.836848Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:017e2d641d457a8729a23075d2c91844909b32dbafb25183411e0d21e8b3f9f8","observation_id":"27a2f274-2780-43fe-9a78-09fec54f6d58","resolution":{"observed_at":"2026-08-02T08:23:34.836848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:34.955335Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:34.955335Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:975993abf434f5170d7ff9738876a652e7c8952b5ceba67935c855a66fd03825","observation_id":"07c5f217-b934-4d1c-85f3-09be015a52ef","resolution":{"observed_at":"2026-08-02T08:23:34.955335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.058989Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference (CVPR)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.058989Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:048cdba1de70466880b0db15b783cc64f4615637df00d345b89d8524c2731adb","observation_id":"740dc824-80f1-49f6-9798-fa92caf04a17","resolution":{"observed_at":"2026-08-02T08:23:35.058989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.188003Z","title":"In: International Conference on Learning Representations (2019),https://openreview.net/forum? id=Bkg6RiCqY7","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.188003Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:6fc2428c181d763a20aab8788fec77f84cc6b5be1603cea71908e9e7201208cc","observation_id":"b62be7cb-31ca-4094-bd2a-8f81f522614b","resolution":{"observed_at":"2026-08-02T08:23:35.188003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.264243Z","title":"In: Oh, A., Naumann, T., Globerson, A., Saenko, K., Hardt, M., Levine, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.264243Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:9b1c0121806ef7335dd17e8752df06327a8e4077745f13fe900ee6083fea1fa0","observation_id":"c337599d-5ab4-4a47-9baf-579cacb0d55f","resolution":{"observed_at":"2026-08-02T08:23:35.264243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.310440Z","title":"In: Meila, M., Zhang, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.310440Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:39ae63de245d68682ed3ba17c94956ea253f89cd71bddc8259f5c85d72a309cc","observation_id":"096338fd-9d86-4e64-83bc-40114820ceed","resolution":{"observed_at":"2026-08-02T08:23:35.310440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.369837Z","title":"In: The Thirteenth International Conference on Learning Representations (2025),https: //openreview.net/forum?id=yFEqYwgttJ","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.369837Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:bdecf9aa0948dd650c1430cdf91c74c4cd37596553230c501a89766a53ca3de7","observation_id":"870ddedc-1cc3-4d0a-a2b5-97c3fa09eb7a","resolution":{"observed_at":"2026-08-02T08:23:35.369837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-02T08:23:35.411862Z","title":"arXiv preprint arXiv:2410.13720 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.411862Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:62b0fe0b09f15dbc9220dd97baa34a5c233b7ffad6266969873dcf0dbccc5dc4","observation_id":"a2a3e85e-7492-48b6-bab2-9b7948240738","resolution":{"observed_at":"2026-08-02T08:23:35.411862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.474923Z","title":"(eds.) Proceedings of the 41st International Conference on Machine Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.474923Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:08664d7a13e8bfa4c7061b30f89a52929a76d75584d58c745f694643993ab7f5","observation_id":"3193c7ce-fe66-4d3d-ac33-69eefe42ce98","resolution":{"observed_at":"2026-08-02T08:23:35.474923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.567854Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.567854Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:c04a39bbc186d8e7a56f0161ebd2e05d4d71c13f92ba0ac933b2154e629a2e6b","observation_id":"7a14b2d7-3fd6-47d1-b0e7-cfc164fa75c3","resolution":{"observed_at":"2026-08-02T08:23:35.567854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.658546Z","title":"In: Proceed- ings of the Computer Vision and Pattern Recognition Conference (CVPR)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.658546Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:026223463ba2ff5adf607e939161f6cb5ba391b456212efd6095eec31facc0fd","observation_id":"d1e879e2-5562-4ad0-8afc-cc2bf0240421","resolution":{"observed_at":"2026-08-02T08:23:35.658546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:23:35.762401Z","title":"In: Globerson, A., Mackey, L., Belgrave, D., Fan, A., Paquet, U., Tomczak, J., Zhang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.762401Z"},"links":{"citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:15ff9637093420f1cc7894da1ac5160669705815ab9ae2e55f87064e212fa503","observation_id":"76871a0a-0c5e-46a0-9431-0b56cf431eb9","resolution":{"observed_at":"2026-08-02T08:23:35.762401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01494","last_updated":"2024-07-01T17:35:56Z","snapshot_observed_at":"2026-08-03T01:05:23.269633Z","submitted_at":"2024-07-01T17:35:56Z","title":"FoleyCrafter: Bring Silent Videos to Life with Lifelike and Synchronized Sounds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01494","snapshot_observed_at":"2026-08-02T08:23:35.864870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T08:23:35.864870Z"},"links":{"cited_paper":"/paper/2407.01494","citing_paper":"/paper/2607.06405"},"observation_digest":"sha256:a013affc87969b132d7d0e0648c3e881579a9f6680cf674a446abd7af7d862ea","observation_id":"bdea5d69-94cc-4cd0-a427-0d4cbc8e5e53","resolution":{"observed_at":"2026-08-02T08:23:35.864870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.06405","last_updated":"2026-07-15T05:05:15Z","latest_version":2,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-02T08:23:32.687929Z","submitted_at":"2026-07-07T15:34:43Z","title":"Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2607.06405."}