{"as_of":"2026-08-17T06:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24eeace2fedf3e60a2e40e61edb7a3841016c32add4ff9dc28a6f4a6c66bbb30","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:24:02.218099Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00463/citation-record","integrity":"/paper/2608.00463/integrity","json":"/paper/2608.00463/citation-record.json","paper":"/paper/2608.00463"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.929795Z","title":"3D gaussian splatting for real-time radiance field rendering,","venue":null,"work_id":"ff50b81a-8cde-4748-95ef-6480820777f3","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:01.985894Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:46b49e47cf449153a34cbb9faea3634e0b6911de85bd13cd068af4a298ba9d1b","observation_id":"e20da344-c2f9-400e-a6f7-6fe95ef288e5","resolution":{"observed_at":"2026-08-15T15:24:02.933123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.920227Z","title":"DreamScene360: Unconstrained text-to-3D scene generation with panoramic gaussian splatting,","venue":null,"work_id":"256bba32-4fd2-463c-9880-f60edb23bda2","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:01.990530Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:14a40f4664d59e9f0f9a0824bff585ed4343b2481d4653d80af177b83f206cd0","observation_id":"b3ccbd8b-30c3-4a93-8c1f-5eb9e6055b0e","resolution":{"observed_at":"2026-08-15T15:24:02.923709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.910439Z","title":"WonderWorld: Interactive 3D scene generation from a single image,","venue":null,"work_id":"cb381ba9-b04d-49fe-a9a5-6e20b3c30d93","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:01.995286Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:836431d96343ef16dc46fdd0dc880ea4a5c57e39684d4837e6c48391a9e56655","observation_id":"103948ee-1ccf-40a4-bf8d-4ff7ea6019fb","resolution":{"observed_at":"2026-08-15T15:24:02.913948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.900553Z","title":"19, 2026","venue":null,"work_id":"f35ae108-756b-48ed-bd3d-71675dc9d32a","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:01.999409Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:84bb36e487b3489056013914f696ccb26f070a7f82db26923d0c2638cb4f04c6","observation_id":"c03191d3-fcbb-40c8-8cbb-ef768978c084","resolution":{"observed_at":"2026-08-15T15:24:02.903969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.890576Z","title":"AG2aussian: Anchor-graph structured gaussian splatting for instance-level 3D scene understanding and editing,","venue":null,"work_id":"3620e29a-5e20-40db-8390-5db78a15af49","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.002869Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:2e4257b1a0f5c3ff6a53df3de1161d2497cc77a5b24db3c944c13aed4e8c553a","observation_id":"e171de73-dc1c-4d07-a69e-2cd330f75bfc","resolution":{"observed_at":"2026-08-15T15:24:02.894321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.881688Z","title":"PhysSplat: Efficient physics simulation for 3D scenes via MLLM-guided gaussian splatting,","venue":null,"work_id":"22135f3f-0db5-4b5c-899c-847632560329","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.006579Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:249349f591e11b04bd6707c264fb7c1cc305765d3fb12cca0261a726787b4be1","observation_id":"997ec9fd-8377-4541-a800-182ecd82f2a9","resolution":{"observed_at":"2026-08-15T15:24:02.884629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.873479Z","title":null,"venue":null,"work_id":"46d251f0-60eb-469f-8686-733326076f25","year":1993},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.010121Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:799ebfb565c7648e1f7464de08449e099a3900cecb4d0043048a1e79397ce74e","observation_id":"893143a3-5894-4c7b-bab6-23fc58e1f92c","resolution":{"observed_at":"2026-08-15T15:24:02.876236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.865153Z","title":"Spatialized audio rendering for immersive virtual environments,","venue":null,"work_id":"2ea12882-3668-4c6b-9dd5-90861de31641","year":2002},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.013410Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:04e8283bc22a61799e56465274cb9445ce87427d50865c009b1c90b7450c9367","observation_id":"428179b7-2968-41dd-a0a7-4961e39fec64","resolution":{"observed_at":"2026-08-15T15:24:02.867858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.855916Z","title":"Sounding that object: Interactive object-aware image to audio generation,","venue":null,"work_id":"7843850c-c2ec-4855-bc1d-bd45d5890818","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.016675Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:b9634afe9a406173f46775fd72f0ed18b9f1d5846a514481a88b34db29642e5c","observation_id":"90f8ea17-06dd-4911-b2dc-ae5fec4d95f7","resolution":{"observed_at":"2026-08-15T15:24:02.859187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.846476Z","title":"SEE-2-SOUND: Zero-shot spatial environment-to-spatial sound,","venue":null,"work_id":"455f4548-7cb3-42b8-b7bc-c6a0a16fcce9","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.021036Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:2ad420ec6a08707d261b995acfe17906a362f3cb259042e16341c59f81595261","observation_id":"466c57be-c6c6-441f-9c80-69455de02fe0","resolution":{"observed_at":"2026-08-15T15:24:02.849914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.836477Z","title":"OmniAudio: Generating spatial audio from 360- degree video,","venue":null,"work_id":"808267b9-3640-4763-baf4-ecc56d7f98e8","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.025063Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:0b86ab62b0219da3e7827cdbb55fd0607821f1f4d4486773f6f2c44652582f99","observation_id":"9a63a2d3-920e-4f29-b454-0730a839129e","resolution":{"observed_at":"2026-08-15T15:24:02.840118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24270","last_updated":"2025-04-01T03:16:38Z","snapshot_observed_at":"2026-08-16T12:45:16.375450Z","submitted_at":"2025-03-31T16:16:10Z","title":"Visual Acoustic Fields","version":2},"cited_work":{"arxiv_id":"2503.24270","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.24270","snapshot_observed_at":"2026-08-15T15:24:02.370157Z","title":"Visual Acoustic Fields","venue":"cs.CV","work_id":"0fcabe4c-2ebb-470c-bfae-892adeb715d2","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.028590Z"},"links":{"cited_paper":"/paper/2503.24270","citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:c9904c921777e1255ed850e0eaf51c9563da9b573211c48e6f2871447d2c5c2f","observation_id":"0bc4a919-6c98-435b-b527-2de4b9827f8d","resolution":{"observed_at":"2026-08-15T15:24:02.373930Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.826634Z","title":"Sonora: Human- AI co-creation of 3D audio worlds and its impact on anxiety and cognitive load,","venue":null,"work_id":"75550de3-8610-4567-8dae-7bf2bd297419","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.032399Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:3bf632399e5bc787c7d4036ac30c3b05a0922f0ceb62d474264659ff6876823a","observation_id":"6976fcf2-2015-4cb8-b707-07c02441d55d","resolution":{"observed_at":"2026-08-15T15:24:02.830114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.816631Z","title":"SonoWorld: From one image to a 3D audio-visual scene,","venue":null,"work_id":"a1131da9-7bd0-4dc4-a81c-3ff840a81ae8","year":2026},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.035750Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:9331e1a1964bb6b5b0b099399da64c8a5b791c321d23400d60199d0781df9098","observation_id":"1bfc02af-4e36-4173-93b7-2453ca7df62b","resolution":{"observed_at":"2026-08-15T15:24:02.820306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.806506Z","title":"Gaussian grouping: Segment and edit anything in 3D scenes,","venue":null,"work_id":"d469ab85-0a31-4ed5-88ff-3783d4092c02","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.038923Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:a723a58febb246b9a5ea3bb0c373a85d5dc9b9b0a32379f90b8b7d41c7aecbe6","observation_id":"87d1e26f-2dfa-454a-a901-9578e96c65a5","resolution":{"observed_at":"2026-08-15T15:24:02.810078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.796520Z","title":"Object-based 3D audio production for virtual reality using the audio definition model,","venue":null,"work_id":"24068845-af9d-4d17-8d2f-4883e91f2dcf","year":2016},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.042400Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:e32180fcff47fcccb3e7cbe9626110267974098fd298fd80bf5047c4f4a07f68","observation_id":"4ff327c9-65fc-4f02-b9fb-b3dba1cd8fc5","resolution":{"observed_at":"2026-08-15T15:24:02.800058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-15T15:24:02.045702Z","title":"Qwen2.5-VL technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.045702Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:975f60771cfe9f3cde6b2d3602f6c80fcebb36254e98f356255c9fc6736e1472","observation_id":"a7bd38b1-73f5-4176-ac50-af234f01674b","resolution":{"observed_at":"2026-08-15T15:24:02.045702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-08-15T15:24:02.049486Z","title":"SAM 3: Segment anything with concepts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.049486Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:cf2a0266afb3ee63c259a5ce5d554f49f56c846564c959377524d2a96d34a2d1","observation_id":"5d8a5188-0c6a-4b25-9894-543efd686d60","resolution":{"observed_at":"2026-08-15T15:24:02.049486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.786412Z","title":"Stable audio open,","venue":null,"work_id":"4e656623-c6b9-4f3a-96a3-2f86c6579e1e","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.053799Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:de86db7a9fa34704aa886b5a323d523a7c623f44f8acc6e556850e64ef6ace54","observation_id":"d8122110-1695-4647-b1d7-9c35bd95f391","resolution":{"observed_at":"2026-08-15T15:24:02.789741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.777707Z","title":"AudioLDM 2: Learning holistic audio generation with self-supervised pretraining,","venue":null,"work_id":"3d843491-7f7a-4737-a2f9-d1fc4251f95d","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.057377Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:428d0858f27bf87d08eaafb5f465215ea3adbca515914812f9bd645e50a1b727","observation_id":"26c794c8-fead-479b-a02f-aa3223a76ea4","resolution":{"observed_at":"2026-08-15T15:24:02.780603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.768516Z","title":"AudioLCM: Efficient and high-quality text-to- audio generation with minimal inference steps,","venue":null,"work_id":"8bc09a15-ffe4-472e-ac3b-9db73668937c","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.062093Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:89d1f5bf9ed5374a899e5e2f9813399fcc63fb708cf74452c3415f30db2ea3ef","observation_id":"77adee3f-667e-4aea-9823-dbc553d55ffe","resolution":{"observed_at":"2026-08-15T15:24:02.771423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.759062Z","title":"FlashAudio: Rectified flow for fast and high- fidelity text-to-audio generation,","venue":null,"work_id":"6a1bd20b-f94e-421f-92c1-46177bebbefb","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.065642Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:943ec6281502fec093005ac8f22ef37e0c9ca0139db906e23d52659c59727d35","observation_id":"e4c6950a-b0d7-4f8e-8959-4fd3b769b366","resolution":{"observed_at":"2026-08-15T15:24:02.762703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.748761Z","title":"TangoFlux: Super fast and faithful text to audio generation with flow matching and CLAP-ranked preference optimiza- tion,","venue":null,"work_id":"48a1c774-d154-420b-b99d-e828352cab1f","year":2026},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.069203Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:566219712242bec7070c9e362d94359eb31a64a2144f675b3401e5ced4d90a27","observation_id":"62940b13-fcd5-4867-a1b9-826edd9bb296","resolution":{"observed_at":"2026-08-15T15:24:02.752569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18583","last_updated":"2024-06-05T17:53:26Z","snapshot_observed_at":"2026-08-16T13:45:47.270039Z","submitted_at":"2024-06-05T17:53:26Z","title":"Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18583","snapshot_observed_at":"2026-08-15T15:24:02.073129Z","title":"Lumina-Next: Making Lumina-T2X stronger and faster with Next-DiT,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.073129Z"},"links":{"cited_paper":"/paper/2406.18583","citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:e72b058895a0466b71c143ea4cf842e825d5ca7b7bf7409d2e99bdd214fbecd7","observation_id":"1b109280-b2bf-4a46-aa4c-c91ee12a81b9","resolution":{"observed_at":"2026-08-15T15:24:02.073129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.738569Z","title":"Diff-Foley: Synchronized video-to-audio synthesis with latent diffusion models,","venue":null,"work_id":"54f598a1-c74b-4ff5-bbb3-39fa6d24609c","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.077750Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:547db58156a9fdc34be28ccc50dc99fb9c7336e9404dca17b2cc1cbc71212a7d","observation_id":"279744d5-2d1c-4a33-9621-9be487734a91","resolution":{"observed_at":"2026-08-15T15:24:02.742324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.729368Z","title":"ThinkSound: Chain-of-thought reasoning in multimodal large language models for audio generation and editing,","venue":null,"work_id":"ffd77c97-55d4-4c89-9c05-b90af75656b7","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.081366Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:997bf0574504fa78458f668af2628cade03bdb9f8d6ff23b8f921a3d744c34a8","observation_id":"97d44d7f-6ce8-4345-b2c4-caad5f602e13","resolution":{"observed_at":"2026-08-15T15:24:02.732656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.18833","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.322322Z","title":"PrismAudio: Decomposed chain-of-thoughts and multi-dimensional rewards for video-to-audio generation,","venue":null,"work_id":"a8669ddb-5540-41da-9e9f-e00ad80c5b1a","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.085692Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:132ce0b6c78cfd59750c36aa5277a3cc4ee48beaeec3e1cc5704a303b2ec373b","observation_id":"c9e53704-3974-40fa-a0e1-db78960f1650","resolution":{"observed_at":"2026-08-15T15:24:02.330905Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.719524Z","title":"MMAudio: Taming multimodal joint training for high-quality video-to-audio synthesis,","venue":null,"work_id":"9e9e7559-0e2e-4b4e-bcff-cd8501d3771c","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.089916Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:222645bfe98ce6c6400133916b6fa1801a6885401d8e80de389df82e2d7d76ab","observation_id":"cbab2c8a-a111-4bba-9a0d-b96c03c0cb00","resolution":{"observed_at":"2026-08-15T15:24:02.723258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.708960Z","title":"ImmerseDiffusion: A gener- ative spatial audio latent diffusion model,","venue":null,"work_id":"bec8c401-b172-4222-abcc-30a081926d18","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.094333Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:59bdd85802da2c7f915598c3d1c809716a4ba9f25032328454a4b87cfc9f3d22","observation_id":"514cc056-7ee1-4803-8ec0-57339ee3af53","resolution":{"observed_at":"2026-08-15T15:24:02.713043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.698317Z","title":"Hearing anything anywhere,","venue":null,"work_id":"272edea6-497f-42cf-af7f-a595160e6cc6","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.098197Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:8a0273f467743c0911927a8f76beacbde113fdcb999e6b1aaba0f1efdae6b21d","observation_id":"e8cc0f82-6e83-4046-8c60-ebca2f20b0a5","resolution":{"observed_at":"2026-08-15T15:24:02.702013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.689884Z","title":"A V-RIR: Audio-visual room impulse response estimation,","venue":null,"work_id":"0ba38702-1433-478d-8404-04b8c2091998","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.101278Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:d1a2de4489c8e0e9e701e8dcab4fed323f4db143260f36cf0d70e80740be9710","observation_id":"22c95381-b859-49e7-9e70-fcd964367e11","resolution":{"observed_at":"2026-08-15T15:24:02.692719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.681192Z","title":"Learning neural acoustic fields,","venue":null,"work_id":"63361160-3259-4eaa-9d2c-381acba9fe29","year":2022},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.104753Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:f7127dca4023b1d196c2a4de35d318a1220c8a89c8f2d7953226212890d9b9bf","observation_id":"462bc503-17b8-4681-a81e-a33b1f7637c0","resolution":{"observed_at":"2026-08-15T15:24:02.684000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.672104Z","title":"Acoustic volume rendering for neural impulse response fields,","venue":null,"work_id":"cd498182-c206-46dc-ae26-3a0fca62ccf8","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.107777Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:71aacdb351164b98afc5dd8e1cfe11ae45fd2a4b1d7ca570f176a96c4c7973b5","observation_id":"ccbd1135-2aad-49ff-8c6a-e10a3299f257","resolution":{"observed_at":"2026-08-15T15:24:02.675718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.661090Z","title":"Novel-view acoustic synthesis,","venue":null,"work_id":"d0bbaeb6-183a-4873-aec4-720a8a7c14f5","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.111750Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:7d6d8b9e5fa56b1067cb4538f01aad05f8af0dd290719e0e026ba46660e8786f","observation_id":"12eafd4f-937c-4ae8-bc2c-0f8e45cb929b","resolution":{"observed_at":"2026-08-15T15:24:02.665371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.649227Z","title":"A V-NeRF: Learning neural fields for real-world audio-visual scene synthesis,","venue":null,"work_id":"4f8a1ba8-e098-40ec-851e-8da4e7496842","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.115597Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:b88694c724e44e5fbfac4e53d20ca593d4798ba44058704f2a41e9209e632056","observation_id":"237f65b3-5593-45ed-a549-bdbcef4080ce","resolution":{"observed_at":"2026-08-15T15:24:02.653714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.639098Z","title":"A V-GS: Learning material and geometry aware priors for novel view acoustic synthesis,","venue":null,"work_id":"39148c00-d6fb-4c42-8a5d-da74dadebf79","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.119478Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:b3d87d8e5d74eba6949dbb9838b6242e982476c8f5d3036047a19edb1ca40f4b","observation_id":"3f607afc-4075-4cad-baea-a6d6af4588a1","resolution":{"observed_at":"2026-08-15T15:24:02.642524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.628161Z","title":"NeRAF: 3D scene infused neural radiance and acoustic fields,","venue":null,"work_id":"656d7bec-55a0-43e4-9b50-196321f72090","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.123169Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:55fec9de3254c91792e2680fc5c3c02df36e7fbbc9223c8df9ec2c6b4c6f6ea1","observation_id":"0c9353e2-c4ee-41df-a075-82130f752cea","resolution":{"observed_at":"2026-08-15T15:24:02.631817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.617373Z","title":"Object-based audio reproduction and the audio scene description format,","venue":null,"work_id":"48259d32-f97c-4566-b8c9-133d8618e52a","year":2010},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.126874Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:cc2129f5c57d0c9e6dc80c9b5de948d1912ddef3d8235d9c9b25ee558467a269","observation_id":"653e1fb6-052b-42d2-9a8c-9b14e9d7af2a","resolution":{"observed_at":"2026-08-15T15:24:02.621151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.606834Z","title":"An audio-visual system for object- based audio: From recording to listening,","venue":null,"work_id":"33f27e12-e583-4795-91c8-40efd578663e","year":2018},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.130842Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:adaae03867b380c2cfd7a602fd1094b7ef9de3a0dddcfe81def1755a2961d00f","observation_id":"7fc65e56-3260-4e63-8770-312115300c01","resolution":{"observed_at":"2026-08-15T15:24:02.610454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.597066Z","title":"Segment any 3D gaussians,","venue":null,"work_id":"cd80facb-54ac-4442-8986-37c48dcca10f","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.134631Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:91ed5f47c0cd96e0fb62dc026e75216f9a83ee108b2e5892d8e6eb549b41069c","observation_id":"7f2f1b9e-defe-4bf8-8092-969d18f37621","resolution":{"observed_at":"2026-08-15T15:24:02.600513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.587192Z","title":"OpenSplat3D: Open-vocabulary 3D instance segmentation using gaussian splatting,","venue":null,"work_id":"962206eb-8bf2-4600-92c5-021046244084","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.140017Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:8520f8e62e199c9e1bed8d96c50c14259844e06058cdd65f7c447727084d00f7","observation_id":"dde620a4-aad5-4039-8f94-619520a0dae5","resolution":{"observed_at":"2026-08-15T15:24:02.590900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.576874Z","title":"Object-aware gaussian splatting for robotic manipulation,","venue":null,"work_id":"5549eec1-b460-4a67-9f92-d0619c71c142","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.143982Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:68beb10c43e5b41769a31f2db41f2aa2ec7a6a93712def282c9028c07490414d","observation_id":"d385a473-8fb5-4174-a8b8-45b1a0419737","resolution":{"observed_at":"2026-08-15T15:24:02.580652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.566852Z","title":"GaussianCut: Interactive segmentation via graph cut for 3D gaussian splatting,","venue":null,"work_id":"c8ddf747-971e-48ba-9018-8a3bb4f36cff","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.147761Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:cd1a8487b459a3eebf328054a222c6b2831c54fe339aca129f33157c6231550f","observation_id":"e1b7d7dc-5312-4fed-af51-cb8a0b0e3e22","resolution":{"observed_at":"2026-08-15T15:24:02.570539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.556627Z","title":"Training-free hierarchical scene understanding for gaussian splatting with superpoint graphs,","venue":null,"work_id":"f612b993-6ea8-4ed6-b070-2db0260877be","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.151793Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:ea676847c542ded2dbd43148879a2df9f6b393f0ed48e528033a4fbe41aeb1ab","observation_id":"c176cd30-f758-462c-9e00-27949925ee73","resolution":{"observed_at":"2026-08-15T15:24:02.560284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.546480Z","title":"Lifting by gaussians: A simple, fast and flexible method for 3D instance segmentation,","venue":null,"work_id":"0c2070d8-41f6-44aa-a404-494346528562","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.155424Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:69a2390e666795170a4b535b2e09a648649c5794a22c50e6ef4404301d4cefbb","observation_id":"77acb656-2ac9-490b-9fde-76944481462e","resolution":{"observed_at":"2026-08-15T15:24:02.550110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.535898Z","title":"DCSEG: Decoupled 3D open-set segmentation using gaussian splatting,","venue":null,"work_id":"57031e64-e719-4c18-88a0-e96f3616ef39","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.158916Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:b2aa1033f5cc6c82c0dd212c55d15abc69c0d8ded9f1491d043af8fed1f24186","observation_id":"706d0da3-00d2-44a5-9755-7e2cd9f5ee6a","resolution":{"observed_at":"2026-08-15T15:24:02.539773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.525228Z","title":"Exploring CLIP for assessing the look and feel of images,","venue":null,"work_id":"6f92c181-315f-4f99-a7e4-01a4f0346bc5","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.162404Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:a33bafce4374e959d9344e01854323c43f9fc50310228326cb0487a12c33b787","observation_id":"0aa08d1f-2670-4c8f-9e27-2ba7d2fef225","resolution":{"observed_at":"2026-08-15T15:24:02.528737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.514261Z","title":"gsplat: An open-source library for gaussian splatting,","venue":null,"work_id":"ca13d1db-2035-40e6-8a8d-262e0d45fe8b","year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.166026Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:ee33baca57125746f10965c47d0f7c4cc6e644035a100034fd3310bfe7cd32cd","observation_id":"e6773ef4-9adc-45f6-8436-09bd0eebaa5c","resolution":{"observed_at":"2026-08-15T15:24:02.518133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.503423Z","title":"Fr ´echet audio distance: A reference-free metric for evaluating music enhancement algorithms,","venue":null,"work_id":"6208b113-9952-4b34-8ecc-f4a8199bbfc6","year":2019},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.169658Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:efc40741614d024c2407ab076a9ff64d8d1c3922ce531e3952e0d7dcebc6cc5d","observation_id":"7405f0ae-ab6b-4829-8abc-f5c0289ee838","resolution":{"observed_at":"2026-08-15T15:24:02.507490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.489849Z","title":"PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,","venue":null,"work_id":"ffce0da7-5947-4592-951c-ac6a4b83cae7","year":2020},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.173182Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:a39c4571b8c846e6c88a79f3e0beab64f659123e3a6ff68c51bdaa7ba1bcdda7","observation_id":"e1390ee1-49af-4923-98b6-dae3549c2372","resolution":{"observed_at":"2026-08-15T15:24:02.496172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.479587Z","title":"Correlation of Fr ´echet audio distance with human perception of environmental audio is embedding dependent,","venue":null,"work_id":"b6d6f74c-3842-4dd4-b3f7-fecc5d0531ac","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.176633Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:fddc9053919900ab3b48c808899f25bdc0bbba348b5db20797fed0f3aaecab58","observation_id":"fb317093-1dd0-4249-a05a-5f941923e833","resolution":{"observed_at":"2026-08-15T15:24:02.483230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08587","last_updated":"2025-01-15T05:15:54Z","snapshot_observed_at":"2026-08-16T14:30:18.233558Z","submitted_at":"2025-01-15T05:15:54Z","title":"Sound Scene Synthesis at the DCASE 2024 Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08587","snapshot_observed_at":"2026-08-15T15:24:02.180525Z","title":"Sound scene synthesis at the DCASE 2024 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.180525Z"},"links":{"cited_paper":"/paper/2501.08587","citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:56e6faa4e0676db6dd4a113eacece7e8b3e1f5d596aa4c84ae03b5f5550c15a0","observation_id":"58a07c9c-cbe5-4c96-96df-705333699a58","resolution":{"observed_at":"2026-08-15T15:24:02.180525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.184402Z","title":"Clotho: An audio captioning dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.184402Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:2a88bfb909ad467a7e760139c1d9f996df1ac9bbf69d35176d4c2660b9f9249e","observation_id":"b58763fc-a9ee-45ec-a287-4cdc9f8d7bd2","resolution":{"observed_at":"2026-08-15T15:24:02.184402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.462780Z","title":"ImageBind: One embedding space to bind them all,","venue":null,"work_id":"49ccfe1a-9542-4e19-bbb4-cd94598dc0ed","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.187846Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:0dff43b34e4b0fff14e2db30acdf29852f08f7fcb715d7fb5547f8295ee4b5a3","observation_id":"5924b400-9ea6-4bcb-9377-472a91cb46c7","resolution":{"observed_at":"2026-08-15T15:24:02.466587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.452000Z","title":"Large-scale contrastive language-audio pretrain- ing with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":"daf61e42-8027-4499-b00b-8ab5676294e7","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.191632Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:b0e1062d959797065c5c6791e1cf9f5660a43d96004dc159cf426e6121e8dd21","observation_id":"43c67b10-bef8-4086-a518-9ef082d20e5c","resolution":{"observed_at":"2026-08-15T15:24:02.455720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.441207Z","title":"Tango 2: Aligning diffusion-based text-to-audio generations through direct preference optimization,","venue":null,"work_id":"f562d698-c120-4f9a-a777-73a26cd0e6c3","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.195272Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:265a9bd19c4c9c86b08957328b11fe070d6fc74999375e772043f3febfea7a80","observation_id":"e77db0bf-9977-4db9-8382-b81d0c8689bd","resolution":{"observed_at":"2026-08-15T15:24:02.445113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.430489Z","title":"Seeing and hearing: Open-domain visual-audio generation with diffusion latent aligners,","venue":null,"work_id":"a74ac69f-7ad8-4324-8a70-60b651b2e453","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.199094Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:f5256c730dd66d95bccaf4d0520e15be87f935b1a71a80704a96b2801ec1ff7a","observation_id":"5999a93b-152a-4a7b-aacc-0d24e15e3d12","resolution":{"observed_at":"2026-08-15T15:24:02.434225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.419578Z","title":"I hear your true colors: Image guided audio generation,","venue":null,"work_id":"6b939050-1383-44dd-b71b-91e0aa0a9cb1","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.202898Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:baebb107b4caed55c9b4dd55c9270a4a3495d92860b4d45816aa8164cee62d20","observation_id":"349514ba-6c80-4e4c-9e94-324e083f45ca","resolution":{"observed_at":"2026-08-15T15:24:02.423349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.206764Z","title":"ViSAGe: Video-to-spatial audio generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.206764Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:9962c112d208d36f5f5e7b27c2f8b12246e8e873d6304bc1a45f4cd456bca40a","observation_id":"898af29a-117b-415e-b42e-38a9552f887b","resolution":{"observed_at":"2026-08-15T15:24:02.206764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.402602Z","title":"D-SA V360: A dataset of gaze scanpaths on 360° ambisonic videos,","venue":null,"work_id":"d1dde298-b9e0-4a4e-bb55-bad23e3bba09","year":2023},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.210742Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:3a3cda8618d2aade1bacd2c9727b856c47f0ba98dd4089cf29c6dc2435b5095e","observation_id":"26bf96cf-0290-4010-99bc-6dc06690f588","resolution":{"observed_at":"2026-08-15T15:24:02.406354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.391873Z","title":"Real acoustic fields: An audio-visual room acoustics dataset and benchmark,","venue":null,"work_id":"4db86e42-d839-4e72-8182-5cecf2d6afde","year":2024},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.214620Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:689fdf5d5639122f470ea78a8c8985fdf533284b0433c2c3b51d6a1951ef7449","observation_id":"d9c47506-e9db-4e73-b474-82e24937524f","resolution":{"observed_at":"2026-08-15T15:24:02.395713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:24:02.381193Z","title":"FLUX.2 [klein] 9B,","venue":null,"work_id":"71162514-2f84-4ddd-b34b-3f65f870a5f1","year":2026},"citing_paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T15:24:02.218099Z"},"links":{"citing_paper":"/paper/2608.00463"},"observation_digest":"sha256:91c902fc8ac2d7adeca5de96cc148284b967588f8206e682abf4af6faa4a69c5","observation_id":"415686ca-63b2-4c82-a395-2c7206a76332","resolution":{"observed_at":"2026-08-15T15:24:02.384779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00463","last_updated":"2026-08-01T06:04:34Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T03:26:38.607043Z","submitted_at":"2026-08-01T06:04:34Z","title":"Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":53},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.00463."}