{"as_of":"2026-08-16T14:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c1a3ec7055cf31151880f59330cdf53b64d01d115d42b60ea05427e38f67d37","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:01:59.885793Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.06752/citation-record","integrity":"/paper/1908.06752/integrity","json":"/paper/1908.06752/citation-record.json","paper":"/paper/1908.06752"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:01.169461Z","title":"RICOH THETA,","venue":null,"work_id":"ab368244-f0f0-4185-a72f-68eeb2e55b3b","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.694060Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:f30cb0f4585abe6f9a7cf72e2eddb3c7bc14773670353d528689a8e820b300c3","observation_id":"d2d915fd-4dcf-4db0-8d16-ab4089b83bcc","resolution":{"observed_at":"2026-08-14T13:02:01.195878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:01.120717Z","title":"Samsung Gear 360,","venue":null,"work_id":"753beeb4-3975-48b0-b0d1-a0db69d856ba","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.705702Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:4712974d7c1350d86ff2becdd8af37fb743061836f42c35d882145938f17e32b","observation_id":"c38f0dc7-6871-4fb2-85d8-eb5417abb0cf","resolution":{"observed_at":"2026-08-14T13:02:01.141620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:01.003642Z","title":"Director’s cut - analysis of aspects of interactive storytelling for vr ﬁlms,","venue":null,"work_id":"8e9e2a2f-2b74-4ce1-b362-801b50e73e29","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.711319Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:c17e0cc6f269af30022ef3db18ea8e3a68fffd9a83bcf0c5af5b8e74734f3bb9","observation_id":"e0aadbae-6f55-42c8-a477-9da72a24ed44","resolution":{"observed_at":"2026-08-14T13:02:01.030356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.969772Z","title":"Director’s cut - a combined dataset for visual attention analysis in cinematic vr content,","venue":null,"work_id":"46462be1-2264-40fd-abac-2b99f8018b97","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.718471Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:eabf89c112e70afe1b2c3fc0aaf7f934956a52084ee2bdd5ba7b4317cd6a9efc","observation_id":"4e20532e-8749-44c3-b80a-6074414e796d","resolution":{"observed_at":"2026-08-14T13:02:00.983269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.933156Z","title":"Visual attention in omnidirectional video for virtual reality applications,","venue":null,"work_id":"8e36ff9f-680e-4c34-8239-1fc07c1afab9","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.730704Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:93492ae929911cc7cf83c57c828260e8737226019f01d96a26b7e87e3a670b53","observation_id":"95f4b6c7-816f-4bbc-a98b-f2f965d53ee1","resolution":{"observed_at":"2026-08-14T13:02:00.940574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.907033Z","title":"Beckett in vr: Exploring narrative using free viewpoint video,","venue":null,"work_id":"150fea80-6126-4352-b96d-09d06fd19dc2","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.745765Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:eee9a2eabbd4e7d4a2147f88cea433bdc17ee55cd3c393c51cd2164573892d55","observation_id":"28395487-24e7-4c02-98e9-e4d22389091c","resolution":{"observed_at":"2026-08-14T13:02:00.912676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.883736Z","title":"Saliency in vr: How do people explore virtual environments?,","venue":null,"work_id":"e6920786-7619-4650-88d0-bd9793b08fca","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.758569Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:3000f327af500d19c11f554d4926a8a9db0d3a944ad667fb77afa084fe338eb7","observation_id":"447b0405-44db-4587-9dbb-475c8a93ad65","resolution":{"observed_at":"2026-08-14T13:02:00.894884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.853897Z","title":"Producing 3d audio in ambison- ics,","venue":null,"work_id":"22969341-2b33-4b50-a646-994956db4691","year":2015},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.769792Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:a0878a5f4c3e327a3d5922e5760d1dfdcb9f8f5171ed3b66d5e918071690befa","observation_id":"caa1f1b1-cf7d-409e-8b03-a811c5d54e49","resolution":{"observed_at":"2026-08-14T13:02:00.861141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.824573Z","title":"Sound localisation for 3d multimedia streaming,","venue":null,"work_id":"beade40d-0b89-4467-b887-19d39e43d682","year":2015},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.783385Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:4e0a22e9a60c74e013806e4f90eb63e7ccdb347d5c2cc9e918ff625078037b7e","observation_id":"ec52201f-f436-4165-a52d-7761b9130236","resolution":{"observed_at":"2026-08-14T13:02:00.833057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.680026Z","title":"Comparing ambisonic microphones [blog],","venue":null,"work_id":"5b0bef17-f68e-4e05-aac4-7714fe365f11","year":2017},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.795324Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:fe3bba90753e0a74c3c31574d9ac494dd9750506536931dfa3a62c0861ea075e","observation_id":"07f9d915-a28b-4b9e-b425-6fcd0ef9f64d","resolution":{"observed_at":"2026-08-14T13:02:00.685364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.633549Z","title":"Ambisonics in multichannel broadcasting and video,","venue":null,"work_id":"554ca8a0-9d08-472f-b3a7-42310f5b8384","year":1985},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.801826Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:e33e2660b1f80a8594965d8909c5bd4ec2d25df8100cbf8eb998ecced84e5bbe","observation_id":"6e906cb0-3b23-4b8d-ae57-5358fb191ebf","resolution":{"observed_at":"2026-08-14T13:02:00.640616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.603774Z","title":"Audio-visual scene analysis with self- supervised multisensory features,","venue":null,"work_id":"ce28c3a7-a48b-45ff-8655-be38c32bfe89","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.808968Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:3034c10337d550ee08d3ebdcbd63859ca9af29b1499c56df28a9c8e456d6d0d2","observation_id":"9778c851-d254-401b-9c8d-0fcde5351a5b","resolution":{"observed_at":"2026-08-14T13:02:00.610396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.579010Z","title":"Audio- visual event localization in unconstrained videos,","venue":null,"work_id":"6ee86e70-6695-4a82-b281-c54b8dc1b53c","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.816676Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:49f009bf92c289f5fe75ca4896d44cd41f586807e2606aff297323ea92fb7fd4","observation_id":"d115461a-9c1f-480e-a82e-d696b9b94f42","resolution":{"observed_at":"2026-08-14T13:02:00.586331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.505773Z","title":"Looking to listen at the cocktail party: A speaker-independent audio-visual model for speech separation,","venue":null,"work_id":"465b1200-636a-41fc-b6dc-6052a65e0a21","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.823684Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:4c21d16f1451e45ca78a2a13cc0769454213829a59ccec624a0cf7fb332b64f0","observation_id":"0bd3e8c8-de23-4a81-9c5e-5357e8f8a8e9","resolution":{"observed_at":"2026-08-14T13:02:00.524529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.429926Z","title":"Predicting audio-visual salient events based on vi- sual, audio and text modalities for movie summarization,","venue":null,"work_id":"86de3579-9b11-4e70-8c62-c8f01cb0800d","year":2015},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.830531Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:0aa276f3b0309d330e5a92439fa843566f0603c0968d03b4641ba39b62136ddc","observation_id":"c371e1b9-8012-48de-9a8a-75d404b5e386","resolution":{"observed_at":"2026-08-14T13:02:00.453573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.378016Z","title":"An Audio-Visual system for Object-Based audio: From recording to listen- ing,","venue":null,"work_id":"9e622b60-e79c-4f40-806a-f56f8027afbd","year":1919},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.836615Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:5eb642513d5a87d250a20fd122090270fceb9e5ca3953f61106d880537f7ba6d","observation_id":"0a3a32a2-17ab-43ad-b7d1-07ffdb7e8870","resolution":{"observed_at":"2026-08-14T13:02:00.400537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.299122Z","title":"Multichannel speech separation with recurrent neural networks from high-order ambisonics recordings,","venue":null,"work_id":"7fcacc50-b1ab-4787-a83b-b2fedd0fff5e","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.842850Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:e30c4064c79d748d6291e8dc28dce677350d9fd71f7e6019c1516145f657a5e3","observation_id":"18bbd345-d6a6-4301-85ea-19a40a01fcb9","resolution":{"observed_at":"2026-08-14T13:02:00.332447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.216139Z","title":"Feature Learning for the Image Retrieval Task,","venue":null,"work_id":"972c6e17-ec54-47a9-ac5b-05a2cd11d827","year":2014},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.847983Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:940b08f44cb8e4a393da33a31d80f55f0e943bb96948a108d6561aff6c6abfb3","observation_id":"d8357806-2e20-46e5-bd23-1982f6752a96","resolution":{"observed_at":"2026-08-14T13:02:00.234947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.151393Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":"81d77959-21ae-4fc9-b7bc-715a96273b66","year":2015},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.855184Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:5ec714abac4238be3372fa7a7acc11d1b94a6d78a6a8831821462909ad0defba","observation_id":"aa58c426-af63-42aa-9a73-f3b83f79c5c9","resolution":{"observed_at":"2026-08-14T13:02:00.161194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.09430","last_updated":"2017-01-10T18:06:51Z","snapshot_observed_at":"2026-08-14T21:37:30.204671Z","submitted_at":"2016-09-29T17:04:50Z","title":"CNN Architectures for Large-Scale Audio Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.09430","snapshot_observed_at":"2026-08-14T13:01:59.861596Z","title":"CNN architectures for large-scale audio classiﬁcation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.861596Z"},"links":{"cited_paper":"/paper/1609.09430","citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:282250fc48f3fcdfa9be40c8b7dd54ea2a57b1c551f77cba3b8615e1266049d3","observation_id":"937f03d2-34bd-43fc-a3a8-39ff18a0fae7","resolution":{"observed_at":"2026-08-14T13:01:59.861596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.115385Z","title":"Imagenet large scale visual recognition challenge,","venue":null,"work_id":"b658be16-f959-4b6f-b8be-9940d21623f1","year":2015},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.867879Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:17f8517c201aae82b82b3ef662bd0f2ad84a3e322bf5bba41d4bad04baa39fc3","observation_id":"2c0df29c-7dfa-490a-a699-e9fc95dfe1cb","resolution":{"observed_at":"2026-08-14T13:02:00.129878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.054226Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"a9f5a518-0b33-4834-ae56-5bf1a47d6f4d","year":2017},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.873816Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:f39b89503bc35c5badc33927e8b9ed419b5a6b5d4cdb7af732ba1580517a0219","observation_id":"fcf7e0fd-ca2c-43d5-bdcf-c0d63f993c1b","resolution":{"observed_at":"2026-08-14T13:02:00.097594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:02:00.026281Z","title":"The Facebook 360 Spatial Workstation,","venue":null,"work_id":"3c0fc065-b3f5-4d94-beb9-d55bedce3acd","year":2018},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.880082Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:8b139ae1efd055069d5bb90f3b398b9ec1c8eb5f5a7caf079c39eccbb47b0211","observation_id":"34125c2c-3830-4db9-9b4c-2dbf9f7d8dc3","resolution":{"observed_at":"2026-08-14T13:02:00.033199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:01:59.993601Z","title":"Experimenting with multimedia advances using GPAC,","venue":null,"work_id":"b9df7879-9c78-4c89-9a55-a1a5de4a6f47","year":2011},"citing_paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T13:01:59.885793Z"},"links":{"citing_paper":"/paper/1908.06752"},"observation_digest":"sha256:8cf243d7cafbe62c208540ce907465895b942bf1fd8e97283f6e7c6564d28c30","observation_id":"d987fd7b-d798-4966-9e51-6dfe5041aeeb","resolution":{"observed_at":"2026-08-14T13:02:00.006438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.06752","last_updated":"2019-08-16T14:49:30Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T12:56:17.200462Z","submitted_at":"2019-08-16T14:49:30Z","title":"Towards Generating Ambisonics Using Audio-Visual Cue for Virtual Reality"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:1908.06752."}