Pith. sign in

Paper Citation Record · LEDGER

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator

As of 23 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2504.18283.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2504.18283 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T10:26:24.304992Z

measured 41 of 41 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

41 of 41 outbound references displayed

  • verified exact1
  • verified fuzzy25
  • unresolved14
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation bc21fbec-6b01-44d3-be32-959c5c05777f · outbound

This paper cites SonicDiffusion: Audio-Driven Image Generation and Editing with Pretrained Diffusion Models.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator SonicDiffusion: Audio-Driven Image Generation and Editing with Pretrained Diffusion Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.017319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.017319Z digest=sha256:7c452928657925c4bfe3393af69622779a2413fab4abdc1d0d6ea64a2f5147a0

Observation ecf14d85-1541-4990-aba2-807c9435e3d6 · outbound

This paper cites Large Scale GAN Training for High Fidelity Natural Image Synthesis.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Large Scale GAN Training for High Fidelity Natural Image Synthesis

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.023227Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.023227Z digest=sha256:6f07ad0ef0510e208d8e5240f58ae596254127d484133ea918d1fb4036b4be4d

Observation f5854aee-204d-4d21-9f25-0414d5cf47e5 · outbound

This paper cites Instance- conditioned gan.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Instance- conditioned gan

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.926228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.027939Z digest=sha256:407a57247fb84261373ed8e33de1001747fed7a9434ef9ec64127bcdae7d4d22

Observation c0408464-2537-48ee-8351-d453a6e1bbe9 · outbound

This paper cites Chatterjee and A.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Chatterjee and A

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.912073Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.032500Z digest=sha256:f783c8a6a0ccc9c7da75d109e79d9aa071e215ecee577a0fe67e00437ee8ca3b

Observation 2060a7cd-45c8-4824-b31a-a4f7603ea2c5 · outbound

This paper cites Learning audio-visual dynamics using scene graphs for au- dio source separation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Learning audio-visual dynamics using scene graphs for au- dio source separation

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.898062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.037370Z digest=sha256:4ff512ad5c1c10eef869152b3ae2cce7752ba629bbc5b85b5e1a154b32d0c124

Observation be0de70e-d633-40cc-8498-d13fd75ebcaf · outbound

This paper cites Vggsound: A large-scale audio-visual dataset.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Vggsound: A large-scale audio-visual dataset

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.883128Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.041920Z digest=sha256:a79aa05b7476d41e8dec2bad56166fe03e99708e415ed49c5e7bc27c27b3fa58

Observation 704b828e-f3ae-42f7-8b07-3f6bdd0ae1d5 · outbound

This paper cites iquery: Instruments as queries for audio-visual sound separation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator iquery: Instruments as queries for audio-visual sound separation

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.868260Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.046970Z digest=sha256:b91cc4fd5176b31ab8fe58bd24296ae5ea139d862e6505ec6204e7e8f840c7f7

Observation 727ada9c-f048-4e6f-be3d-92216ccaa392 · outbound

This paper cites Deep cross-modal audio-visual generation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Deep cross-modal audio-visual generation

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.852993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.051337Z digest=sha256:addb45369e9637fd4b6087a5005a8c0cf1240b9691458c001d8b3698e5b2ddd1

Observation ec8de647-16ab-4574-9dae-fb878876d0fa · outbound

This paper cites Filter-recovery network for multi-speaker audio- visual speech separation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Filter-recovery network for multi-speaker audio- visual speech separation

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.838665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.055805Z digest=sha256:f41355cf688e1bed713dd99df05794f826f1003007c7ab70f2d5a135a3f54906

Observation 782db89a-8ebb-44d7-a75a-cb5c5670d26a · outbound

This paper cites Yolo-world: Real-time open- vocabulary object detection.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Yolo-world: Real-time open- vocabulary object detection

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.824684Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.060136Z digest=sha256:5433e7936e18ab09bd26ee33e51576d87414a8794e078f4fa24ed554e80f2e14

Observation e8ef29eb-372f-4439-92b1-99afc54afd4d · outbound

This paper cites Jha, Teddy Koker, Luca Di Liello, Daniel Stancl, Changsheng Quan, Maxim Grechkin, and William Falcon.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Jha, Teddy Koker, Luca Di Liello, Daniel Stancl, Changsheng Quan, Maxim Grechkin, and William Falcon

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.810383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.064522Z digest=sha256:3435f3d323b0f4b014961ab8ec7bac07357a4d99a8d8706a108c1ac5d9e6d438

Observation df29c25e-1074-49b5-a4cb-592a1eee5879 · outbound

This paper cites an unresolved cited work.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-16T10:26:24.795653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.068932Z digest=sha256:db67d3518fef3cca260fe704563baed72ead57e5a4224b8525a54811ac541a80

Observation 58435090-7873-4152-8a09-81a155b05784 · outbound

This paper cites Sound-to-Imagination: An Exploratory Study on Unsupervised Crossmodal Translation Using Diverse Audiovisual Data.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Sound-to-Imagination: An Exploratory Study on Unsupervised Crossmodal Translation Using Diverse Audiovisual Data

Reference 13

Resolution
metadata mismatch
local_arxiv, observed 2026-08-16T10:26:24.455257Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.073331Z digest=sha256:ce1fd409d698b372464cdf8fc970114e43743b9f3e0879956db322cd87bc5aa4

Observation dc3310f9-8794-4549-b949-69ef54bf92d3 · outbound

This paper cites Generative adversarial nets.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Generative adversarial nets

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.077677Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.077677Z digest=sha256:1e621964960cdf1745545c0d45b6bc9399c701bdb72d910bd2d577605a86e487

Observation c0a51a7a-e709-4692-82e6-b3a90a68c303 · outbound

This paper cites CMCGAN: A Uniform Framework for Cross-Modal Visual-Audio Mutual Generation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator CMCGAN: A Uniform Framework for Cross-Modal Visual-Audio Mutual Generation

Reference 15

Resolution
verified exact
local_arxiv, observed 2026-08-16T10:26:24.434368Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.081745Z digest=sha256:7ebc7a2a14519b1a6584af652c8523aa50e4fba41ff03228cad3280eb670044f

Observation c6821b2f-a0e3-446d-b54a-ecac4050660d · outbound

This paper cites Zhang, Shaoqing Ren, and Jian Sun.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Zhang, Shaoqing Ren, and Jian Sun

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.771448Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.086249Z digest=sha256:2ef8560a0a4ad5c7c8e81e41bb4246a8b14d3df06e7ffe9a5d7507b290dd6695

Observation 148d7fa7-f851-4afd-b670-f12b35ec57bb · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilib- rium.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Gans trained by a two time-scale update rule converge to a local nash equilib- rium

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.090490Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.090490Z digest=sha256:78570c115757027bd114de679ba6b6c24f1d00e6a4b9ed5e572b250d067a011f

Observation 6237d19e-d9a0-4cec-af78-6099d1217ef1 · outbound

This paper cites Denoising dif- fusion probabilistic models.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Denoising dif- fusion probabilistic models

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.748123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.094842Z digest=sha256:baee09fd985d0fbe346c20b013d57a09796c6f8808be1cfaf50a421e93e3e0d2

Observation fa104f01-d528-4202-b440-6090c24d74d8 · outbound

This paper cites Ultralyt- ics yolo.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Ultralyt- ics yolo

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.733269Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.098966Z digest=sha256:b52bba11895e9e7e9281529b908d50b048717378b359a05fe7acc040f6d6a320

Observation f096559b-c155-4041-a315-af193c1bce61 · outbound

This paper cites Sound to visual scene generation by audio-to-visual latent alignment.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Sound to visual scene generation by audio-to-visual latent alignment

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.719015Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.103273Z digest=sha256:e8fbc6114dea1af72829d6a04ecaea1b2b78f70997e70ee4f36cf3894632031b

Observation f4f63d3d-6fd0-4207-b5e7-f59a97c32549 · outbound

This paper cites Kingma and Jimmy Ba.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Kingma and Jimmy Ba

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.704205Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.107934Z digest=sha256:74fb5b54b22696299436a764cd2cbda52b53f85cde5d569bcd0e23478fef6c63

Observation 691dfd59-e469-42e2-8b30-1470a63998f1 · outbound

This paper cites King’s computational research, en- gineering and technology environment (create), 2022.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator King’s computational research, en- gineering and technology environment (create), 2022

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.689563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.112013Z digest=sha256:b4b9f6f9b20560b38acff8e3211c3c053f225f56abb8a26b596a0851508965d4

Observation 629946b5-7bde-45d8-9362-ac6fa9096d91 · outbound

This paper cites Montesinos, Venkatesh S.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Montesinos, Venkatesh S

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.674700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.116113Z digest=sha256:8be12b96a26a1a14e34c63fd8b27a2caaedc61effc395385f0ed91b66194b4ac

Observation 01920d7e-6c56-460a-9f81-ac9dfc6527c9 · outbound

This paper cites Narasimhan, S.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Narasimhan, S

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.660361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.120180Z digest=sha256:a382f0e60389c0104934a6d5bbed1aee5633be5d8043aa36af74ff34e6eb2218

Observation 24ab208b-b48f-40fd-a270-23a41d528195 · outbound

This paper cites Freeman, Michael Rubinstein, and Wojciech Ma- tusik.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Freeman, Michael Rubinstein, and Wojciech Ma- tusik

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.644555Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.124356Z digest=sha256:1e99caac6963631468e429348ae643c467620ecbdee3cf3540242a0ff5abfeaa

Observation ceaf72b0-092e-4615-bc96-85a5c3980730 · outbound

This paper cites Estimating Visual Information From Audio Through Manifold Learning.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Estimating Visual Information From Audio Through Manifold Learning

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.128495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.128495Z digest=sha256:7e3e90f5068cc9bf656e55a123dce21d75d786d0583ef52106d10ffbf7eb80d8

Observation c8083618-4ce6-4009-87ad-9a530cc9ade4 · outbound

This paper cites Image generation associ- ated with music data.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Image generation associ- ated with music data

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.629380Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.132917Z digest=sha256:15c38469124c7bfea8e12f68aaf4e2ff7497f3ede07a4cc075b295f6c9dcf48f

Observation 98805cc5-96a7-4ec5-9964-f6f8b130d6e6 · outbound

This paper cites Learn- ing transferable visual models from natural language super- vision.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Learn- ing transferable visual models from natural language super- vision

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.614543Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.137106Z digest=sha256:cc4a12b6d0412ed30de221dad6c6e5f8121e915604863d4159ac5ff6dabb5088

Observation 75ee66d8-d39d-41f1-995a-1c01f36db187 · outbound

This paper cites Zero-shot text-to-image generation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Zero-shot text-to-image generation

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.599224Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.251543Z digest=sha256:6ab700efab73bbb141e40f4232e11785533eb5e6d880666913f8a10e43c997e2

Observation 8f8008ff-f97a-4bf1-907f-c144b471fa5c · outbound

This paper cites Hierarchical Text-Conditional Image Generation with CLIP Latents.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Hierarchical Text-Conditional Image Generation with CLIP Latents

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.256533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.256533Z digest=sha256:983fdfa43d6ec4ff9def9fb9c5af02528e68db5f891b291a868ee638738898e1

Observation 43966105-013a-4814-82a3-ef83866748a8 · outbound

This paper cites High-Resolution Image Synthesis with Latent Diffusion Models.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator High-Resolution Image Synthesis with Latent Diffusion Models

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.260999Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.260999Z digest=sha256:264a73fba81eb5021a08c47773c0e164c5d0f55facdbc6847702fee3dbd60faa

Observation d6229f17-8dfa-4d4a-bae8-4e695f96cc97 · outbound

This paper cites Improved Techniques for Training GANs.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Improved Techniques for Training GANs

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.265861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.265861Z digest=sha256:145287eb3769d4228ff0e5fbaefaf31ef137d6664d50d72d0fbde425a295d88f

Observation 1d1b9d2a-96e2-4b1f-87f7-ae0bff6433e6 · outbound

This paper cites S2i- bird: Sound-to-image generation of bird species using gen- erative adversarial networks.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator S2i- bird: Sound-to-image generation of bird species using gen- erative adversarial networks

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.584546Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.270255Z digest=sha256:f95f48108bbd2df217dcc6ebe18a8d47d0888f803b38e968b36ea2e97ddf2e4a

Observation 721e6166-0b31-4e03-b74d-b690a91d6a42 · outbound

This paper cites Deep unsupervised learning using nonequilibrium thermodynamics.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Deep unsupervised learning using nonequilibrium thermodynamics

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.274378Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.274378Z digest=sha256:d8105d2feb9928a3fbf205ce270610bf8de22e33ff23e08714df6991d1f27ef3

Observation cb969ff3-506b-48f2-bca1-e97d76c91eb0 · outbound

This paper cites Denois- ing diffusion implicit models.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Denois- ing diffusion implicit models

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.559804Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.278811Z digest=sha256:d3b5047ef0a08d39ccedfdc09f535d4dba51bd02ce0997e4c68822d544d9bf93

Observation a765976c-a214-4e89-8566-8f8c0b1f04c0 · outbound

This paper cites Rethinking the in- ception architecture for computer vision.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Rethinking the in- ception architecture for computer vision

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.544778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.283039Z digest=sha256:d6948b74e9f414fb79748b594194dbe260e991be93099739fa14614561f53af8

Observation e53f6702-f575-4170-9ea1-d187a0e611ef · outbound

This paper cites an unresolved cited work.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-16T10:26:24.529347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.287745Z digest=sha256:243d256f0bfafebb6eba006da526b8f1dc29de7584d252c6dc2717c6e2e777af

Observation 5b2f8800-ef3b-4af5-a372-4f24d16f9a76 · outbound

This paper cites an unresolved cited work.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-16T10:26:24.513614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.291806Z digest=sha256:26e42c6001be91b43c44937b7605293af2bc421b2f0dc472bd74ceec8087d269

Observation d0577edc-5976-4d4b-8293-e948ebc01d82 · outbound

This paper cites To- wards audio to scene image synthesis using generative adver- sarial network.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator To- wards audio to scene image synthesis using generative adver- sarial network

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T10:26:24.498791Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T10:26:24.296227Z digest=sha256:3e9a3b3c3d6c9e98e117b083267a0896e8c0abab4b64d4ab5de784ee9f67a9bd

Observation 71079888-b18f-47bf-8731-e62b8bedf847 · outbound

This paper cites Visual Echoes: A Simple Unified Transformer for Audio-Visual Generation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator Visual Echoes: A Simple Unified Transformer for Audio-Visual Generation

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.300525Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.300525Z digest=sha256:d56b0a8934021121117b0a4d715b7e3cf1e876a4579e29080538214ab5851411

Observation a3a3c73f-2ed8-4e4f-8fbe-21e653122f19 · outbound

This paper cites AudioToken: Adaptation of Text-Conditioned Diffusion Models for Audio-to-Image Generation.

Seeing Soundscapes: Audio-Visual Generation and Separation from Soundscapes Using Audio-Visual Separator AudioToken: Adaptation of Text-Conditioned Diffusion Models for Audio-to-Image Generation

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-16T10:26:24.304992Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:26:24.304992Z digest=sha256:814d1d17e998e3f3f6b79dcfbdcac9a4e7b9596aec0b9764e43645517095cf01

Pith citing papers

No inbound Pith citation observations are available.