{"as_of":"2026-08-08T18:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fab2c56f416066ce26de88f86ed093a62746525509dcee1d6b6c96f4bbd0e55e","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:47:16.214424Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:47:14.238419Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.18658","snapshot_observed_at":"2026-08-01T14:47:14.238419Z","title":"The ge- ometric variations across different arrays make it difficult to merge existing datasets into a unified, large-scale training cor- pus","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.238419Z"},"links":{"cited_paper":"/paper/2607.18658","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:eafb3a2636aefbaeab32f6e74e344fde54e258cb16c408d4f6c9dceb7350e341","observation_id":"098ec478-e828-4094-927b-0a434f2d313c","resolution":{"observed_at":"2026-08-01T14:47:14.238419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.18658/citation-record","integrity":"/paper/2607.18658/integrity","json":"/paper/2607.18658/citation-record.json","paper":"/paper/2607.18658"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.18658","snapshot_observed_at":"2026-08-01T14:47:14.238419Z","title":"The ge- ometric variations across different arrays make it difficult to merge existing datasets into a unified, large-scale training cor- pus","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.238419Z"},"links":{"cited_paper":"/paper/2607.18658","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:eafb3a2636aefbaeab32f6e74e344fde54e258cb16c408d4f6c9dceb7350e341","observation_id":"098ec478-e828-4094-927b-0a434f2d313c","resolution":{"observed_at":"2026-08-01T14:47:14.238419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.352723Z","title":"Input features are stacked along the channel dimension, and inter-channel infor- mation is fused within the layer to form the output [10, 11]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.352723Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:9f668c81a037ed55869475c7a2712b57efaceb026c8e6ea13c3d771522565cc8","observation_id":"e8946a9f-599c-4e39-9ca1-b97321429d58","resolution":{"observed_at":"2026-08-01T14:47:14.352723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.514726Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.514726Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:1eac3e4537731cebd319de5e8fd5c8e8fdb7823140a030dc20975ef8b0e7d7ab","observation_id":"b7c58c4f-3c7b-4ef2-a909-b10a3e5f4752","resolution":{"observed_at":"2026-08-01T14:47:14.514726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.612712Z","title":"Impact of Fixed vs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.612712Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:27d3175a78fac8eae313d92b0aa0b56e6e066cc557547af08069af378e5a1479","observation_id":"33da09ee-1385-4128-8cde-6f2716fe0b55","resolution":{"observed_at":"2026-08-01T14:47:14.612712Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.681917Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.681917Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:1f49d124ce5b20cc8de7da3fc1c294bdb4270c58538ae2c53ae42d73ccdede5f","observation_id":"6fc53ebb-4071-4bae-8c25-ec5b0461489d","resolution":{"observed_at":"2026-08-01T14:47:14.681917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.834046Z","title":"U25A20409, and in part by SJTU Med-X (Medicine & Engineering) Translational Research Grant (YG2025LC09)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.834046Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:5f22a2a6a519ca02f23014d6d29eab130f4cec1ac0016a0a09d3624be3a0da41","observation_id":"24026e50-30ee-4d1b-8b3b-c5c9ff09940d","resolution":{"observed_at":"2026-08-01T14:47:14.834046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.939236Z","title":"All scientific content, ideas, analysis, and conclusions are original and fully authored by the researchers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.939236Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:eb4d50b55aa1de22249571ee9ecb3b2eb3f9c67e3ac45515cc5bdf93fb6b19e9","observation_id":"52c68b56-89a5-475d-abdc-eee3a1c64aed","resolution":{"observed_at":"2026-08-01T14:47:14.939236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.019958Z","title":"SenSE: Semantic-aware high-fidelity universal speech enhancement,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.019958Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:f4582cde68d043c7f53a6b1c0caf7141ecdb0310a01a9f7bb6e4f83e6d826569","observation_id":"bf94a1e9-040c-43ae-b338-f2b2324bd4a8","resolution":{"observed_at":"2026-08-01T14:47:15.019958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.390874Z","title":"DNN-based geometry- invariant DOA estimation with microphone positional encoding and complexity gradual training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.390874Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:399dd35f1f75ec2dd92e3f4db70acad30780d8790e568a58fb2737219a86e267","observation_id":"f0119d4b-071c-4600-936b-06704a5ae9f2","resolution":{"observed_at":"2026-08-01T14:47:15.390874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.086359Z","title":"AnyEnhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.086359Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:72e7462cb3cb4880f0f19d2d16c7b9f63a91c199c8399e113cd188782defd6ea","observation_id":"a464dd8f-b77b-4de0-ab51-d6efcb5eb7f6","resolution":{"observed_at":"2026-08-01T14:47:15.086359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.122307Z","title":"End-to- end microphone permutation and number invariant multi-channel speech separation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.122307Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:b17a7781322c676e2a5529dbb4ccc6eb85e3271d4fdce219b8623d98e76ff5f7","observation_id":"ef4b40e5-5d89-49fc-b7e3-c9eddc8c7901","resolution":{"observed_at":"2026-08-01T14:47:15.122307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.164002Z","title":"TPARN: Triple-path attentive recurrent network for time-domain multichannel speech enhancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.164002Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:c6fab3b38a44461cc0b352a6a5ef0372f9f4377793f07cd97de37858a7f054f4","observation_id":"6f1eb3e5-6f50-4b62-9055-b8ff512afca5","resolution":{"observed_at":"2026-08-01T14:47:15.164002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.211397Z","title":"Improving design of in- put condition invariant speech enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.211397Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:7f968298a70ab181191907a718e083a2fd0e581d756d2040abe52d1fc36873cb","observation_id":"bc288d78-d7a0-4a3a-8079-e20bad8b2841","resolution":{"observed_at":"2026-08-01T14:47:15.211397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.14855","last_updated":"2026-07-01T07:15:38Z","snapshot_observed_at":"2026-08-06T08:59:22.592976Z","submitted_at":"2025-09-18T11:22:00Z","title":"AmbiDrop: Array-Agnostic Speech Enhancement Using Ambisonics Encoding and Dropout-Based Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.14855","snapshot_observed_at":"2026-08-01T14:47:15.259938Z","title":"AmbiDrop: Array-agnostic speech enhancement using ambisonics encoding and dropout- based learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.259938Z"},"links":{"cited_paper":"/paper/2509.14855","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:fd5cc24a9c7bdeea54e92c3a454b682ddff94ae204c8692fe2893940034def52","observation_id":"be6a1abf-efc3-44d1-8af0-8d8d993f8aba","resolution":{"observed_at":"2026-08-01T14:47:15.259938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.309007Z","title":"UniArray: Unified spectral-spatial modeling for array-geometry-agnostic speech separation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.309007Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:71b3319ea809620cc9f5fa859ad4dba54d09d14bb66a616b5839484c20683b2e","observation_id":"63cb14ad-d358-44fe-9541-771eef592f21","resolution":{"observed_at":"2026-08-01T14:47:15.309007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.359868Z","title":"A memory-based gravitational search al- gorithm for enhancing minimum variance distortionless response beamforming,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.359868Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:35c0a0c1a30f1a01e6fb19730ba703b118f682be93abeb3b0e5e866fd03ae80e","observation_id":"cc8cdf1d-f9fb-4cd8-b90f-c15c70256534","resolution":{"observed_at":"2026-08-01T14:47:15.359868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.855365Z","title":"TF-GridNet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.855365Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:1d3276b9f4bf2398538a3d048a980eeea9973df44cbec700cc5eb1edf905d91b","observation_id":"072a0c16-3ecf-4eaa-89e4-925c094e5186","resolution":{"observed_at":"2026-08-01T14:47:15.855365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.438047Z","title":"Beam-TasNet: Time-domain audio separation net- work meets frequency-domain beamformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.438047Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:e5f4d3cc7609eadcbb5e27bb21195f85226c33aff494ab26e78475d0773cbaac","observation_id":"40156162-b37a-49e7-8b50-685bfab7869b","resolution":{"observed_at":"2026-08-01T14:47:15.438047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.485664Z","title":"Closing the gap between time-domain multi-channel speech enhancement on real and simulation conditions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.485664Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:9fb1f7990905911dc6f092da0273b84ccf12e762f4b3d75ebaed76d144be984c","observation_id":"9e9a9017-c9e1-4178-9e8c-ca7181aa7e4e","resolution":{"observed_at":"2026-08-01T14:47:15.485664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.534881Z","title":"NeRF: Representing scenes as neural radiance fields for view synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.534881Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:3b8bed0b679cf5800ddef59e1290ad679395ec47c962a6970211cf0a9df5a017","observation_id":"331ef254-5a55-4017-8117-a10402d06f1f","resolution":{"observed_at":"2026-08-01T14:47:15.534881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.583084Z","title":"Learning neural acoustic fields,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.583084Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:736b624804894e68b69f7c56d13e48e8ca5b01410eae654225ae130f020bfe31","observation_id":"1a38d113-4b79-4837-b8d7-6aa3718ee59a","resolution":{"observed_at":"2026-08-01T14:47:15.583084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.630613Z","title":"RealMAN: A real-recorded and anno- tated microphone array dataset for dynamic speech enhancement and localization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.630613Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:1db190819665c62a00eca935575391086631e4b3e9d73541e22c49857e2135dd","observation_id":"c8299703-9838-4b1d-a987-bb6a06621bdd","resolution":{"observed_at":"2026-08-01T14:47:15.630613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.652676Z","title":"Music source separation with band-split RNN,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.652676Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:af84096aabadf2d7e1c26f41e03372e7e6a86c2af49c5860efa1427e3f662be9","observation_id":"977a3356-433a-417d-91bc-b68b2e2b5161","resolution":{"observed_at":"2026-08-01T14:47:15.652676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.752642Z","title":"SpatialNet: Extensively learning spatial in- formation for multichannel joint speech separation, denoising and dereverberation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.752642Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:795dee1d17e62db7efe8c1d554213d84776202ba164bcc75075e0dcdbbc78cb6","observation_id":"af068860-f786-4829-a3f4-2b8b79e39dd7","resolution":{"observed_at":"2026-08-01T14:47:15.752642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14623","last_updated":"2026-06-03T05:46:56Z","snapshot_observed_at":"2026-08-05T18:25:38.030161Z","submitted_at":"2025-08-20T11:22:11Z","title":"A Study of the Scale Invariant Signal to Distortion Ratio in Speech Separation with Noisy References","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14623","snapshot_observed_at":"2026-08-01T14:47:15.959730Z","title":"A study of the scale invariant signal to distortion ratio in speech separation with noisy references,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.959730Z"},"links":{"cited_paper":"/paper/2508.14623","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:9b5ccbb85d6ccc01b0aef8eef37953456fa0f69b078075e421db08a051193a62","observation_id":"4c04689f-25dd-40f7-bdd7-cb111c83085d","resolution":{"observed_at":"2026-08-01T14:47:15.959730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.007853Z","title":"Perceptual eval- uation of speech quality (PESQ)-a new method for speech qual- ity assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.007853Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:7bb1260a2d6e41c29a54254e93d1e8fda7009198d23e6ee5ea33a850ae29ad77","observation_id":"76cf895f-face-4ba1-9885-1ff2a040aa81","resolution":{"observed_at":"2026-08-01T14:47:16.007853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.088061Z","title":"A short- time objective intelligibility measure for time-frequency weighted noisy speech,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.088061Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:d74fd2a118156d4e686961b6e1024d597d7426b3a38649336d5c4ed2b5deadfa","observation_id":"57113d2b-aaf9-4e63-b171-e60f8e85d21a","resolution":{"observed_at":"2026-08-01T14:47:16.088061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.154364Z","title":"DNSMOS P. 835: A non- intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.154364Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:1bac844246fcd81384ad8348555ef218db9168b2f87c50c6df45256d2df44ae3","observation_id":"253f46ee-39c4-4ef6-9434-9587487874d2","resolution":{"observed_at":"2026-08-01T14:47:16.154364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.214424Z","title":"An analysis of environment, microphone and data simulation mismatches in robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.214424Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:1eb992c68631feaf4e5874a80229114efea50e842b8c5852a6984ac4258240c9","observation_id":"e124e135-f9e1-4c42-9816-27b2d9e4b232","resolution":{"observed_at":"2026-08-01T14:47:16.214424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24708","last_updated":"2026-04-05T03:27:11Z","snapshot_observed_at":"2026-08-04T09:40:49.585423Z","submitted_at":"2025-09-29T12:34:58Z","title":"SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24708","snapshot_observed_at":"2026-08-01T14:47:15.050474Z","title":"Available: https://arxiv.org/abs/2509.24708","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.050474Z"},"links":{"cited_paper":"/paper/2509.24708","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:6a21254480042e771f8e560d66f6996df621c8d289df9b7fdb27cb075674f0d0","observation_id":"ee406369-01f1-4329-a644-908167f022c2","resolution":{"observed_at":"2026-08-01T14:47:15.050474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T11:23:28.430534Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2607.18658."}