{"as_of":"2026-08-08T11:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea1ea13378870ec3fdd5d38b34b340adfa5cd45956626055c4d7474905b900b9","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:53:46.177712Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:53:41.686588Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:53:46.575085Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"cited_work":{"arxiv_id":"2506.06756","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.06756","snapshot_observed_at":"2026-08-07T05:53:46.575085Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","venue":"cs.SD","work_id":"d901e548-6e6e-4ae4-92c2-ec73af94fe4b","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:41.686588Z"},"links":{"cited_paper":"/paper/2506.06756","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:cf4a89a900a161e22d0bf2e9796741497276b40807b848851adac429110e6318","observation_id":"619034f8-a4d3-4385-a877-97c322ddd4f0","resolution":{"observed_at":"2026-08-07T05:53:46.714939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06756/citation-record","integrity":"/paper/2506.06756/integrity","json":"/paper/2506.06756/citation-record.json","paper":"/paper/2506.06756"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"cited_work":{"arxiv_id":"2506.06756","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.06756","snapshot_observed_at":"2026-08-07T05:53:46.575085Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","venue":"cs.SD","work_id":"d901e548-6e6e-4ae4-92c2-ec73af94fe4b","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:41.686588Z"},"links":{"cited_paper":"/paper/2506.06756","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:cf4a89a900a161e22d0bf2e9796741497276b40807b848851adac429110e6318","observation_id":"619034f8-a4d3-4385-a877-97c322ddd4f0","resolution":{"observed_at":"2026-08-07T05:53:46.714939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:53.608093Z","title":", xT }, where each frame xi ∈ Rd, T is the total number of frames, and d is the dimensionality of each frame","venue":null,"work_id":"6d6e1392-700a-4ae7-a965-20f92294cfe5","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:41.820304Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:425bf1af52e0b2b25cb85a5dd6bd0238599b28aa857992dae79efca9fe14365c","observation_id":"befc544c-3856-4c93-8b2d-e616bde42fcd","resolution":{"observed_at":"2026-08-07T05:53:53.775356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:53.231320Z","title":null,"venue":null,"work_id":"bfc4c56c-72a8-40e7-afc4-cd403c45ac4b","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.053609Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:24429d7bd90415807b362a58a3e221ed0815f74cc639af21cbe163dfcdb8871d","observation_id":"ab3d14b1-325e-4ec9-b4c0-631604418605","resolution":{"observed_at":"2026-08-07T05:53:53.408576Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:52.878326Z","title":null,"venue":null,"work_id":"5753f778-2e66-4830-8fb2-4c0872cfd40d","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.206192Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:83fd6acd0aa0c93a87b08427b8304bb64bcb4e28edfc5cbbf99e2bd44e07d669","observation_id":"5ac88124-4318-47b6-8e23-b59ffe1412ee","resolution":{"observed_at":"2026-08-07T05:53:53.024690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:52.608072Z","title":"The authors also gratefully acknowledge the support of IndiaAI and Meta through Srijan: Centre of Excellence for Generative AI","venue":null,"work_id":"4a16e701-4e8d-48e6-a7e3-cbf328da62a0","year":null},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.392482Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:d02c861e522af4531223bd180eec88fce1bb7da6931a46d562c77caf3733bb97","observation_id":"598dadb5-7ded-4ab6-9dd9-e34a8290dd8d","resolution":{"observed_at":"2026-08-07T05:53:52.775425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:42.552426Z","title":"A survey on speech large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.552426Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:940668ed6dec66d1ac5e0ad261d67fb663dd0cab15f8e12d3754d9cf55c4831a","observation_id":"65ed964c-16db-4e40-97dc-e2ca37f0cd04","resolution":{"observed_at":"2026-08-07T05:53:42.552426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:52.264416Z","title":"Pengi: An audio language model for audio tasks,","venue":null,"work_id":"59a8ff79-19f8-4319-af75-120ac32ececa","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.756657Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:73b08a2c94af626a74cdadd6ea41fde0de42d48b99276677a64a380171ed5286","observation_id":"77671e89-220a-4470-ba43-3449a82916bd","resolution":{"observed_at":"2026-08-07T05:53:52.399755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:42.917701Z","title":"Listen, think, and understand,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:42.917701Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:bd0e033c62b3b387b0fe080aeedd2d6c44efa5b817424257368065a2145e2614","observation_id":"ca7920ca-83cc-4357-9eeb-7638162454d6","resolution":{"observed_at":"2026-08-07T05:53:42.917701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:51.832152Z","title":"Neural codec language models are zero-shot text to speech synthesizers,","venue":null,"work_id":"7436168b-1596-4b6b-929b-bf4bce666221","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.059579Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:e379c502670e12dcf669f7b0d065644399a2d59d3559d58726729e6830beec91","observation_id":"1ccf13a9-e7fd-4aab-a400-2f012904c747","resolution":{"observed_at":"2026-08-07T05:53:52.046837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:51.515336Z","title":"Mobilespeech: A fast and high-fidelity framework for mobile zero-shot text-to- speech,","venue":null,"work_id":"2f6cc713-1cea-4a5e-a16b-86814c60de9a","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.197717Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:2766456059ac0552eda3c70b40561eba7b890476743de2e81c8c535d06528e3d","observation_id":"a70db387-9f55-42b0-9d19-982eb978689a","resolution":{"observed_at":"2026-08-07T05:53:51.657404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:51.140312Z","title":"Can rag- driven enhancements amplify audio llms for low-resource lan- guages?","venue":null,"work_id":"807d630b-eaec-4968-9612-e49a9b473af8","year":2025},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.338242Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:df690de557db06c10306bb71fb28009747e1a694575863a8484e51e72029b2c0","observation_id":"32c170c8-4a14-4e84-bbe3-78709ccb905f","resolution":{"observed_at":"2026-08-07T05:53:51.306554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08295","last_updated":"2021-06-15T17:12:42Z","snapshot_observed_at":"2026-08-02T11:19:40.664702Z","submitted_at":"2021-06-15T17:12:42Z","title":"A White Paper on Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08295","snapshot_observed_at":"2026-08-07T05:53:43.538083Z","title":"A white paper on neural network quantization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.538083Z"},"links":{"cited_paper":"/paper/2106.08295","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:4a4596da61d64f79227e4317381a1b6327dfa224468f087234e0c0d47e43b760","observation_id":"6dc123cf-8fa7-46cc-94c1-c9d7f1a98db5","resolution":{"observed_at":"2026-08-07T05:53:43.538083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:50.754717Z","title":"Sv-deit: Speaker verifica- tion with deitcap spoofing detection,","venue":null,"work_id":"85a1f9af-b2fd-47f1-aba1-cee772983521","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.692101Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:42d585eaa33388c2684822fcfb4363f518acea858760bb96725bb7b34000ab73","observation_id":"d24e1cdc-a9a6-476b-9ce6-ddc7c8faee7f","resolution":{"observed_at":"2026-08-07T05:53:50.922281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:50.343651Z","title":"Faking fluent: Un- veiling the achilles’ heel of multilingual deepfake detection,","venue":null,"work_id":"50b86930-f9ab-49e0-ac20-a75a922998a5","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:43.839750Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:c836da1dd59faa9feeca3fd8acb6f8ef1cabf9c219c0188c482db9756b8a4168","observation_id":"c17f2288-a9ee-4e5d-ba25-0e9aee2b4d45","resolution":{"observed_at":"2026-08-07T05:53:50.535046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:50.055463Z","title":"Context encoded multi-modal attention network for detecting audio spoofing,","venue":null,"work_id":"0f2b9dd0-926e-4afd-84b9-8c66465d0952","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.011055Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:febdeffdbc4b9a82fa76a1cc78f124f4e9dc74e60d136ea5d24a4411ca23a969","observation_id":"0e6ed026-db15-44d2-8ac6-c656b1418ab9","resolution":{"observed_at":"2026-08-07T05:53:50.192227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:49.702859Z","title":"GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities,","venue":null,"work_id":"01ea95d8-8b56-4e46-9831-3397f08bea2a","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.215530Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:2a17dd8c0e6aa0cd5ea5b27334536b6c3c8b27928404506f8fdf4d731147b187","observation_id":"a26f2131-a477-4e15-84f1-3345db629dac","resolution":{"observed_at":"2026-08-07T05:53:49.886715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T05:53:44.376678Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.376678Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:f6bc4944e7f9da79e73a043979d48a825574faa067ed8705d0c760ac9e30ed8a","observation_id":"973e30d4-adff-4e7b-8470-f14e4fe45fb9","resolution":{"observed_at":"2026-08-07T05:53:44.376678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:49.356714Z","title":"Joint audio and speech understanding,","venue":null,"work_id":"a1e32f10-9a07-42f6-b561-4fd4a851dc64","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.580432Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:803280f56bb7f4d3d390d251a5dfac9a32562de6afb6b45b1924f80cea743a7b","observation_id":"96c5930e-a4f0-4934-a6ad-19a6570dcaad","resolution":{"observed_at":"2026-08-07T05:53:49.537664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:49.011497Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"b0a38c9e-dbe3-496e-8686-c6345328ff28","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.729191Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:5bf72278844f49e6fb05c21c3123a91a1bf3b0cbe01cc1d44c93fbaf183af563","observation_id":"62632fbf-3ca5-48e1-9c5c-321b350e58a4","resolution":{"observed_at":"2026-08-07T05:53:49.189022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-07-06T20:06:17.706151Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09818","snapshot_observed_at":"2026-08-07T05:53:44.932527Z","title":"Meralion-audiollm: Bridging audio and language with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:44.932527Z"},"links":{"cited_paper":"/paper/2412.09818","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:cc7ad9570ea063e98298bfd61e527219fe73f563d4a3dfe478168f7d889e05bc","observation_id":"ea9b714b-767a-4334-ba29-1bd3b7e6cb14","resolution":{"observed_at":"2026-08-07T05:53:44.932527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:48.712723Z","title":"Sea-lion (southeast asian languages in one net- work): A family of large language models for southeast asia,","venue":null,"work_id":"2d09b829-474d-4949-8561-df0fb66734a8","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.065096Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:9d5e07d3c859a3fd3b3c47690b7fe154aaf269d9d5418250bd1de0a1823ae98a","observation_id":"ba26a92e-fbcc-4d97-8043-21e6e3f0c0eb","resolution":{"observed_at":"2026-08-07T05:53:48.885947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T05:53:45.230382Z","title":"Qwen-audio: Advancing universal audio under- standing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.230382Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:a4b55aa464b5e4be4a61af5337a6d0f6401a142fa404e9a5b8c67335105184d4","observation_id":"a047bf3c-cd4e-4e5d-a4f9-7df2d0718f40","resolution":{"observed_at":"2026-08-07T05:53:45.230382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:48.289909Z","title":"SALMONN: towards generic hearing abilities for large language models,","venue":null,"work_id":"ada44cf1-6f88-4f2d-813a-e3eefb580192","year":2024},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.391416Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:876efd5ac5e8c1ab05be68de3d989fe9555d9f6e2ae4a5d8e81b5015075116f8","observation_id":"c2e97566-4099-4ab9-8ebe-24ca57a30d7d","resolution":{"observed_at":"2026-08-07T05:53:48.506318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:47.909777Z","title":"Vicuna: An open-source chatbot impress- ing gpt-4 with 90%* chatgpt quality,","venue":null,"work_id":"dde3add9-2d26-4da2-9ed1-636c84ca6692","year":2023},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.595885Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:e67c46a19dc1e0506c36af15dfa068aa060617e69a07e3dec98606cc2b6ae682","observation_id":"67d529dc-35b7-4f9d-a12c-fae02b9b6bd9","resolution":{"observed_at":"2026-08-07T05:53:48.105285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:47.615465Z","title":"Asvspoof 2019: Spoofing countermeasures for the detection of synthesized, converted and replayed speech,","venue":null,"work_id":"7528f672-cba5-4a32-8867-0a23dae3991f","year":2019},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.744556Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:8329d17e96798a3a2c6ef7e6021c77af114b3f867b32cf09a5b40fe657529712","observation_id":"9cee30bb-7b37-41d0-ab5e-78f52075e62d","resolution":{"observed_at":"2026-08-07T05:53:47.756321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:47.329851Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"fc50123c-d42b-4300-a50e-f269b8357497","year":2022},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:45.943188Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:a5c37dfa505d92c27dd5bcd07e8a8a28772e1a971a8c85dea2f2a5e1b993d9fa","observation_id":"5d189bd7-4b2e-4152-9824-c8b07c066f67","resolution":{"observed_at":"2026-08-07T05:53:47.455935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:53:46.833349Z","title":"Wavefake: A data set to facilitate audio deepfake detection,","venue":null,"work_id":"47d0f56d-68dc-4dbd-9b02-7fb4df5a3a9c","year":2021},"citing_paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:46.177712Z"},"links":{"citing_paper":"/paper/2506.06756"},"observation_digest":"sha256:e73d5064d9857ea36f9c3b7637760dd712338676af96194a6504e44cd765b8f0","observation_id":"845c7959-fd43-4df2-bc3f-1b4adb6d35b7","resolution":{"observed_at":"2026-08-07T05:53:47.164985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06756","last_updated":"2025-06-07T10:56:33Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T05:47:49.266556Z","submitted_at":"2025-06-07T10:56:33Z","title":"Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2506.06756."}