{"as_of":"2026-08-19T01:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b381fa25c5356d5120b4a90a31e6ac51735e3479f9c62157c23eed28b84ab7a","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T01:01:47.014495Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00003/citation-record","integrity":"/paper/2506.00003/integrity","json":"/paper/2506.00003/citation-record.json","paper":"/paper/2506.00003"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2109.06129","last_updated":"2021-09-14T07:10:41Z","snapshot_observed_at":"2026-08-16T17:56:56.996982Z","submitted_at":"2021-09-13T17:09:40Z","title":"Can Language Models Encode Perceptual Structure Without Grounding? A Case Study in Color","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06129","snapshot_observed_at":"2026-08-16T01:01:46.951308Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.951308Z"},"links":{"cited_paper":"/paper/2109.06129","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:f6b0628f9958cac2624fa50edec747fa230bd8db5997bd10507914430e54df5e","observation_id":"a1c5ea21-1656-457c-9b71-5da1a0188824","resolution":{"observed_at":"2026-08-16T01:01:46.951308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00475","last_updated":"2022-04-23T20:12:00Z","snapshot_observed_at":"2026-08-16T19:16:33.203758Z","submitted_at":"2020-10-01T15:07:25Z","title":"FSD50K: An Open Dataset of Human-Labeled Sound Events","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00475","snapshot_observed_at":"2026-08-16T01:01:46.956586Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.956586Z"},"links":{"cited_paper":"/paper/2010.00475","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:7929a562efe38acecb922353845fda0d1d2fdf28e5abeb9c397df346d01a08e1","observation_id":"e7089a03-23e9-430b-bc3b-b9f570c6f7b0","resolution":{"observed_at":"2026-08-16T01:01:46.956586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:46.961150Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.961150Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:4140097c697506fd33188c7f904012d8de223f889b1538ca7c81c874fb790fc0","observation_id":"0695277c-532e-413e-8fd8-3981eecc6e00","resolution":{"observed_at":"2026-08-16T01:01:46.961150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14856","last_updated":"2025-01-26T01:47:47Z","snapshot_observed_at":"2026-08-16T14:32:08.360219Z","submitted_at":"2023-12-22T17:29:08Z","title":"Turbulence: Systematically and Automatically Testing Instruction-Tuned Large Language Models for Code","version":3},"cited_work":{"arxiv_id":"2312.14856","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14856","snapshot_observed_at":"2026-08-16T01:01:47.127226Z","title":"Turbulence: Systematically and Automatically Testing Instruction-Tuned Large Language Models for Code","venue":"cs.SE","work_id":"b8c9091a-0098-401c-bce0-0d4c900dbb95","year":2023},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.965293Z"},"links":{"cited_paper":"/paper/2312.14856","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:bc0591fb57ee1511d8bfe3c98dfc7510c3a0b897a493a5fdecd3e2d1e0fe0975","observation_id":"b37ab424-4c3d-495d-afe4-b4071f6ff5ca","resolution":{"observed_at":"2026-08-16T01:01:47.133833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.04281","last_updated":"2018-12-12T07:42:08Z","snapshot_observed_at":"2026-08-14T18:29:37.094691Z","submitted_at":"2018-09-12T07:15:26Z","title":"Music Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.04281","snapshot_observed_at":"2026-08-16T01:01:46.970240Z","title":"Dai, Matthew D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.970240Z"},"links":{"cited_paper":"/paper/1809.04281","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:b3c475df992225c4e4f0350e0d99dab86cda86fd20a1eec9691008d1c2ba52d3","observation_id":"d581f7d3-f1e8-4429-ae09-9da0f1ee330e","resolution":{"observed_at":"2026-08-16T01:01:46.970240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-15T08:25:11.276003Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-16T01:01:46.975082Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.975082Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:1338e3852c29d47d7285dbe68e440960e11a597d27303d8132563f82faa54c99","observation_id":"d2398f65-f7c4-4408-afd3-7cbe56af2744","resolution":{"observed_at":"2026-08-16T01:01:46.975082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:47.213976Z","title":"Franke, and Andrew Zisserman","venue":null,"work_id":"4f88c0e4-5308-4699-b3d4-b4ced34be900","year":2017},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.979733Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:0bf28c87bc3eaabb5773a5cbd61a8266b72703a25fd70d6f2e4d4c94c68bee10","observation_id":"8f70e738-518c-43b3-a1c5-db4fa8f9beb9","resolution":{"observed_at":"2026-08-16T01:01:47.217831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:47.202546Z","title":null,"venue":null,"work_id":"31dbf68b-df25-4b24-9cc3-d8b78a3dbaad","year":2022},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.983345Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:4276dcfc48fda5f93fa7b84b6de296bb156dbbd185ea640d6ca654012c3a612d","observation_id":"7644e12e-4c82-4293-a31c-5c2be034901b","resolution":{"observed_at":"2026-08-16T01:01:47.206205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12925","last_updated":"2023-06-22T14:37:54Z","snapshot_observed_at":"2026-08-07T01:18:02.068918Z","submitted_at":"2023-06-22T14:37:54Z","title":"AudioPaLM: A Large Language Model That Can Speak and Listen","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12925","snapshot_observed_at":"2026-08-16T01:01:46.986759Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.986759Z"},"links":{"cited_paper":"/paper/2306.12925","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:47eb12b235d8e452c0525142a736658148b0ecd441803f8dbe23fc6dd9f890e1","observation_id":"5685effd-9494-4b52-8143-e28d5fa8d37f","resolution":{"observed_at":"2026-08-16T01:01:46.986759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01862","last_updated":"2024-01-03T18:09:33Z","snapshot_observed_at":"2026-08-16T14:30:02.593407Z","submitted_at":"2024-01-03T18:09:33Z","title":"A Vision Check-up for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01862","snapshot_observed_at":"2026-08-16T01:01:46.991081Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.991081Z"},"links":{"cited_paper":"/paper/2401.01862","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:1c7bb3977a449ea4b41e64d00b94f9b11c63892380fa91872ab7d63424391c6f","observation_id":"6ba9c38a-6d76-47fd-b043-89615dd55b5e","resolution":{"observed_at":"2026-08-16T01:01:46.991081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:47.190613Z","title":null,"venue":null,"work_id":"9ac53876-38c0-43c7-8c77-6b7384b71194","year":2017},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:46.995986Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:4e68d8eb6736e089166f1d789466d08509760438d4f90b04e59fdd0fc4d181eb","observation_id":"45e573fc-63d7-43a0-b02a-c94d1fde5aac","resolution":{"observed_at":"2026-08-16T01:01:47.194818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:47.178544Z","title":null,"venue":null,"work_id":"68dcc0bd-216f-4edd-9798-9b1a33dee062","year":2023},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:47.000175Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:164eecfd065464892ec205e7bcb3e94087db5d234a44cb19b76ee359f0659781","observation_id":"22d13cfb-1534-4967-98e4-8581a50480ee","resolution":{"observed_at":"2026-08-16T01:01:47.183001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00335","last_updated":"2025-05-11T23:57:58Z","snapshot_observed_at":"2026-08-16T18:27:39.380785Z","submitted_at":"2021-05-01T19:38:30Z","title":"Audio Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00335","snapshot_observed_at":"2026-08-16T01:01:47.003825Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:47.003825Z"},"links":{"cited_paper":"/paper/2105.00335","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:2268b7cf4e10c0074675a596861c9489e4098fed0e235d93878949f3fb52145a","observation_id":"db2b5505-a39a-478d-ad11-092a904e81d1","resolution":{"observed_at":"2026-08-16T01:01:47.003825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08109","last_updated":"2025-01-15T11:57:34Z","snapshot_observed_at":"2026-08-15T20:29:17.589892Z","submitted_at":"2024-12-11T05:31:39Z","title":"Unseen Horizons: Unveiling the Real Capability of LLM Code Generation Beyond the Familiar","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08109","snapshot_observed_at":"2026-08-16T01:01:47.007429Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:47.007429Z"},"links":{"cited_paper":"/paper/2412.08109","citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:b186d09bf64978d927ecbc4cd0c32c304b6cfb4220c9764d4de29d1c55368e4d","observation_id":"c8de5b1f-ffef-4e79-ad46-f2bcbe47a9b0","resolution":{"observed_at":"2026-08-16T01:01:47.007429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:47.010821Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:47.010821Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:e985aa20116bbff3fed43458407dd5adef8f02f142ad7a591abcbf67b0542b0b","observation_id":"889cae68-face-4848-803b-ab4e7cea38a3","resolution":{"observed_at":"2026-08-16T01:01:47.010821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T01:01:47.014495Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T01:01:47.014495Z"},"links":{"citing_paper":"/paper/2506.00003"},"observation_digest":"sha256:b763ef4eb87c47eeb38d1508796fe2517768eab1cece42bc0c60c3596f747b6b","observation_id":"bd81236d-b8ed-44cc-9012-97d3a88411bf","resolution":{"observed_at":"2026-08-16T01:01:47.014495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00003","last_updated":"2025-05-04T23:46:01Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T00:53:38.607983Z","submitted_at":"2025-05-04T23:46:01Z","title":"Probing Audio-Generation Capabilities of Text-Based Language Models"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2506.00003."}