{"as_of":"2026-08-07T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc2335fa1fe09349a7f80e8eda11586069e9302f3e5f26eb4db4b7e955d94edd","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:34:15.067301Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.06065/citation-record","integrity":"/paper/2509.06065/integrity","json":"/paper/2509.06065/citation-record.json","paper":"/paper/2509.06065"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:18.729957Z","title":"https: //www.nature.com/articles/s41598-025-98483-1","venue":null,"work_id":"25ff68b8-96e8-45fe-bd1a-366a6cf18db0","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:12.775402Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:b27137b75320e81517ca269a1abaa4536e93f6c36265a5f2007cc0bd365b2cd6","observation_id":"8e020b3f-7e2e-47a8-952e-23460ec651e1","resolution":{"observed_at":"2026-08-05T04:34:18.841396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:18.482665Z","title":"https: //www.nature.com/articles/s41586-024-07421-0","venue":null,"work_id":"b886c038-f702-47e0-b754-d10b86fa9ef0","year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:12.854025Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:45bbfb8f63a160d742267954350bfac4eebdfda89d2a69735d434a73c6e50799","observation_id":"8f534799-7d9b-46a3-95d5-bef04b4c8bb4","resolution":{"observed_at":"2026-08-05T04:34:18.588446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-05T04:34:13.022585Z","title":"https://arxiv.org/abs/2311.05232","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.022585Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:44bfaf88fcdbac55dc9719a1d08a108a850cd703ca34d85f8fff3e398a97beb7","observation_id":"dafac304-5e89-4c1a-9351-af85aa11d3d9","resolution":{"observed_at":"2026-08-05T04:34:13.022585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-05T04:34:13.134166Z","title":"https://arxiv.org/abs/2109","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.134166Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:2abac2699b1efbe9c8eef926b3c604d7066952ec0cd6d81c24df45fca667a6cb","observation_id":"cf25dc17-5198-4b90-b25b-829dbeb7f572","resolution":{"observed_at":"2026-08-05T04:34:13.134166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:18.180577Z","title":"LessWrong(2025)","venue":null,"work_id":"e977125e-c297-43b9-85ce-ae9799a74714","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.256045Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:1217f3cb64bf8ad5c2aaf832e2e5b305a8e0e13a3fea2b348fbf94f7ae0c647b","observation_id":"5c3f8478-e4fd-4e1d-94ef-9fed3d631d1e","resolution":{"observed_at":"2026-08-05T04:34:18.362908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.938707Z","title":"Association for Computational Lin- guistics","venue":null,"work_id":"4dac3564-2578-477e-9472-4f1812061191","year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.420371Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:76bee6abb7a59d0c99bb57fdaccff7badfdb044d8fc0722345b259829c5bdb8a","observation_id":"2147dc05-b97f-4c0e-81dd-e56cbe30ccca","resolution":{"observed_at":"2026-08-05T04:34:18.046645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.699913Z","title":"https://commoncrawl.github.io/ cc-crawl-statistics/plots/languages","venue":null,"work_id":"004706be-ec88-45a0-8769-48393380af64","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.590672Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:b5188b7736b5d03893c2afb770eba53786af91d6704b0f3dccddfdf8a2df9147","observation_id":"825e1b1d-0ad7-46b3-beb4-8e42c1f0fc07","resolution":{"observed_at":"2026-08-05T04:34:17.807059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16787","last_updated":"2023-11-04T19:10:06Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:20:26Z","title":"The Data Provenance Initiative: A Large Scale Audit of Dataset Licensing & Attribution in AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16787","snapshot_observed_at":"2026-08-05T04:34:13.772914Z","title":"https://arxiv.org/abs/2310.16787","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.772914Z"},"links":{"cited_paper":"/paper/2310.16787","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:09ea9a22e901bf8f834d9210b4b213ecf8025ad63b31d9384a63211546a44584","observation_id":"24652b06-c21f-4849-90b4-1714d52eaafb","resolution":{"observed_at":"2026-08-05T04:34:13.772914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14911","last_updated":"2025-06-19T08:30:50Z","snapshot_observed_at":"2026-07-06T20:40:01.776087Z","submitted_at":"2025-02-19T07:03:15Z","title":"Batayan: A Filipino NLP benchmark for evaluating Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.14911","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.14911","snapshot_observed_at":"2026-08-05T04:34:16.427217Z","title":"Batayan: A Filipino NLP benchmark for evaluating Large Language Models","venue":"cs.CL","work_id":"8570a43d-4c7b-4181-820b-a0e09ddf88e6","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.877584Z"},"links":{"cited_paper":"/paper/2502.14911","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:2e7490737713916e6fc324fa566d7a7465a3cdc7ddd6d26da61c6671694cb5a7","observation_id":"2bf1059f-d29b-4368-a078-23d820ce234d","resolution":{"observed_at":"2026-08-05T04:34:16.604534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.09387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:16.080097Z","title":"arXiv preprint arXiv:2502.09387(2025)","venue":null,"work_id":"8be5614c-d7f5-430c-8a75-77e0ae4d9dc5","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.027859Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:9cc908451b043ff9d32ca0d98c2cf631bcdb9e313bf1ae639f6bba2834a56a88","observation_id":"f1faeaab-6ade-41b5-a9b0-b8dea4f463da","resolution":{"observed_at":"2026-08-05T04:34:16.261035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.443367Z","title":"Association for Computational Linguistics","venue":null,"work_id":"37afce7c-ea6f-48f3-8ab5-fe0ce672f76b","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.139147Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:a0f84407c97005ded58e8f1c8f17105ba54276f28894c0b7690d2be8b1088624","observation_id":"9fcf1110-bd84-44fe-b5c5-32254e182b10","resolution":{"observed_at":"2026-08-05T04:34:17.537765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00948","last_updated":"2024-12-01T19:46:40Z","snapshot_observed_at":"2026-07-06T19:59:47.022132Z","submitted_at":"2024-12-01T19:46:40Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","version":1},"cited_work":{"arxiv_id":"2412.00948","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00948","snapshot_observed_at":"2026-08-05T04:34:15.539178Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","venue":"cs.CL","work_id":"1ce92246-0dbe-4465-b39b-1919000ebb06","year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.256912Z"},"links":{"cited_paper":"/paper/2412.00948","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:3a60d043ccfcd9a84f16e570da76982d3fde370fb926f4abbe60d2fbd3e827dc","observation_id":"a749506c-f4c3-4ce3-9133-c92e07c54505","resolution":{"observed_at":"2026-08-05T04:34:15.667230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05794","last_updated":"2022-03-11T08:35:15Z","snapshot_observed_at":"2026-07-06T12:46:41.057346Z","submitted_at":"2022-03-11T08:35:15Z","title":"BERTopic: Neural topic modeling with a class-based TF-IDF procedure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05794","snapshot_observed_at":"2026-08-05T04:34:14.429081Z","title":"https://arxiv.org/abs/2203","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.429081Z"},"links":{"cited_paper":"/paper/2203.05794","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:1a46c08929e4d97c766d2725aae93d69af2ac857e10b54a503b526437156601e","observation_id":"084fcc2b-b44b-4dbe-8a23-7e57192efd35","resolution":{"observed_at":"2026-08-05T04:34:14.429081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.119350Z","title":"S.: Chapter 5: Tests for Paired Nominal Data.R Companion Hand- book(2025)","venue":null,"work_id":"de68112a-464c-450d-8dc5-8d8c37589331","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.590487Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:f25e0c9a1319a0a23cbd7436547934bbd24c4dd64322968da054c242a9de5822","observation_id":"d49f8eb6-9f6f-4365-bc30-3c8d113fcae8","resolution":{"observed_at":"2026-08-05T04:34:17.292638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03523","last_updated":"2025-08-05T14:48:32Z","snapshot_observed_at":"2026-08-06T04:24:04.481518Z","submitted_at":"2025-08-05T14:48:32Z","title":"FilBench: Can LLMs Understand and Generate Filipino?","version":1},"cited_work":{"arxiv_id":"2508.03523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.03523","snapshot_observed_at":"2026-08-05T04:34:15.210465Z","title":"FilBench: Can LLMs Understand and Generate Filipino?","venue":"cs.CL","work_id":"7aae5d80-23e2-4b6c-be8e-473c6c264491","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.771236Z"},"links":{"cited_paper":"/paper/2508.03523","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:a33a764b60aa94480a2c7625a02edf12ba0a5959cdd522d9b3b6b4d545af1de5","observation_id":"1fe44ee8-4816-4c0e-9982-b222143ee92b","resolution":{"observed_at":"2026-08-05T04:34:15.338813Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.11080","last_updated":"2020-09-04T17:56:31Z","snapshot_observed_at":"2026-07-06T09:07:03.996169Z","submitted_at":"2020-03-24T19:09:37Z","title":"XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.11080","snapshot_observed_at":"2026-08-05T04:34:14.946810Z","title":"https://arxiv.org/abs/2003.11080","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.946810Z"},"links":{"cited_paper":"/paper/2003.11080","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:8ee4fa52999938f47caf7e2f30a6d2766a6edf0d18db7d3ebd6114b74f81c924","observation_id":"3536f4d6-026f-4973-843e-3bcd961e2bf7","resolution":{"observed_at":"2026-08-05T04:34:14.946810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:16.831883Z","title":"https://openai.com/ index/introducing-gpt-5/","venue":null,"work_id":"5721fcda-b55c-417d-a74f-45fa80ad1481","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:15.067301Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:618dc549d1ae100c99fa385b6dd042b7e016633ed142fb3876bac1b5246c72d1","observation_id":"d1cd925b-b8aa-46e4-85e9-6b87305d7a85","resolution":{"observed_at":"2026-08-05T04:34:16.953587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T09:02:15.345728Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":5,"verified_exact":3,"verified_fuzzy":8},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2509.06065."}