{"as_of":"2026-08-09T12:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0085d8d33d94c1f29db6ffb4f0ebcd5807b091b1c91ab8ac314c57b35e2b63e6","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:44:30.355862Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.13972/citation-record","integrity":"/paper/2505.13972/integrity","json":"/paper/2505.13972/citation-record.json","paper":"/paper/2505.13972"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-07T15:44:25.515082Z","title":"Hewett, Mojan Javaheripi, Piero Kauffmann, James R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.515082Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:cde2f2a49c12f4174fb91d31f376c71071a200b05c0b1b16f0978d8fc661c73a","observation_id":"7088945a-d144-4f99-a60c-a4e592907fe0","resolution":{"observed_at":"2026-08-07T15:44:25.515082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:36.819825Z","title":null,"venue":null,"work_id":"8eb816fa-5a52-4c8b-9b5e-4288dc000e64","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.554905Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:5a481f357a0875574a0d7d435e70b370b56cee953f424772e7038a03e9bf3077","observation_id":"6b00125d-17ca-40ed-958f-f67ebb09fba6","resolution":{"observed_at":"2026-08-07T15:44:36.893628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:25.650892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.650892Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:66f0b69d57a07dd42839694253081dd5bbc1757aeeece57ab855fafb6145a467","observation_id":"638873ec-33a8-4e8d-972d-0f1f3ff97c97","resolution":{"observed_at":"2026-08-07T15:44:25.650892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.10","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:33.036696Z","title":null,"venue":null,"work_id":"822217b2-4d28-4d61-9ea8-b29bd26f014e","year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.754515Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:a2dc2e19c12ba8b22d2381d159c382bea2165a9594231e07321385de693bced4","observation_id":"3117beef-c4f5-4366-830e-3d819b5959ee","resolution":{"observed_at":"2026-08-07T15:44:33.234735Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:25.825354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.825354Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:749dce3416e4aea1f5b2de55f9dc47a1e0cbae1c63356c9579f238014fd52272","observation_id":"0ad26ac0-38c0-4065-9fee-872b29b8807a","resolution":{"observed_at":"2026-08-07T15:44:25.825354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:36.465012Z","title":null,"venue":null,"work_id":"7e39463c-4cd7-4513-b471-99f20d447f52","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.895584Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:dec773dac192964a3508dcb9094081030687c3b6e15ee71bb485350474f36730","observation_id":"d8f194de-3bf2-4e68-b873-3856962a54d0","resolution":{"observed_at":"2026-08-07T15:44:36.602773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.043351Z","title":"Bowman, Gabor Angeli, Christopher Potts, and Christopher D","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.043351Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:65c48810ee6ae04bbda65a3d4e1fab067dde409e9d2abfb45136f40d7db6c900","observation_id":"fc89d7ea-351a-4353-9fcb-792951f9c937","resolution":{"observed_at":"2026-08-07T15:44:26.043351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.234743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.234743Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:98e9c184392454697bcb2e0c27fb4e8b6763c57cefaf828f74547a0334d9f7ba","observation_id":"cc147dd9-e4cd-4013-b9d9-72c468494670","resolution":{"observed_at":"2026-08-07T15:44:26.234743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:44:26.344047Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.344047Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:7a6e5f7b067dd1ddb88aa13b05bc3a88b0ea8aac4680f034c1254ac14132df19","observation_id":"fe638c10-8937-464a-b023-553114cc1164","resolution":{"observed_at":"2026-08-07T15:44:26.344047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.18156","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:34.602076Z","title":null,"venue":null,"work_id":"bdf3dbd9-912b-43ae-b43e-bf26c7d25546","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.464746Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:463bb652fa6b68fadaf63d29f4a0c9f8b37e804ee826ec7c110efa313a60baa1","observation_id":"a2dbc8b2-911f-4c08-9865-2eb3f5b69d05","resolution":{"observed_at":"2026-08-07T15:44:34.792167Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.614909Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.614909Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:09198b9d22e3278449ae82c02aeb701a5300439f294330907fbd72f87eabcfc8","observation_id":"3aaacecc-76ec-49a5-9f24-cd84555444c4","resolution":{"observed_at":"2026-08-07T15:44:26.614909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.794865Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.794865Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:22e3fc8eaf3dcdd147a1a2ee6f07d713b0f4020a60c83a70034ec21edc2effe2","observation_id":"1e9f694f-152b-46cb-a716-8a5945f3453b","resolution":{"observed_at":"2026-08-07T15:44:26.794865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i15.33791","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:32.645589Z","title":null,"venue":null,"work_id":"acff485e-8313-4131-b053-7b6a595c9721","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.907496Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:a19e4c8b11e13def45bf41d100494f3649b57d493a51f79124a05752c8c57d76","observation_id":"48b6081e-2c53-4b88-9cc9-8022c0bb897c","resolution":{"observed_at":"2026-08-07T15:44:32.734870Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.359","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:32.295820Z","title":null,"venue":null,"work_id":"b5e8214e-3e1c-4ffe-adb7-bb8c3b79d56c","year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.034846Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d905add947ea594e6319e3a69f61f1f43c59f4a38b0db27e1db9334e6b3814b3","observation_id":"f340d044-a703-418a-86c7-ac949718d152","resolution":{"observed_at":"2026-08-07T15:44:32.470377Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.emnlp-main.452","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:32.124838Z","title":null,"venue":null,"work_id":"7aa3c91c-21ba-4c52-86ca-9e165ff40966","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.181806Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:04ae05cbfc1b5f3a3fac3ef33b48f5ef85f298336dcaf05f57d862498655bd62","observation_id":"8d43f7c0-349e-4f77-93e2-8761bc39f687","resolution":{"observed_at":"2026-08-07T15:44:32.192332Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:27.316254Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.316254Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:1c165fb0191bace1b7933d5a1dd2d634d1d26868c8ac6ba84d92223c62a64af0","observation_id":"1e4f6d65-a1f8-4117-b92b-c4dfced02546","resolution":{"observed_at":"2026-08-07T15:44:27.316254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01962","last_updated":"2021-09-05T01:38:49Z","snapshot_observed_at":"2026-08-07T00:28:16.881534Z","submitted_at":"2021-09-05T01:38:49Z","title":"Counterfactual Evaluation for Explainable AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01962","snapshot_observed_at":"2026-08-07T15:44:27.488639Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.488639Z"},"links":{"cited_paper":"/paper/2109.01962","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:07c7eff777f7836b8b6007ed31bf226460fcfdf73a418dc514854966ef49197d","observation_id":"1d5c8c3d-0cc8-4dfa-8459-bf1d4712e4e3","resolution":{"observed_at":"2026-08-07T15:44:27.488639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:44:27.624972Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.624972Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:221689bda59cdcbcd282cf8ce0d9a45a4c7e8babcd41f587702afa499620bdc2","observation_id":"c883d8c2-6b6d-41c0-aaa4-67e1144eef69","resolution":{"observed_at":"2026-08-07T15:44:27.624972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:27.764919Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.764919Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:05de631d007c40b66cf9b67c3e35c33abfc11bb1e3a6e9292f2412207480bdf9","observation_id":"da3e824a-30f2-4312-95ce-38c4b92815ab","resolution":{"observed_at":"2026-08-07T15:44:27.764919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:27.933864Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.933864Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:02b05df7cbcadca3cf32c0ddc0217821639f142edcd50f5a7ddd78acaf0ed5ed","observation_id":"33d3ae11-6940-4465-b6d2-45ae956f336a","resolution":{"observed_at":"2026-08-07T15:44:27.933864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:36.134814Z","title":null,"venue":null,"work_id":"12574797-3e8c-4e80-be2e-60a64e391f10","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.036650Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:aa449e68c7fcea67f164e7548bbaddddcd5c5104677784ad6735dc60b280bb87","observation_id":"407b9831-af7a-4d0d-bdb0-005d367a5b30","resolution":{"observed_at":"2026-08-07T15:44:36.215754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:28.195340Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.195340Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:31f9d97d84470a77b823aaade7aa7900b8d82f046ec7d3fb0013badbc241f77d","observation_id":"16425e82-50fb-4e09-a141-ac9f9cdcab17","resolution":{"observed_at":"2026-08-07T15:44:28.195340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i15.17594","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:31.672461Z","title":null,"venue":null,"work_id":"945cb3c3-86c0-4aa0-857b-851e7932d6a8","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.379835Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:95e3c251c3b4432440dfafa3795c742590fe59bd5c7a035332095752f609ff22","observation_id":"cdccff1e-2b2b-4eb6-9712-161ec3114885","resolution":{"observed_at":"2026-08-07T15:44:31.814757Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:28.515999Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.515999Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d0711221570b2745a2e78b4f1c4952b40f19065272a50543a395a1f6fd8faa9e","observation_id":"6fdca278-8915-419d-99ac-7a4f2ac5cd0e","resolution":{"observed_at":"2026-08-07T15:44:28.515999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:35.804748Z","title":null,"venue":null,"work_id":"b14ebff2-2987-4d93-912e-e14ac5f30d13","year":2019},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.603647Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:fbb403d496d7ff2499b2c695fc9512ed8dd8a0ed8fab6bec1aea3ae9314f04da","observation_id":"26a1e29f-cc54-4e23-92df-211cbde78ee0","resolution":{"observed_at":"2026-08-07T15:44:35.885737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:35.505475Z","title":"o rg Schl \\","venue":null,"work_id":"1e2a185b-073c-42ac-9bea-81472139725c","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.696386Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:f4beb2db20b9bff7b7b0dd0b13ffbdfd7e102a203f5e233391138f1c00bee31e","observation_id":"c1b0b121-01e2-4bd5-aac0-1e849049c49e","resolution":{"observed_at":"2026-08-07T15:44:35.626161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:28.804745Z","title":"o rg Schl \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.804745Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:92987b901cc1292f156ca1471ed6b7729c97c87b8c68d7b59f4a2ef42db2b38f","observation_id":"486c2ae8-00d4-41b9-89a5-34263a8594c1","resolution":{"observed_at":"2026-08-07T15:44:28.804745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:44:28.900244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.900244Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:9e8edc73a59d2062ac12d5bc392f7c3fcc0d07cdefc883e9ef8f572109d0b4d0","observation_id":"b4933804-24fb-4fbf-8316-58d2a8644657","resolution":{"observed_at":"2026-08-07T15:44:28.900244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-emnlp.306","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:31.336597Z","title":null,"venue":null,"work_id":"c579ac99-0735-45bc-9b02-cee755198495","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.994748Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d932b1bd559e57a885ff81040518a9d7c9114f1d731b358b96c33df5aad3c4b4","observation_id":"af6cf771-22be-4748-8787-37cac2b2425a","resolution":{"observed_at":"2026-08-07T15:44:31.447121Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.085098Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.085098Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:afe0a3e5471e09691094f02bc4017bdce637a628e4a715771c84036c31b55b46","observation_id":"82ec1ccd-cc26-484e-ba3c-7125d2f6a1f3","resolution":{"observed_at":"2026-08-07T15:44:29.085098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.236695Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.236695Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:6b18cf1731eb9eebeb39efb70f8e1a5338d512b4e0f80968fa98ac40f9ff5e4e","observation_id":"16614cd7-9449-4205-b7a3-8ff8858f5041","resolution":{"observed_at":"2026-08-07T15:44:29.236695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.354746Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.354746Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:fea3f44c839af3152fa32426d2d7bc117d10d8e4736e297a34f0f84ed4d8300f","observation_id":"c66d15c2-8c8d-463c-94d2-158f024682d0","resolution":{"observed_at":"2026-08-07T15:44:29.354746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11830","last_updated":"2025-02-17T14:25:54Z","snapshot_observed_at":"2026-08-07T18:12:22.280387Z","submitted_at":"2025-02-17T14:25:54Z","title":"Text Classification in the LLM Era -- Where do we stand?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11830","snapshot_observed_at":"2026-08-07T15:44:29.464953Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.464953Z"},"links":{"cited_paper":"/paper/2502.11830","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:63a7a5557efefa04aed34c4306df2749ba788465824f00f2459f12d019b0f902","observation_id":"dba62b38-02ae-4262-9393-235e83889d6a","resolution":{"observed_at":"2026-08-07T15:44:29.464953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.hcinlp-1.9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.964480Z","title":null,"venue":null,"work_id":"b5e33cea-638e-4a31-bc16-d3d178520d54","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.564834Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:1c061a81db07f93f6fd9c5f7656c880f368b074c15e704af9a12dd8688ed1b67","observation_id":"731fe4f2-593d-4e92-a1d4-25975a6519c1","resolution":{"observed_at":"2026-08-07T15:44:31.092070Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00777","last_updated":"2025-05-28T15:18:07Z","snapshot_observed_at":"2026-08-06T08:34:49.129704Z","submitted_at":"2025-01-01T09:00:10Z","title":"FitCF: A Framework for Automatic Feature Importance-guided Counterfactual Example Generation","version":3},"cited_work":{"arxiv_id":"2501.00777","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00777","snapshot_observed_at":"2026-08-07T15:44:33.533795Z","title":"FitCF: A Framework for Automatic Feature Importance-guided Counterfactual Example Generation","venue":"cs.CL","work_id":"d599e176-b016-4db9-92e8-c040b53f2585","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.684825Z"},"links":{"cited_paper":"/paper/2501.00777","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:f2fb52079e831d9d75ae3bd9ab4728741c324f8975e9d59eaebd1c02517d11a4","observation_id":"6397cb28-4e40-4d5b-a9d6-ca31560ef29f","resolution":{"observed_at":"2026-08-07T15:44:33.641915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.765292Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.765292Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:6f9e76783b038291fc552aa000c4f95cb84cd901b24f09be7440528e03dc717f","observation_id":"19508210-7d82-4a4a-9420-83a7bf1da4ff","resolution":{"observed_at":"2026-08-07T15:44:29.765292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.523","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.698062Z","title":null,"venue":null,"work_id":"fb57e993-a153-4d13-9a88-c6dc96587e1a","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.915421Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d4d87103fd50ca1c9ce5aa65ed54b9137034994221778b92d67d9c6114bcfb05","observation_id":"17e3b136-49ab-40e2-9eee-3141a776c9cb","resolution":{"observed_at":"2026-08-07T15:44:30.787790Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.023875Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.023875Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:6d156e132721f45dea3878a077c979ec36fdb13ddd8a70a7892a0bec8b2db2bb","observation_id":"a0e27e0f-4ef5-4a0e-a53b-3228ffd9b74a","resolution":{"observed_at":"2026-08-07T15:44:30.023875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.124745Z","title":"Hedderich, Fangzhou Zhai, David Ifeoluwa Adelani, and Dietrich Klakow","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.124745Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:09804d6b1f019807045528f41313bbd6e2f574425857804ce058005cdf957c6b","observation_id":"f771dca3-1144-4307-86df-76a604f22cd0","resolution":{"observed_at":"2026-08-07T15:44:30.124745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.255876Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.255876Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:76516191bff20f10c879272ebf3ecccd34427995420206727c3ec4b993f1d341","observation_id":"579fd5d3-a216-4301-9e5c-09af59736928","resolution":{"observed_at":"2026-08-07T15:44:30.255876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.355862Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.355862Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:c1e2f411acf95844f468c45845a26072ce810deb4680ac1a0a92716633209d81","observation_id":"a8f8babd-db04-427c-8d59-44abe76985ea","resolution":{"observed_at":"2026-08-07T15:44:30.355862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:41:34.675832Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":10,"verified_fuzzy":1},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2505.13972."}