{"as_of":"2026-08-07T22:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:732698ea07538cbdc699aea945b4572db86f585a675b5a141ff92212de349b8d","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T04:43:04.740925Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:01:22.131040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T23:16:36.698169Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"cited_work":{"arxiv_id":"2606.15127","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.15127","snapshot_observed_at":"2026-07-09T23:16:36.698169Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","venue":"cs.LG","work_id":"30b7acc0-54dc-48e5-8d85-81f2d4e3cebc","year":2026},"citing_paper":{"arxiv_id":"2607.06913","last_updated":"2026-07-08T02:04:47Z","snapshot_observed_at":"2026-08-07T15:18:13.525880Z","submitted_at":"2026-07-08T02:04:47Z","title":"Evaluating LLM Robustness Under Domain-Specific Prompt Perturbations in Public Health Applications","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-09T23:07:45.392658Z"},"links":{"cited_paper":"/paper/2606.15127","citing_paper":"/paper/2607.06913"},"observation_digest":"sha256:ec6ca7690557822e6674c9839aeed919165b4946363dd2acf90d420f3e1612ed","observation_id":"49ae5f4f-492d-4d08-86d6-394f5243dc46","resolution":{"observed_at":"2026-07-09T23:16:36.700008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.15127","snapshot_observed_at":"2026-08-02T07:01:22.131040Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-06T18:28:05.554022Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.131040Z"},"links":{"cited_paper":"/paper/2606.15127","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:d4b7cc7295529eefd5eff1e37596da24c1d3e4b5451dc42a63a036fe35888869","observation_id":"6c8c60fb-bb4c-4cbc-bdd1-5eb025eeb94b","resolution":{"observed_at":"2026-08-02T07:01:22.131040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.15127","snapshot_observed_at":"2026-08-01T15:03:42.817118Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21635","last_updated":"2026-07-20T23:14:36Z","snapshot_observed_at":"2026-08-05T00:41:56.304371Z","submitted_at":"2026-07-20T23:14:36Z","title":"Toward User-Conditioned Evaluation of Personal LLM Agents under Temporal Interventions","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:42.817118Z"},"links":{"cited_paper":"/paper/2606.15127","citing_paper":"/paper/2607.21635"},"observation_digest":"sha256:66586a57c30468ca98463bbc31159802b7bf219a391d834a1a9d6467e3fed4b9","observation_id":"c7e7b098-61eb-4a79-b54e-45e114912c23","resolution":{"observed_at":"2026-08-01T15:03:42.817118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.15127/citation-record","integrity":"/paper/2606.15127/integrity","json":"/paper/2606.15127/citation-record.json","paper":"/paper/2606.15127"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.08679","last_updated":"2026-06-16T17:36:22Z","snapshot_observed_at":"2026-08-07T17:12:11.913580Z","submitted_at":"2025-03-11T17:56:30Z","title":"Chain-of-Thought Reasoning In The Wild Is Not Always Faithful","version":6},"cited_work":{"arxiv_id":"2503.08679","doi":"10.48550/arxiv.2503.08679","metadata_source":"pith","pith_arxiv_id":"2503.08679","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-thought reasoning in the wild is not always faithful.arXiv preprint:2503.08679","venue":"cs.AI","work_id":"221c289d-ba9c-41b9-a1d6-7ea026fdcc9b","year":2025},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2503.08679","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:eca23550720b7516f879c604f7753ef632bb675bb1326065d4bc8e9a0f05a4f6","observation_id":"447b601f-3e95-4e48-9367-8fbd2feb2c6d","resolution":{"observed_at":"2026-07-03T16:58:43.406916Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":"2505.05410","doi":"10.48550/arxiv.2210.14889","metadata_source":"pith","pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning Models Don't Always Say What They Think","venue":"cs.CL","work_id":"b9bdcbf5-9ae0-464c-b1a6-de04f85a6e33","year":2025},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:a22c5f31cb0cb3d3c4fe4d6d304cf7b4fcd09d6d5076c1c6adba9434782c99b2","observation_id":"60250f88-3172-43ba-bf75-dd6341c2c6f1","resolution":{"observed_at":"2026-07-03T16:58:43.404342Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.14473","last_updated":"2026-07-19T02:26:21Z","snapshot_observed_at":"2026-08-02T14:06:25.310847Z","submitted_at":"2026-05-14T07:14:19Z","title":"Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict","version":4},"cited_work":{"arxiv_id":"2605.14473","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.14473","snapshot_observed_at":"2026-07-04T10:09:45.258813Z","title":"Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict","venue":"cs.CL","work_id":"2187cd94-259c-4274-aa22-32288fe2848a","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2605.14473","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:8d9ec9b34117e75914da2926e01203ae881c014eee3914a577daff4146d20078","observation_id":"0c74a992-f189-46c3-9fa2-7788131d90d3","resolution":{"observed_at":"2026-07-03T16:58:43.432751Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04982","last_updated":"2026-04-04T23:13:55Z","snapshot_observed_at":"2026-08-02T14:39:32.415726Z","submitted_at":"2026-04-04T23:13:55Z","title":"CURE:Circuit-Aware Unlearning for LLM-based Recommendation","version":1},"cited_work":{"arxiv_id":"2604.04982","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04982","snapshot_observed_at":"2026-07-03T19:58:54.907266Z","title":"CURE:Circuit-Aware Unlearning for LLM-based Recommendation","venue":"cs.IR","work_id":"af4639fa-2f2b-437c-9825-b6490a1888cc","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2604.04982","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:d4234fcc123ae579eb4213f340df0b02d85407d4b67fe5bbc13bc73c8194699d","observation_id":"ef290be6-4202-4db5-98df-be8aaead5094","resolution":{"observed_at":"2026-07-03T16:58:43.429997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05113","last_updated":"2026-04-06T19:18:24Z","snapshot_observed_at":"2026-07-06T22:53:55.926521Z","submitted_at":"2026-04-06T19:18:24Z","title":"CRAB: Codebook Rebalancing for Bias Mitigation in Generative Recommendation","version":1},"cited_work":{"arxiv_id":"2604.05113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05113","snapshot_observed_at":"2026-07-04T01:39:24.179069Z","title":"CRAB: Codebook Rebalancing for Bias Mitigation in Generative Recommendation","venue":"cs.IR","work_id":"2be9bcdc-02eb-423d-bc9d-75f931aece60","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2604.05113","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:73852d626422db63eb6c2424c24b07c349a72f234b281cb8d4a50c60cf6ff2cf","observation_id":"7fee1767-a400-4a05-b1de-dc869ce1bc54","resolution":{"observed_at":"2026-07-03T16:58:43.418529Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-01576-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., Li, Z., Wu, X., Visweswaran, S., and Wang, Y","venue":"npj Digital Medicine","work_id":"cb6238d2-a345-41eb-9ce8-48ecffdabf29","year":2025},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:dd4f50da86331ceccc5b236e872f1dfeb38e2a48349d27990aeb1759e34dc967","observation_id":"233b53d9-2659-49c3-b08a-20235ea4514c","resolution":{"observed_at":"2026-06-27T04:50:34.964469Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2307.13702","doi":"10.48550/arxiv.2307.13702","metadata_source":"pith","pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","venue":"cs.AI","work_id":"86ca07b8-4628-4f51-8938-a82683386ae4","year":2023},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:dcaaa23deae8a42c119fdf34c7916322d45dcac7a6574e2b32e01b9697708c28","observation_id":"6d52b44d-ad2f-44b9-8289-36360c2938c1","resolution":{"observed_at":"2026-07-03T16:58:43.434936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:58:43.414237Z","title":"Lin, J., Zhu, C., Kneuertz, P","venue":null,"work_id":"a931ac85-10fd-4fe8-9d11-57a50d876cd2","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:d3925f43b23af218af85d5c4c3881576338085f5f9cc015974203bc10e631f51","observation_id":"f66aff0b-e9f9-4bcf-93bb-4d35cf604577","resolution":{"observed_at":"2026-07-03T16:58:43.415736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24834","last_updated":"2026-05-24T02:58:21Z","snapshot_observed_at":"2026-07-06T23:34:52.129354Z","submitted_at":"2026-05-24T02:58:21Z","title":"Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection","version":1},"cited_work":{"arxiv_id":"2605.24834","doi":"10.48550/arxiv.2605.24834","metadata_source":"pith","pith_arxiv_id":"2605.24834","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection","venue":"cs.CR","work_id":"cf2801c8-a21b-4a7d-a8ab-de98697d9ed9","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2605.24834","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:95236e9741eb14b274e4f1a0df632c97d3d9113c07f1ce8fc1ba46e5cdfa1bcf","observation_id":"fc5f91cc-f1de-4cc8-9eec-600b4abba7f4","resolution":{"observed_at":"2026-06-27T04:50:34.962781Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17814","last_updated":"2025-02-24T08:49:32Z","snapshot_observed_at":"2026-08-07T03:21:47.052030Z","submitted_at":"2024-05-28T04:18:00Z","title":"FAIntbench: A Holistic and Precise Benchmark for Bias Evaluation in Text-to-Image Models","version":6},"cited_work":{"arxiv_id":"2405.17814","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17814","snapshot_observed_at":"2026-07-04T09:49:44.554563Z","title":"Faintbench: A holistic and precise benchmark for bias evaluation in text-to-image models","venue":null,"work_id":"88fae054-3ab7-42db-9446-9bde0ae49897","year":2024},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2405.17814","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:2116dfa292b47710c673486f1ec7af284e1e23060ce48ee0b6ec90419d4ea207","observation_id":"a61174eb-32e5-4925-bd92-5d5fe7ea1178","resolution":{"observed_at":"2026-07-03T16:58:43.418981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22645","last_updated":"2026-05-21T15:51:53Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T15:51:53Z","title":"AtelierEval: Agentic Evaluation of Humans & LLMs as Text-to-Image Prompters","version":1},"cited_work":{"arxiv_id":"2605.22645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.22645","snapshot_observed_at":"2026-07-03T16:58:43.411605Z","title":"AtelierEval: Agentic Evaluation of Humans & LLMs as Text-to-Image Prompters","venue":"cs.AI","work_id":"bbb32672-380a-479f-a5c2-334f798b582e","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2605.22645","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:13790225a2ab97bcd235c44c8031393bf0766c0a1dc0a11137d38673d1eb99f4","observation_id":"9f2226b5-0f54-4c49-b3a4-2a2b8140b0df","resolution":{"observed_at":"2026-07-03T16:58:43.413110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28044","last_updated":"2026-05-27T06:47:44Z","snapshot_observed_at":"2026-08-02T08:36:06.431400Z","submitted_at":"2026-05-27T06:47:44Z","title":"Relevant Is Not Warranted: Evidence-Force Calibration for Cited RAG","version":1},"cited_work":{"arxiv_id":"2605.28044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.28044","snapshot_observed_at":"2026-07-04T10:09:45.225000Z","title":"Relevant Is Not Warranted: Evidence-Force Calibration for Cited RAG","venue":"cs.AI","work_id":"70371c7e-dffb-487e-9e5d-fa6a2518a5e0","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2605.28044","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:6e70492df392df91e2ed83d12f61e7294c4070c20747ae9f2900d1ad521cb278","observation_id":"2207baad-4d7e-4fea-b47f-2ace7c490240","resolution":{"observed_at":"2026-07-03T16:58:43.427689Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00448","last_updated":"2026-05-30T00:38:07Z","snapshot_observed_at":"2026-08-03T06:02:54.207055Z","submitted_at":"2026-05-30T00:38:07Z","title":"When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems","version":1},"cited_work":{"arxiv_id":"2606.00448","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.00448","snapshot_observed_at":"2026-07-04T10:09:45.211621Z","title":"When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems","venue":"cs.SE","work_id":"3cd65b99-61c3-419f-8484-a601ae482784","year":2026},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"cited_paper":"/paper/2606.00448","citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:167c8950d0942d98a8d823da8e77c3e94ca2a3241514ddcbec1d47f41bbd4f01","observation_id":"123b41f0-d534-434c-a872-d8e802ff5717","resolution":{"observed_at":"2026-07-03T16:58:43.426521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.15126","doi":"10.48550/arxiv.2508.15126","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2508.15126 , year =","venue":"ArXiv.org","work_id":"6b2c43e6-1999-4a89-aa18-57937ea56c15","year":2025},"citing_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T04:43:04.740925Z"},"links":{"citing_paper":"/paper/2606.15127"},"observation_digest":"sha256:bc3818162e8d8f41f53bf2e5ff545f599e6e6dbca20b9a53e8bf1c4709b90a92","observation_id":"236ea5ec-cb9c-41e6-ae8a-ce87bd908d21","resolution":{"observed_at":"2026-07-03T16:58:43.429126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:52:32.998232Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":10,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 3 inbound Pith citation observations for arXiv:2606.15127."}