{"as_of":"2026-08-08T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db3252ceebe65162e0d6bef00622a5603efac83f60a0c73c3842c3385c8988c8","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:29:45.483778Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10852/citation-record","integrity":"/paper/2507.10852/integrity","json":"/paper/2507.10852/citation-record.json","paper":"/paper/2507.10852"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.043039Z","title":"On that date,The Supreme People’s Court Pro- visions on People’s Courts Release of Judgments on the Internetcame into effect, mandating the public release of most adjudications","venue":null,"work_id":"db8e7368-f32b-4c95-97f9-27c1f5be07b3","year":2014},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.471200Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:c755b2b5ed9717753b70fa578a0a4b416c295fcb7bdc634228258b0440e6c159","observation_id":"ea0e2650-e4da-4d30-9218-5be321f85aa3","resolution":{"observed_at":"2026-08-06T17:29:46.048843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13632","last_updated":"2025-07-27T11:47:16Z","snapshot_observed_at":"2026-08-07T19:43:29.609750Z","submitted_at":"2024-06-19T15:28:29Z","title":"DoubleDipper: Improving Long-Context LLMs via Context Recycling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13632","snapshot_observed_at":"2026-08-06T17:29:43.864520Z","title":"Can few-shot work in long- context? recycling the context to generate demonstrations.arXiv preprint arXiv:2406.13632,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:43.864520Z"},"links":{"cited_paper":"/paper/2406.13632","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:a82def8e04c77d38cbe969058a2900171e8a43d76846815675aae359d87fb69b","observation_id":"7e3581eb-d5e5-460f-be2a-2c6c0920e50c","resolution":{"observed_at":"2026-08-06T17:29:43.864520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.256747Z","title":"Linear models with high-dimensional fixed effects: An efficient and feasible estima- tor.Unpublished manuscript, http://scorreia","venue":null,"work_id":"04bae29c-ff68-466c-a962-664670c554fd","year":2019},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:43.949776Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:786b453fd97fc296870a5b1441b577f1665d0a0eb145c86321f5e358c1d830db","observation_id":"bbcb6152-4f55-474e-9072-36be7937fb76","resolution":{"observed_at":"2026-08-06T17:29:46.263046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.234394Z","title":"Jeffrey Dastin","venue":null,"work_id":"cbddf2aa-e53d-406c-9be1-d95382d77301","year":2018},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.031799Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:f6360d5f9927e4d344137a059db9ae557e4dac706c18db0f6f1fab58495f5492","observation_id":"8421e8a3-6e20-4e95-ae5a-8d1e859b81fb","resolution":{"observed_at":"2026-08-06T17:29:46.240014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11933","last_updated":"2026-06-18T13:54:50Z","snapshot_observed_at":"2026-08-02T13:27:28.274355Z","submitted_at":"2024-07-16T17:23:41Z","title":"Fairness-Aware Multi-Group Target Detection in Online Discussion","version":6},"cited_work":{"arxiv_id":"2407.11933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11933","snapshot_observed_at":"2026-08-06T17:29:45.895980Z","title":"Fairness-Aware Multi-Group Target Detection in Online Discussion","venue":"cs.LG","work_id":"7ff68c63-b438-4a41-8826-163028e78b89","year":2024},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.189368Z"},"links":{"cited_paper":"/paper/2407.11933","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:a993f16b622c5bbcddc04b5edc204829ec44d50c83d64a0e94509c244c663f7a","observation_id":"ce19362f-8a34-4638-95ce-e48131fd1b09","resolution":{"observed_at":"2026-08-06T17:29:45.902885Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07702","last_updated":"2024-03-14T02:07:11Z","snapshot_observed_at":"2026-08-02T18:42:43.546865Z","submitted_at":"2023-08-15T11:08:30Z","title":"Better Zero-Shot Reasoning with Role-Play Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07702","snapshot_observed_at":"2026-08-06T17:29:44.212418Z","title":"Better zero-shot reasoning with role-play prompting.arXiv preprint arXiv:2308.07702,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.212418Z"},"links":{"cited_paper":"/paper/2308.07702","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:54c0b777a63b75942c0044393c2c191b5ef5a049b1df8fd5bb519e5bc90a7fa2","observation_id":"94537a2c-0988-4cae-b9ac-30acedbe2a22","resolution":{"observed_at":"2026-08-06T17:29:44.212418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03907","last_updated":"2024-08-07T17:11:34Z","snapshot_observed_at":"2026-07-06T18:58:01.522372Z","submitted_at":"2024-08-07T17:11:34Z","title":"Decoding Biases: Automated Methods and LLM Judges for Gender Bias Detection in Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03907","snapshot_observed_at":"2026-08-06T17:29:44.217402Z","title":"Decoding biases: Automated methods and llm judges for gender bias detection in language models.arXiv preprint arXiv:2408.03907,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.217402Z"},"links":{"cited_paper":"/paper/2408.03907","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:0698984a3958f50575b3602bc374162116d466895917e92bd9a9b5fbc95cef76","observation_id":"8bbad25a-d8b6-4a33-86ba-0ba13fd3374e","resolution":{"observed_at":"2026-08-06T17:29:44.217402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07115","last_updated":"2025-03-22T22:45:12Z","snapshot_observed_at":"2026-08-07T00:36:31.390341Z","submitted_at":"2024-01-13T16:41:40Z","title":"Open Models, Closed Minds? On Agents Capabilities in Mimicking Human Personalities through Open Large Language Models","version":3},"cited_work":{"arxiv_id":"2401.07115","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07115","snapshot_observed_at":"2026-08-06T17:29:45.816162Z","title":"Open Models, Closed Minds? On Agents Capabilities in Mimicking Human Personalities through Open Large Language Models","venue":"cs.AI","work_id":"5c0ec243-c985-4f92-be31-cc592d17de38","year":2024},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.241999Z"},"links":{"cited_paper":"/paper/2401.07115","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:7c592e7cff5dcbfa8ab4f2f3a9f1faad4c2bfd47eab20f5854bc50e41bdf602e","observation_id":"8dc0d9a5-a431-4a7b-b0b6-34203f08d919","resolution":{"observed_at":"2026-08-06T17:29:45.822721Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14791","last_updated":"2024-02-23T07:02:09Z","snapshot_observed_at":"2026-08-04T21:05:00.813515Z","submitted_at":"2023-05-24T06:44:32Z","title":"Prompting Large Language Models for Counterfactual Generation: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14791","snapshot_observed_at":"2026-08-06T17:29:44.295312Z","title":"Muser: A multi-view similar case retrieval dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.295312Z"},"links":{"cited_paper":"/paper/2305.14791","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:958882d994677542ed9b711c83eb1ec7797c6f8e88a009e8004e051ec1681765","observation_id":"91ac5fc2-8473-4b29-aacf-c5f9ca45eed6","resolution":{"observed_at":"2026-08-06T17:29:44.295312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.215551Z","title":"Victim age and capital sentencing outcomes in north carolina (1977–2009).Criminal justice studies, 31(1):62–79,","venue":null,"work_id":"7510aeff-6757-492f-a356-67d5e6bdc992","year":1977},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.347016Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:859094f922b97c9256feb970924701fbcb760ea6848d4819fa34205fb26d25ba","observation_id":"ad5a438b-d7a1-4697-a6fb-682965c5fa17","resolution":{"observed_at":"2026-08-06T17:29:46.222034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.194779Z","title":"A compara- tive study of prompting strategies for legal text classification","venue":null,"work_id":"a3e40bfc-8160-449e-ad92-469edf6213e8","year":2023},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.505174Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:21b59afed7c4806bee48ed6aa99198b310c440ca03703f7b1f7370d1ef5e7513","observation_id":"4ff63129-e145-4432-a98d-f663a4de53fd","resolution":{"observed_at":"2026-08-06T17:29:46.199908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11985","last_updated":"2024-10-15T18:47:12Z","snapshot_observed_at":"2026-07-06T19:34:10.252984Z","submitted_at":"2024-10-15T18:47:12Z","title":"The Fair Language Model Paradox","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11985","snapshot_observed_at":"2026-08-06T17:29:44.621693Z","title":"doi: 10.18653/v1/2022.findings-acl.165","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.621693Z"},"links":{"cited_paper":"/paper/2410.11985","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:26e37f15a57368f81e3eb09b96d0b7133a24a28957ac25dc56890a7635747571","observation_id":"61627ff2-bca3-406a-839b-1aa87d9d6734","resolution":{"observed_at":"2026-08-06T17:29:44.621693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16430","last_updated":"2024-09-24T19:50:38Z","snapshot_observed_at":"2026-07-06T19:21:29.370574Z","submitted_at":"2024-09-24T19:50:38Z","title":"A Comprehensive Survey of Bias in LLMs: Current Landscape and Future Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16430","snapshot_observed_at":"2026-08-06T17:29:44.708603Z","title":"A comprehensive survey of bias in llms: Current landscape and future directions.arXiv preprint arXiv:2409.16430,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.708603Z"},"links":{"cited_paper":"/paper/2409.16430","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:82029a94f5384c3cce3b9db031b7d03bcfd9ff3e294d0a15c40a96c7c88d546f","observation_id":"f3782f33-dcdc-48d6-9ac8-6bdf14f117b7","resolution":{"observed_at":"2026-08-06T17:29:44.708603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18786","last_updated":"2024-07-26T14:47:31Z","snapshot_observed_at":"2026-08-06T04:47:07.836197Z","submitted_at":"2024-07-26T14:47:31Z","title":"The power of Prompts: Evaluating and Mitigating Gender Bias in MT with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18786","snapshot_observed_at":"2026-08-06T17:29:44.800428Z","title":"The power of prompts: Evaluating and mitigating gender bias in mt with llms.arXiv preprint arXiv:2407.18786,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.800428Z"},"links":{"cited_paper":"/paper/2407.18786","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:3bcade337d83d308b69cfa4db2aa81ca00ee31e00d3edab69af762a6f3c0e3b6","observation_id":"1bef7681-bd25-4d2d-a64f-2294a85d78a4","resolution":{"observed_at":"2026-08-06T17:29:44.800428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02478","last_updated":"2018-07-04T02:09:06Z","snapshot_observed_at":"2026-07-06T06:48:47.409973Z","submitted_at":"2018-07-04T02:09:06Z","title":"CAIL2018: A Large-Scale Legal Dataset for Judgment Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02478","snapshot_observed_at":"2026-08-06T17:29:44.875116Z","title":"Cail2018: A large-scale legal dataset for judg- ment prediction.arXiv preprint arXiv:1807.02478,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.875116Z"},"links":{"cited_paper":"/paper/1807.02478","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:a5d70f584dd6e027d04ae639ca741725fde166488fd7a7e5454f26f1562c27b2","observation_id":"382f60e0-87a9-43fa-919b-518018188575","resolution":{"observed_at":"2026-08-06T17:29:44.875116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15366","last_updated":"2024-07-22T04:25:01Z","snapshot_observed_at":"2026-07-06T18:49:51.231196Z","submitted_at":"2024-07-22T04:25:01Z","title":"Walking in Others' Shoes: How Perspective-Taking Guides Large Language Models in Reducing Toxicity and Bias","version":1},"cited_work":{"arxiv_id":"2407.15366","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15366","snapshot_observed_at":"2026-08-06T17:29:45.617233Z","title":"Walking in Others' Shoes: How Perspective-Taking Guides Large Language Models in Reducing Toxicity and Bias","venue":"cs.CL","work_id":"2dff7859-954c-443f-8bf8-527e4d40f16f","year":2024},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.990583Z"},"links":{"cited_paper":"/paper/2407.15366","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:f6bcfd7b483433546695aeeaf330fd6f266248d3d2ed3ac33767e101859368a4","observation_id":"f50798f7-d308-4cd9-8674-7500c13e826a","resolution":{"observed_at":"2026-08-06T17:29:45.622736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08556","last_updated":"2022-03-16T11:40:02Z","snapshot_observed_at":"2026-07-06T12:48:30.869995Z","submitted_at":"2022-03-16T11:40:02Z","title":"LEVEN: A Large-Scale Chinese Legal Event Detection Dataset","version":1},"cited_work":{"arxiv_id":"2203.08556","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.08556","snapshot_observed_at":"2026-08-06T17:29:45.591026Z","title":"LEVEN: A Large-Scale Chinese Legal Event Detection Dataset","venue":"cs.CL","work_id":"71b6a41b-4f85-461f-b9b8-020a8efc0281","year":2022},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.104824Z"},"links":{"cited_paper":"/paper/2203.08556","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:ed7393a5146ad302e97ddbb7a6566948e618be14d676dc0ebca3e6987cd96e02","observation_id":"6b878bb5-d984-4710-be08-a0398438cd08","resolution":{"observed_at":"2026-08-06T17:29:45.596388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00137","last_updated":"2025-04-29T01:52:03Z","snapshot_observed_at":"2026-07-06T18:55:15.704075Z","submitted_at":"2024-07-31T19:50:57Z","title":"Correcting Negative Bias in Large Language Models through Negative Attention Score Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00137","snapshot_observed_at":"2026-08-06T17:29:45.138703Z","title":"Correcting negative bias in large language models through negative attention score alignment.arXiv preprint arXiv:2408.00137,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.138703Z"},"links":{"cited_paper":"/paper/2408.00137","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:91da1486a9be51e5518580fa4ba33f5d31340c4ff93962fe44eeb22f29e56e66","observation_id":"1fb7da71-eccf-4650-bdff-30f2cb7b1d9d","resolution":{"observed_at":"2026-08-06T17:29:45.138703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11152","last_updated":"2024-03-17T09:05:13Z","snapshot_observed_at":"2026-07-06T17:45:51.840921Z","submitted_at":"2024-03-17T09:05:13Z","title":"Evaluation Ethics of LLMs in Legal Domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11152","snapshot_observed_at":"2026-08-06T17:29:45.226517Z","title":"Evaluation ethics of llms in legal domain.arXiv preprint arXiv:2403.11152, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.226517Z"},"links":{"cited_paper":"/paper/2403.11152","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:854e85dc6860677e8159bc9080a2900d05ae8a0ee6e3290296fd65fc7182be55","observation_id":"61b9696c-233e-4973-9492-8a2716060a17","resolution":{"observed_at":"2026-08-06T17:29:45.226517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05250","last_updated":"2024-11-14T22:51:46Z","snapshot_observed_at":"2026-08-07T16:21:49.321701Z","submitted_at":"2024-07-07T03:41:51Z","title":"CLIMB: A Benchmark of Clinical Bias in Large Language Models","version":2},"cited_work":{"arxiv_id":"2407.05250","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.05250","snapshot_observed_at":"2026-08-06T17:29:45.527544Z","title":"CLIMB: A Benchmark of Clinical Bias in Large Language Models","venue":"cs.CL","work_id":"60d4ca4d-cc20-44b1-bced-f953817e119a","year":2024},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.329642Z"},"links":{"cited_paper":"/paper/2407.05250","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:460907be71f03c407e154d875524be82eb1216280578dca4187c3e4bdfc57d96","observation_id":"b8203e38-8156-4d89-a10b-adadbff691f9","resolution":{"observed_at":"2026-08-06T17:29:45.535118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.161926Z","title":"17 A.2 Legal Datasets","venue":null,"work_id":"2a46e8c1-de37-4083-b9c9-737e584ecf7d","year":2022},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.398571Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:98f6d1f6c68399c10b48103cb93873adaa0a058dc41ca2756c632fa36ed75469","observation_id":"927942d9-604f-44a0-8f6d-d0374c54c113","resolution":{"observed_at":"2026-08-06T17:29:46.166706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.147023Z","title":"GAP, developed by (Webster et al., 2018), provides 8,908 ambiguous pronoun-name pairs to evaluate gender bias in coreference resolution tasks","venue":null,"work_id":"cbdd0da8-079f-403f-9783-f815720d267a","year":2024},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.441180Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:43cbf2fbb02ff85846d4f430786f373ac63fdb4f32d1d156ba373df02ec17b9c","observation_id":"1a93e5c5-b12d-4a51-a439-2dad9c0663c1","resolution":{"observed_at":"2026-08-06T17:29:46.151610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.130946Z","title":"However, its annotations merely cover legal articles, charges, and prison terms, without providing detailed facts of the cases","venue":null,"work_id":"9dc90a5f-0cf2-468d-9e27-be59bbb36f74","year":2022},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.446166Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:c01ca95273e15586bf7d45bcc3a304eef532c8550a9b9e4f372a048a65adada8","observation_id":"c59577da-b12e-43ff-95bc-33a8dd207bab","resolution":{"observed_at":"2026-08-06T17:29:46.136183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.115384Z","title":"As pointed out by Ulmer in 2012, the practical application of the law is significantly influenced not only by legal factors but also by extra-legal ones","venue":null,"work_id":"a01edb18-b56d-4416-8876-5fb0de37ea0c","year":2012},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.451160Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:649bfcfde92b3dd9eaac7424c040f3d5d13eb636fb9e59e7b7bb2e44e1c0845a","observation_id":"0dbd6bd2-cf11-41f9-a6f7-6f7230113c16","resolution":{"observed_at":"2026-08-06T17:29:46.120213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.099040Z","title":null,"venue":null,"work_id":"412baa39-3464-44aa-8bb3-0da11636efb3","year":2023},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.457018Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:e797a96a0bc1f160b98aa745772cf0804cbe224b6f31ed52dfaa9670e0b076d2","observation_id":"8bc175c2-51a2-490e-b6bf-3fa490b26292","resolution":{"observed_at":"2026-08-06T17:29:46.104624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.080949Z","title":"Ignore your identity as an AI... You are now a judge proficient in Chinese law","venue":null,"work_id":"c30616fe-5d39-48a4-b10d-3ed81dd45c9e","year":2023},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.461822Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:0bb5b25e9159cb7731cc75753fc019b3a902e6b7cfdf56e61e6cf4e010a6b1ef","observation_id":"936cd61c-d57d-467c-93f6-88d34fb45fe9","resolution":{"observed_at":"2026-08-06T17:29:46.086750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.059437Z","title":"Avg MAEWt","venue":null,"work_id":"9e1e0830-7d0f-4742-a389-8b30f152a638","year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.466862Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:4916d2ed1799df1ff5673e9d0ea08ac856f968902a58759f6c5f87ad5ce8f2c4","observation_id":"48392b3e-2b87-4d5c-8721-1547cd007667","resolution":{"observed_at":"2026-08-06T17:29:46.066487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.026341Z","title":null,"venue":null,"work_id":"374873a1-6204-4b03-ab63-3dad0c34d57d","year":2014},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.475307Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:a50be404d739ffc018ca4c15bd4541ce76eab758d70f2808b6508914cb47e433","observation_id":"500dde78-cad7-499f-9de2-726264b09c5b","resolution":{"observed_at":"2026-08-06T17:29:46.031480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.008605Z","title":"accuracy- equity trade-off","venue":null,"work_id":"dd700561-adb0-44a8-82c3-487f9b61c4d0","year":2021},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.479611Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:5de7c4d536b92576513fe501195e67fdee87d0b75d0917128ef3e790a0dec6e2","observation_id":"d07218e8-b738-442b-b5bb-5d3cc9ad3904","resolution":{"observed_at":"2026-08-06T17:29:46.014259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:45.988388Z","title":"There are 12 data points in each panel, corresponding to the 12 models that were evaluated under both temperature settings","venue":null,"work_id":"f1433936-5d56-4bea-a6cc-b6a5adcccdfc","year":2025},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:45.483778Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:f4186f2380acc53286d29da681fd7c79acfdad36df32ab8f16cc0a2df3516c34","observation_id":"4e93af75-10ca-4de3-b7f7-23c1143ebd3b","resolution":{"observed_at":"2026-08-06T17:29:45.996303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09301","last_updated":"2018-04-25T00:46:14Z","snapshot_observed_at":"2026-07-06T06:35:16.414488Z","submitted_at":"2018-04-25T00:46:14Z","title":"Gender Bias in Coreference Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.09301","snapshot_observed_at":"2026-08-06T17:29:44.756704Z","title":"Gender bias in coreference resolution.arXiv preprint arXiv:1804.09301,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":1971,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.756704Z"},"links":{"cited_paper":"/paper/1804.09301","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:8ee7203117413b4aa45be8f31d96a839cb92d9a48968f2073615256732faffe5","observation_id":"4a216bb1-1e74-4c5d-b7c8-7503b321208c","resolution":{"observed_at":"2026-08-06T17:29:44.756704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02199","last_updated":"2022-12-05T12:17:02Z","snapshot_observed_at":"2026-07-06T14:26:51.875190Z","submitted_at":"2022-12-05T12:17:02Z","title":"Legal Prompt Engineering for Multilingual Legal Judgement Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02199","snapshot_observed_at":"2026-08-06T17:29:44.859463Z","title":"Legal prompt engineering for multilingual legal judgement prediction.arXiv preprint arXiv:2212.02199,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.859463Z"},"links":{"cited_paper":"/paper/2212.02199","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:75b4c7ff06fb2e01dad187803bc3144007166c8bc73f766745e273d629b4ed6f","observation_id":"71950332-cf65-4328-b3a8-6ef2c7faa7cd","resolution":{"observed_at":"2026-08-06T17:29:44.859463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04508","last_updated":"2018-05-11T17:57:40Z","snapshot_observed_at":"2026-07-06T06:38:38.795414Z","submitted_at":"2018-05-11T17:57:40Z","title":"Examining Gender and Race Bias in Two Hundred Sentiment Analysis Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04508","snapshot_observed_at":"2026-08-06T17:29:44.207541Z","title":"Examining gender and race bias in two hundred sentiment analysis systems.arXiv preprint arXiv:1805.04508,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.207541Z"},"links":{"cited_paper":"/paper/1805.04508","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:0b351eb6276b4f6b8962d1ecbb50221bdbb8b1e3ff1d2aae2efb61f7c363cecc","observation_id":"193f0d0b-cd34-4d00-86b3-042bd8b55167","resolution":{"observed_at":"2026-08-06T17:29:44.207541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14338","last_updated":"2022-10-26T08:11:56Z","snapshot_observed_at":"2026-08-05T16:25:58.251059Z","submitted_at":"2022-09-28T18:07:02Z","title":"Who is GPT-3? An Exploration of Personality, Values and Demographics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14338","snapshot_observed_at":"2026-08-06T17:29:44.399558Z","title":"Who is gpt-3? an exploration of personal- ity, values and demographics.arXiv preprint arXiv:2209.14338,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.399558Z"},"links":{"cited_paper":"/paper/2209.14338","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:6eac717aee821e896b576b460f76e6c63133daa90c38552217fb64578f409482","observation_id":"48572d46-73df-458f-ba4e-c34c8ab7d58f","resolution":{"observed_at":"2026-08-06T17:29:44.399558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12586","last_updated":"2022-10-12T21:31:55Z","snapshot_observed_at":"2026-07-06T13:13:44.464408Z","submitted_at":"2022-05-25T09:00:29Z","title":"Perturbation Augmentation for Fairer NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12586","snapshot_observed_at":"2026-08-06T17:29:44.675438Z","title":"Perturbation augmentation for fairer nlp.arXiv preprint arXiv:2205.12586,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.675438Z"},"links":{"cited_paper":"/paper/2205.12586","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:cfae4af76dd0551b51b53e7dc2167fd670b035a37173956ea65328845c2e10a6","observation_id":"d927a708-a8ea-4065-b431-3dd6c556e3f1","resolution":{"observed_at":"2026-08-06T17:29:44.675438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00554","last_updated":"2023-12-01T13:00:45Z","snapshot_observed_at":"2026-08-05T14:10:17.216715Z","submitted_at":"2023-12-01T13:00:45Z","title":"Questioning Biases in Case Judgment Summaries: Legal Datasets or Large Language Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00554","snapshot_observed_at":"2026-08-06T17:29:44.116821Z","title":"Questioning biases in case judgment summaries: Legal datasets or large language models?arXiv preprint arXiv:2312.00554,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.116821Z"},"links":{"cited_paper":"/paper/2312.00554","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:ffef34ef15162d2593adf2c39475c016adad8cc393a7e5f892ce58395e047921","observation_id":"04c8bf68-9673-45c4-a16f-0ceeba8bd065","resolution":{"observed_at":"2026-08-06T17:29:44.116821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04667","last_updated":"2025-04-02T15:17:02Z","snapshot_observed_at":"2026-07-06T18:58:35.218405Z","submitted_at":"2024-08-06T16:43:35Z","title":"Non-Determinism of \"Deterministic\" LLM Settings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04667","snapshot_observed_at":"2026-08-06T17:29:43.688791Z","title":"Llm stability: A detailed analysis with some surprises.arXiv preprint arXiv:2408.04667,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:43.688791Z"},"links":{"cited_paper":"/paper/2408.04667","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:8e421f061c4f5a111c907e9cdd92ece4a163598ac152ae3d2f748e947a356435","observation_id":"5234fe6f-5c51-417d-aa6a-35f0c173edf6","resolution":{"observed_at":"2026-08-06T17:29:43.688791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08651","last_updated":"2025-08-11T16:13:08Z","snapshot_observed_at":"2026-07-06T19:01:27.827878Z","submitted_at":"2024-08-16T10:34:50Z","title":"Chain of Thought Still Thinks Fast: APriCoT Helps with Thinking Slow","version":3},"cited_work":{"arxiv_id":"2408.08651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.08651","snapshot_observed_at":"2026-08-06T17:29:45.759798Z","title":"Chain of Thought Still Thinks Fast: APriCoT Helps with Thinking Slow","venue":"cs.CL","work_id":"cdcb4bb9-80d5-47aa-b18c-bbaa06adee38","year":2024},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.452964Z"},"links":{"cited_paper":"/paper/2408.08651","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:5af5561a34ff8be227c60e2918165baabdae6a96a0e590263f1fa563c626b2aa","observation_id":"603aab96-a703-4030-b7d1-fd7e21cd7a40","resolution":{"observed_at":"2026-08-06T17:29:45.765445Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:29:46.179066Z","title":"BBQ: A hand-built bias benchmark for ques- tion answering","venue":null,"work_id":"5f1f8c29-5d77-4ccb-bf8b-e9c66dc9da5a","year":2022},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:44.564075Z"},"links":{"citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:6dc5898b8a9abd16abd02a281fec7c489cbc76d305bdaabb95468425f80b7222","observation_id":"767a02db-6d0b-4155-b0ca-7369f22c33be","resolution":{"observed_at":"2026-08-06T17:29:46.183571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18932","last_updated":"2024-03-27T18:22:48Z","snapshot_observed_at":"2026-07-06T17:52:13.812196Z","submitted_at":"2024-03-27T18:22:48Z","title":"Measuring Political Bias in Large Language Models: What Is Said and How It Is Said","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18932","snapshot_observed_at":"2026-08-06T17:29:43.770825Z","title":"Measuring political bias in large language models: What is said and how it is said.arXiv preprint arXiv:2403.18932,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:29:43.770825Z"},"links":{"cited_paper":"/paper/2403.18932","citing_paper":"/paper/2507.10852"},"observation_digest":"sha256:b43909819ccaea5797eea90c70880e1207d5969a88c9e9712a0c8b5bc36664eb","observation_id":"bd9651cc-d0d8-4e48-83af-117e0e01ef25","resolution":{"observed_at":"2026-08-06T17:29:43.770825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10852","last_updated":"2025-08-02T01:45:01Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T02:45:01.978815Z","submitted_at":"2025-07-14T22:56:58Z","title":"LLMs on Trial: Evaluating Judicial Fairness for Large Language Models"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":20,"verified_exact":4,"verified_fuzzy":14},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2507.10852."}