{"as_of":"2026-08-08T20:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15f6c0f9ea890400dcf5c5593c90eb9a9580a8d2e53e0b90115fa2458f0066b2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:34:50.298845Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:49:38.206304Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-08-07T15:34:50.298845Z","title":"Atla selene mini: A general purpose evaluation model.arXiv preprint arXiv:2501.17195, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14674","last_updated":"2025-05-20T17:58:03Z","snapshot_observed_at":"2026-08-07T23:14:31.982740Z","submitted_at":"2025-05-20T17:58:03Z","title":"Reward Reasoning Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:50.298845Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2505.14674"},"observation_digest":"sha256:ef7be815a331f91f9f517a6cb4d67711d84c873192017de70e46f14623b6d7ba","observation_id":"10d6e181-a23c-4326-a1ea-b681e34819c8","resolution":{"observed_at":"2026-08-07T15:34:50.298845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-08-07T13:20:16.293260Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22169","last_updated":"2025-09-13T18:08:05Z","snapshot_observed_at":"2026-08-07T13:11:08.846003Z","submitted_at":"2025-05-28T09:40:48Z","title":"ReliableEval: A Recipe for Stochastic LLM Evaluation via Method of Moments","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:20:16.293260Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2505.22169"},"observation_digest":"sha256:751b6688c3f57eb5bbf8dace4530f5c11c92ee6c52db85920d7070408917d6c6","observation_id":"473fb600-3bd8-4f37-939b-d734da71ea0f","resolution":{"observed_at":"2026-08-07T13:20:16.293260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":"2501.17195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-07-04T06:49:38.206304Z","title":"org/abs/2501.17195","venue":null,"work_id":"aa04d32f-16fd-4993-8e2b-b48afbc9dfa7","year":2025},"citing_paper":{"arxiv_id":"2510.24235","last_updated":"2026-04-20T06:29:42Z","snapshot_observed_at":"2026-08-03T23:17:37.743021Z","submitted_at":"2025-10-28T09:43:47Z","title":"PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T03:15:57.744706Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2510.24235"},"observation_digest":"sha256:604fdf2d714af3405c9303d6964a8d452c77aaf244cb9a30d2d7338483a2886d","observation_id":"b21ac2cc-0103-47d7-a5f5-69cad4632d49","resolution":{"observed_at":"2026-05-18T03:20:49.325679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-08-03T03:04:43.002417Z","title":"Atla selene mini: A general purpose evaluation model.arXiv preprint arXiv:2501.17195,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-08T13:06:41.126177Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.002417Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:1d8a02a12bfcb932672e68f19c767742021b309f776af8b50bfc3593233c6afe","observation_id":"186743ae-0d1a-452e-8e87-9a8674819b32","resolution":{"observed_at":"2026-08-03T03:04:43.002417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-08-04T05:56:17.811091Z","title":"Alexandru, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08091","last_updated":"2026-08-01T14:08:22Z","snapshot_observed_at":"2026-08-08T10:13:23.268703Z","submitted_at":"2026-03-09T08:32:21Z","title":"Toward Robust LLM-Based Judges: Taxonomic Bias Evaluation and Debiasing Optimization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T05:56:17.811091Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2603.08091"},"observation_digest":"sha256:b4fe49856e6ba0cdcf3c49044a9223ba76d389ee7eec94c96eef7a1e6fc5e314","observation_id":"633b275c-4d7e-406b-9fe7-66f5b8e3a17a","resolution":{"observed_at":"2026-08-04T05:56:17.811091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":"2501.17195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-07-04T06:49:38.206304Z","title":"org/abs/2501.17195","venue":null,"work_id":"aa04d32f-16fd-4993-8e2b-b48afbc9dfa7","year":2025},"citing_paper":{"arxiv_id":"2604.12312","last_updated":"2026-04-14T05:42:41Z","snapshot_observed_at":"2026-08-02T05:56:57.097541Z","submitted_at":"2026-04-14T05:42:41Z","title":"CompliBench: Benchmarking LLM Judges for Compliance Violation Detection in Dialogue Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T14:56:00.449776Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2604.12312"},"observation_digest":"sha256:2327eab467be264d8806b6997b8f4161d5edf8170aac21bf271474d139061152","observation_id":"8646f0f6-5d56-4f6d-8d75-6de409b7d501","resolution":{"observed_at":"2026-05-11T11:26:02.445512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":"2501.17195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-07-04T06:49:38.206304Z","title":"org/abs/2501.17195","venue":null,"work_id":"aa04d32f-16fd-4993-8e2b-b48afbc9dfa7","year":2025},"citing_paper":{"arxiv_id":"2605.11334","last_updated":"2026-05-11T23:39:19Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T23:39:19Z","title":"VERDI: Single-Call Confidence Estimation for Verification-Based LLM Judges via Decomposed Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T01:48:29.633350Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2605.11334"},"observation_digest":"sha256:3fc61f97152eb54ba3eae61ef6fdb57a8a94eafc419520c4e0411fe0df5b6a20","observation_id":"2c34bab5-fb6a-464f-8d10-984958b188a9","resolution":{"observed_at":"2026-05-13T01:52:05.633574Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":"2501.17195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-07-04T06:49:38.206304Z","title":"org/abs/2501.17195","venue":null,"work_id":"aa04d32f-16fd-4993-8e2b-b48afbc9dfa7","year":2025},"citing_paper":{"arxiv_id":"2606.01034","last_updated":"2026-05-31T05:50:27Z","snapshot_observed_at":"2026-08-04T18:54:04.912017Z","submitted_at":"2026-05-31T05:50:27Z","title":"A Finite-Calibration Regime Map for LLM Judge Panels","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T17:34:28.258222Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2606.01034"},"observation_digest":"sha256:e1d49f11d175ec8bae2b5155cd1cb84a57e1d621849b4519d79078b6901f6f7a","observation_id":"2d4c3f1a-13ab-4a46-ba7c-0ad48e2eb519","resolution":{"observed_at":"2026-07-01T21:06:13.157300Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":"2501.17195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-07-04T06:49:38.206304Z","title":"org/abs/2501.17195","venue":null,"work_id":"aa04d32f-16fd-4993-8e2b-b48afbc9dfa7","year":2025},"citing_paper":{"arxiv_id":"2606.03128","last_updated":"2026-06-02T04:13:43Z","snapshot_observed_at":"2026-07-06T23:43:27.226603Z","submitted_at":"2026-06-02T04:13:43Z","title":"Decoupled Smart Contract Audits: Lightweight LLM Framework via Distillation and Aggregation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T09:58:30.611774Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2606.03128"},"observation_digest":"sha256:cf4834418079c7984d157c224ac25ebd3158ac000480330edb4b676bd27d3c2f","observation_id":"b61684d5-7b12-4020-adf8-8846be308705","resolution":{"observed_at":"2026-07-02T03:26:29.997093Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":"2501.17195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-07-04T06:49:38.206304Z","title":"org/abs/2501.17195","venue":null,"work_id":"aa04d32f-16fd-4993-8e2b-b48afbc9dfa7","year":2025},"citing_paper":{"arxiv_id":"2606.21627","last_updated":"2026-06-19T17:30:56Z","snapshot_observed_at":"2026-08-07T08:25:40.894867Z","submitted_at":"2026-06-19T17:30:56Z","title":"Counsel: A Meta-Evaluation Dataset for Agentic Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-26T14:07:59.446478Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2606.21627"},"observation_digest":"sha256:88caed37d464b1eda33bf7b8d48d618dedfbbc3310cd3b570df4a3e858bdc584","observation_id":"a097e6de-8e70-4f5b-b512-32b3998d4134","resolution":{"observed_at":"2026-07-04T06:49:38.208141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-08-01T19:02:46.756858Z","title":"arXiv preprint arXiv:2501.17195 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17117","last_updated":"2026-07-19T08:07:32Z","snapshot_observed_at":"2026-08-06T16:41:28.805563Z","submitted_at":"2026-07-19T08:07:32Z","title":"Persistent Sparse Autoencoders: Learning Feature Timescales in Language Models","version":1},"reference_index":167,"source":"arxiv_source","source_observed_at":"2026-08-01T19:02:46.756858Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2607.17117"},"observation_digest":"sha256:601c16aa3cbe0abda5d1e34f8b4c933534a90ae9c521f776e4771cd4daa99645","observation_id":"69427740-b102-4ced-8a95-6852b925c18c","resolution":{"observed_at":"2026-08-01T19:02:46.756858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17195","snapshot_observed_at":"2026-08-03T17:29:12.599582Z","title":"arXiv preprint arXiv:2501.17195 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28908","last_updated":"2026-07-31T00:15:32Z","snapshot_observed_at":"2026-08-07T21:53:39.024507Z","submitted_at":"2026-07-31T00:15:32Z","title":"Reflection or Re-Generation? Why LLM Revision Fails Where Human Revision Succeeds","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T17:29:12.599582Z"},"links":{"cited_paper":"/paper/2501.17195","citing_paper":"/paper/2607.28908"},"observation_digest":"sha256:099958293f799aefff72bc921846490c2a55e1584fcd79a53eeb5a3e7d8c192f","observation_id":"1072ece7-ec15-493e-843c-e6c2c3ebaf38","resolution":{"observed_at":"2026-08-03T17:29:12.599582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.17195/citation-record","integrity":"/paper/2501.17195/integrity","json":"/paper/2501.17195/citation-record.json","paper":"/paper/2501.17195"},"outbound":[],"paper":{"arxiv_id":"2501.17195","last_updated":"2025-01-27T15:09:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T15:43:50.298757Z","submitted_at":"2025-01-27T15:09:08Z","title":"Atla Selene Mini: A General Purpose Evaluation Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2501.17195."}