{"as_of":"2026-08-08T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64f3688734078d8a498f1ed7382334ba1a8a0a60a7cbb4f20534c00f2e3eda2f","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:08:24.025435Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T06:07:56.678339Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T06:07:56.725173Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"cited_work":{"arxiv_id":"2506.11702","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11702","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"316ca89f-27a1-4c6c-a497-bcaedece3b05","year":2025},"citing_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T06:07:56.678339Z"},"links":{"cited_paper":"/paper/2506.11702","citing_paper":"/paper/2507.17746"},"observation_digest":"sha256:89c8df6d1a4ba5d74db6f6174c8d8ad62f537eb9db3c8217de17b792ac726b65","observation_id":"8a0c8d06-ac9e-429e-b579-c3010d897804","resolution":{"observed_at":"2026-05-13T06:07:56.727853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11702/citation-record","integrity":"/paper/2506.11702/integrity","json":"/paper/2506.11702/citation-record.json","paper":"/paper/2506.11702"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:22.631282Z","title":"Capturing individual human preferences with reward features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.631282Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:96141c5752cf669a71f36ae115a9afa431788dc39e8ca3d52a2d54074b439121","observation_id":"fd1a6f39-fad6-4acd-a5d5-36d4b9480030","resolution":{"observed_at":"2026-08-07T04:08:22.631282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.770239Z","title":null,"venue":null,"work_id":"323db410-4253-40b1-9b87-cdfce8eccec6","year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.685509Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:fa7e036f6fc68d3028debdc761f7fd812341508757ca71f30e424310984ffc1d","observation_id":"7b00e3ae-83ac-4a6e-acc9-2dc96bb05dec","resolution":{"observed_at":"2026-08-07T04:08:24.867958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:22.746721Z","title":"F., Leike, J., Brown, T., Martic, M., Legg, S., and Amodei, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.746721Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:c2961170d1380d8ea53255287c6da88230edd7810696f18a1ef0e4eb1eba313b","observation_id":"ffb9cda2-e3fd-44f3-8acc-ea522c25303a","resolution":{"observed_at":"2026-08-07T04:08:22.746721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10271","last_updated":"2024-06-04T14:34:38Z","snapshot_observed_at":"2026-07-06T18:00:44.208590Z","submitted_at":"2024-04-16T03:59:33Z","title":"Social Choice Should Guide AI Alignment in Dealing with Diverse Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10271","snapshot_observed_at":"2026-08-07T04:08:22.822573Z","title":"H., Jacobs, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.822573Z"},"links":{"cited_paper":"/paper/2404.10271","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:6d975246d46bb862ba540a26ecc7319287ddd688ddeb40bb319969e2b072ca01","observation_id":"7292b80e-0ade-4f5b-a99e-d3c212b35550","resolution":{"observed_at":"2026-08-07T04:08:22.822573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14115","last_updated":"2024-01-10T16:11:32Z","snapshot_observed_at":"2026-07-06T16:51:40.320710Z","submitted_at":"2023-11-23T17:20:36Z","title":"A density estimation perspective on learning from pairwise human preferences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14115","snapshot_observed_at":"2026-08-07T04:08:22.959105Z","title":"D., Castro, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.959105Z"},"links":{"cited_paper":"/paper/2311.14115","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:e6a2350b07ed32b141138501b2bde19af5463b268712b608dc6ae84f04267f3a","observation_id":"6394af7c-b335-4c7c-ab7a-a383bf119ab1","resolution":{"observed_at":"2026-08-07T04:08:22.959105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00495","last_updated":"2024-03-30T23:28:05Z","snapshot_observed_at":"2026-07-06T17:53:31.221833Z","submitted_at":"2024-03-30T23:28:05Z","title":"Configurable Safety Tuning of Language Models with Synthetic Preference Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00495","snapshot_observed_at":"2026-08-07T04:08:23.120937Z","title":"Configurable safety tuning of language models with synthetic preference data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.120937Z"},"links":{"cited_paper":"/paper/2404.00495","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:40239586aff05038405f2de5a06c52bf76e9d069b6718abdb7a9f9a980f05b32","observation_id":"86609ba3-3c2f-4935-abe2-e03dc5dfaf64","resolution":{"observed_at":"2026-08-07T04:08:23.120937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13011","last_updated":"2024-03-14T18:07:10Z","snapshot_observed_at":"2026-07-06T16:35:48.413898Z","submitted_at":"2023-10-17T01:31:59Z","title":"Compositional preference models for aligning LMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13011","snapshot_observed_at":"2026-08-07T04:08:23.227133Z","title":"Compositional preference models for aligning lms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.227133Z"},"links":{"cited_paper":"/paper/2310.13011","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:76e1207711d499cfb8bf1eecce766dd16c1c25b4947b04e12a83c0bc8f8b4f6d","observation_id":"1134de0f-dba1-486f-b487-568bd8007fec","resolution":{"observed_at":"2026-08-07T04:08:23.227133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T04:08:23.386571Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.386571Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:8290f10b1b9bb82ea11f8b1a15d52edb9f4d5d0d694645316fb6db7b1c57557d","observation_id":"90862026-c584-4346-b76d-f213a5dba549","resolution":{"observed_at":"2026-08-07T04:08:23.386571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:08:23.505047Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.505047Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:09ca3076a551e1543d4d1ccf0e6aa663d970c4b2708c74b241c0fe5000afbede","observation_id":"5c98fe95-afba-4482-a43e-fc947cace56c","resolution":{"observed_at":"2026-08-07T04:08:23.505047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:23.582086Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., Chen, W., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.582086Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:d6fa03020821ba13514940c1aef6ae4ae05bb2e1c001aa0cbba2519b7af9a88f","observation_id":"934cce3c-b197-41e3-8282-22c1b2a20897","resolution":{"observed_at":"2026-08-07T04:08:23.582086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05133","last_updated":"2024-12-09T04:21:08Z","snapshot_observed_at":"2026-08-06T13:42:00.057517Z","submitted_at":"2024-02-06T04:18:58Z","title":"Personalized Language Modeling from Personalized Human Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05133","snapshot_observed_at":"2026-08-07T04:08:23.633018Z","title":"C., and Leqi, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.633018Z"},"links":{"cited_paper":"/paper/2402.05133","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:ce13334ad2870d3b16250dfba29f30d01e9b74f08d0cb7390b6b2d1d54b39253","observation_id":"38151b5c-effe-4c85-a42b-0fce1a8e4579","resolution":{"observed_at":"2026-08-07T04:08:23.633018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.600818Z","title":"Openai o3 mini system card","venue":null,"work_id":"e908b8b8-6be4-4af2-98e4-7b1cf5ef831a","year":2025},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.689062Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:c3cb8b5af8fff8bf2e2fe2ad9b6861d9cc9833b8a62d07966963a9e551fe84cd","observation_id":"57a1a22d-4801-4146-b073-0bf13b4fcd93","resolution":{"observed_at":"2026-08-07T04:08:24.661153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:23.746284Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.746284Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:a7c47557be9646030edcd40789a69de989ed96203f9421b0916699f5b8ed3f1e","observation_id":"621c733d-87c0-4a57-b565-e07379c42986","resolution":{"observed_at":"2026-08-07T04:08:23.746284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-07-06T19:02:56.021845Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-07T04:08:23.797237Z","title":"Personalizing reinforcement learning from human feedback with variational preference learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.797237Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:04f198ff68e498df033afd5d8bf7e520f23be890c043dd844c0c53281a2107ea","observation_id":"8d1d615b-98dc-469c-a8cf-fc480c450fee","resolution":{"observed_at":"2026-08-07T04:08:23.797237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.458798Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":"1adc21f8-57c5-4327-85d9-731a00ba9610","year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.835248Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:dbb93f94e05dd6c0bccdfb37dd54740cfc985ef90bfa83132b2477667ca5b5c6","observation_id":"0c5dfe93-a7e5-4a03-b9fa-e891551e0936","resolution":{"observed_at":"2026-08-07T04:08:24.539135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.316967Z","title":"Self-supervised visual preference alignment","venue":null,"work_id":"b9aecfe3-6d52-4ff0-ab9a-c99dc0d2d933","year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.896721Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:32e78bab3108bf8987ce5c3d2565cf8c79d84767c800b7790f843ffddea307a4","observation_id":"fd46a228-ffb0-4563-9dbb-7d12458f2865","resolution":{"observed_at":"2026-08-07T04:08:24.372980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T04:08:23.959593Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.959593Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:efdfdcad6912de7f811b5fc7d22103f23874907d8b63bfc094562f8b2900f01f","observation_id":"cf0d61f7-e7f2-4304-a64e-5c7d477065ec","resolution":{"observed_at":"2026-08-07T04:08:23.959593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.025435Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:24.025435Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:292e16429bb13e874fa7f01c1bd79f02b4212759eeedc14cdfc3fe6e12ad0eb8","observation_id":"3ba555ae-30fa-448c-a006-99f28a4c1a5a","resolution":{"observed_at":"2026-08-07T04:08:24.025435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T04:01:53.225838Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2506.11702."}