{"as_of":"2026-08-07T22:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0efb283e075df9047803846fa16718cf924dd451f0a7129f22378d3fd530efd","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:21:43.077882Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02726/citation-record","integrity":"/paper/2506.02726/integrity","json":"/paper/2506.02726/citation-record.json","paper":"/paper/2506.02726"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:47.649687Z","title":"Large language models: A survey of their development, capabilities, and applications.Knowledge and Information Systems, pages 1–56, 2024","venue":null,"work_id":"0f788742-66d3-4eac-a8f6-43a1cefa2835","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:38.818556Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:0154f40a796c25fac48c8ea073cc8f2353bfc7d7102db33ccfacc4ee68f0a5eb","observation_id":"35378862-893b-4597-b95b-05288e3f5877","resolution":{"observed_at":"2026-08-07T11:21:47.731516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:38.860198Z","title":"Nlp for social good: A survey of challenges, opportunities, and responsible deployment.arXiv preprint arXiv:2505.22327, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:38.860198Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b98cc9807d8c3d069e5e1a4fcd764d8f7d5962fc59d1150647bc4bcc6eb61291","observation_id":"d7bbc86f-e931-45c9-8953-57ef7582e0ec","resolution":{"observed_at":"2026-08-07T11:21:38.860198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:47.380462Z","title":"Current applications and challenges in large language models for patient care: a systematic review.Communications Medicine, 5(1):26, 2025","venue":null,"work_id":"b003895a-f20b-4d3f-9cf5-43989302afca","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:38.949163Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:a03ce9c3c95988d832d399255b1fd6fb23eb5ca5da20c8baf967d3b2c9e15d33","observation_id":"bb19e456-97f4-405b-aae1-7bae18f537a2","resolution":{"observed_at":"2026-08-07T11:21:47.478778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04040","last_updated":"2025-02-09T08:00:36Z","snapshot_observed_at":"2026-07-06T20:17:47.599899Z","submitted_at":"2025-01-03T21:04:49Z","title":"A Survey on Large Language Models with some Insights on their Capabilities and Limitations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04040","snapshot_observed_at":"2026-08-07T11:21:39.055557Z","title":"A survey on large language models with some insights on their capabilities and limitations.arXiv preprint arXiv:2501.04040, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.055557Z"},"links":{"cited_paper":"/paper/2501.04040","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:c7b29bbf0147436bfedacda3a3814ee7cc2cc170f8f75755ecb5f8851b67d8a0","observation_id":"57b394cb-018e-46af-be82-05bfc3318205","resolution":{"observed_at":"2026-08-07T11:21:39.055557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.094280Z","title":"Direct preference optimization: Your language model is secretly a reward model.Advances in Neural Information Processing Systems, 36:53728–53741, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.094280Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:2ff735be8c28202dab33ff40ffffd6ecc6641487524394f3c0af6cdeb10ca438","observation_id":"44ab70e2-1c85-4c56-a568-e9ce0a935689","resolution":{"observed_at":"2026-08-07T11:21:39.094280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10400","last_updated":"2025-02-24T08:57:10Z","snapshot_observed_at":"2026-08-07T21:53:28.691375Z","submitted_at":"2024-12-05T16:10:42Z","title":"Reinforcement Learning Enhanced LLMs: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10400","snapshot_observed_at":"2026-08-07T11:21:39.153862Z","title":"Reinforcement learning enhanced llms: A survey.arXiv preprint arXiv:2412.10400, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.153862Z"},"links":{"cited_paper":"/paper/2412.10400","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:7a3060c9f11f1326ba8a29741a6e78009ea4546c87d2d76940b1a50ba49eac10","observation_id":"74c35b06-33bc-4769-a41d-ee2412b33a4e","resolution":{"observed_at":"2026-08-07T11:21:39.153862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00125","last_updated":"2025-03-31T18:19:41Z","snapshot_observed_at":"2026-08-07T16:19:31.140226Z","submitted_at":"2025-03-31T18:19:41Z","title":"LLMs for Explainable AI: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00125","snapshot_observed_at":"2026-08-07T11:21:39.242160Z","title":"Llms for explainable ai: A comprehensive survey.arXiv preprint arXiv:2504.00125, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.242160Z"},"links":{"cited_paper":"/paper/2504.00125","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:bc3cc4a7f44584c0097033cbe3635ad9eb3fbfcc5f2fdbad0fec74b7b8d0579b","observation_id":"a381681a-455a-4ea2-9fb1-fabb69e82004","resolution":{"observed_at":"2026-08-07T11:21:39.242160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:47.221341Z","title":"Explainability for large language models: A survey.ACM Transactions on Intelligent Systems and Technology, 15(2):1–38, 2024","venue":null,"work_id":"57667dfc-150b-4df3-b3ad-4abc0c468016","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.392138Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:744a48910ac7a1952fdf91ace8f94acbed7272d2d372754641b8ea20c53399c2","observation_id":"ba7746db-7ab2-49c0-9c0d-d2fe3e7f91eb","resolution":{"observed_at":"2026-08-07T11:21:47.331458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.447414Z","title":"Understand what llm needs: Dual preference alignment for retrieval-augmented generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.447414Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b3d85329f55648876cebd6b57f70d02a6be1791be20c01b83f2c87f98f3668f2","observation_id":"ab4988a7-bbac-49a4-8d43-ae72784b60c7","resolution":{"observed_at":"2026-08-07T11:21:39.447414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.545398Z","title":"Chain of preference optimization: Improving chain-of-thought reasoning in llms.Advances in Neural Information Processing Systems, 37:333–356, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.545398Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:882bf8e6563af5f838afa37997fb83105ac7274b893947487c48223e5c72f4cc","observation_id":"4f2b9230-9f4f-41fa-b65c-682f64177050","resolution":{"observed_at":"2026-08-07T11:21:39.545398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15280","last_updated":"2024-12-18T04:08:18Z","snapshot_observed_at":"2026-07-06T20:10:29.099784Z","submitted_at":"2024-12-18T04:08:18Z","title":"Context-DPO: Aligning Language Models for Context-Faithfulness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15280","snapshot_observed_at":"2026-08-07T11:21:39.613828Z","title":"Context-dpo: Aligning language models for context-faithfulness.arXiv preprint arXiv:2412.15280, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.613828Z"},"links":{"cited_paper":"/paper/2412.15280","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f231598012776e0da5c52e13ab69a3613d4daffebe11240eed6efe0ea5095d33","observation_id":"5faf9fb3-54ce-4de8-99ab-631bf7637757","resolution":{"observed_at":"2026-08-07T11:21:39.613828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14510","last_updated":"2024-12-19T04:18:51Z","snapshot_observed_at":"2026-07-06T20:09:42.677491Z","submitted_at":"2024-12-19T04:18:51Z","title":"PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization","version":1},"cited_work":{"arxiv_id":"2412.14510","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14510","snapshot_observed_at":"2026-08-07T11:21:44.107793Z","title":"PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization","venue":"cs.CL","work_id":"c59ca83a-383f-4bac-b7ba-c6a2bad503b1","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.749604Z"},"links":{"cited_paper":"/paper/2412.14510","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:8dbc70fa73cf713ae247880790cf0b598679cfd63f5c67ab002b0e7511f64558","observation_id":"bb9969f1-74a8-4879-9709-705b98e488d6","resolution":{"observed_at":"2026-08-07T11:21:44.178173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.999577Z","title":"Knowpo: Knowledge-aware preference optimization for controllable knowledge selection in retrieval- augmented language models","venue":null,"work_id":"3c53244f-0eb3-4274-b030-f13628e51a39","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.821944Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:61f29be10ef3d88768d874798aff26752c106abd17ebedfb38584f4ded417e32","observation_id":"26010888-1271-453c-9889-bb799a52a1a3","resolution":{"observed_at":"2026-08-07T11:21:47.090260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.897385Z","title":"Iterative reasoning preference optimization.Advances in Neural Information Processing Systems, 37:116617–116637, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.897385Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:50653d9892189074e522ec4dd00da0f75c7c475bb57a9568ac62602ff9c6bf1e","observation_id":"9d28fa35-cf80-4ed3-9bc1-053bd929396d","resolution":{"observed_at":"2026-08-07T11:21:39.897385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18248","last_updated":"2024-07-25T17:59:16Z","snapshot_observed_at":"2026-08-05T00:01:46.859793Z","submitted_at":"2024-07-25T17:59:16Z","title":"Self-Training with Direct Preference Optimization Improves Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18248","snapshot_observed_at":"2026-08-07T11:21:40.015790Z","title":"Self-training with direct preference optimization improves chain-of- thought reasoning.arXiv preprint arXiv:2407.18248, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.015790Z"},"links":{"cited_paper":"/paper/2407.18248","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:87a1e3e3b676c6f1e0e51ecfb241696a7c0a07b3391e3d5a0ee9e56c4a0ba0eb","observation_id":"903b4620-bbfa-4740-b989-c9aa6a4f3c2d","resolution":{"observed_at":"2026-08-07T11:21:40.015790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11181","last_updated":"2024-03-27T13:51:04Z","snapshot_observed_at":"2026-08-04T02:45:57.365745Z","submitted_at":"2024-03-17T11:55:35Z","title":"Solving Maxwell's Equations","version":2},"cited_work":{"arxiv_id":"2403.11181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11181","snapshot_observed_at":"2026-08-07T11:21:43.912022Z","title":"Solving Maxwell's Equations","venue":"physics.gen-ph","work_id":"5a38dd42-be6e-4080-a172-389ea39a1607","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.090748Z"},"links":{"cited_paper":"/paper/2403.11181","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:dac133ffe07d750b110c55c72c7e3bf3d7076fd60d26a6a9b674f46eefdc5743","observation_id":"a6cab298-93e4-432d-a3cd-31d582c665e6","resolution":{"observed_at":"2026-08-07T11:21:44.000302Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10677","last_updated":"2026-07-20T09:35:34Z","snapshot_observed_at":"2026-08-07T17:14:35.447258Z","submitted_at":"2025-03-11T01:59:35Z","title":"A Survey on Knowledge-Oriented Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10677","snapshot_observed_at":"2026-08-07T11:21:40.158290Z","title":"A survey on knowledge-oriented retrieval-augmented generation.arXiv preprint arXiv:2503.10677, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.158290Z"},"links":{"cited_paper":"/paper/2503.10677","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:929bbf6c536484e91b8c8efb6d9726ad71ac0b6bb2bc3dcaefcc9b82fd55cab9","observation_id":"a9a06361-e0ee-4ac3-abe2-d72c8f9d7519","resolution":{"observed_at":"2026-08-07T11:21:40.158290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:40.284051Z","title":"Chain-of-thought prompting elicits reasoning in large language models.Advances in neural information processing systems, 35:24824–24837, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.284051Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:e0ab26125884aa620e995f3a806e2096763fdf965708d8299cd2140002a6722b","observation_id":"23df82cc-59c2-4a25-bebe-450afeb4def6","resolution":{"observed_at":"2026-08-07T11:21:40.284051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06072","last_updated":"2025-08-01T01:52:05Z","snapshot_observed_at":"2026-08-07T17:20:39.665338Z","submitted_at":"2025-03-08T05:41:42Z","title":"A Survey on Post-training of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06072","snapshot_observed_at":"2026-08-07T11:21:40.383980Z","title":"A survey on post-training of large language models.arXiv preprint arXiv:2503.06072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.383980Z"},"links":{"cited_paper":"/paper/2503.06072","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:3fb632cfc32bfdff133af91b4b261b201b94c9f251fae6a49233ff25f840d012","observation_id":"fa508398-e9cd-4894-bbe0-055d2e765f73","resolution":{"observed_at":"2026-08-07T11:21:40.383980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17003","last_updated":"2025-05-05T01:21:53Z","snapshot_observed_at":"2026-08-07T16:47:00.977896Z","submitted_at":"2025-03-21T10:09:16Z","title":"A Survey on Personalized Alignment -- The Missing Piece for Large Language Models in Real-World Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17003","snapshot_observed_at":"2026-08-07T11:21:40.479121Z","title":"A survey on personalized alignment–the missing piece for large language models in real-world applications.arXiv preprint arXiv:2503.17003, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.479121Z"},"links":{"cited_paper":"/paper/2503.17003","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:c17871982f5840cf5ad0fff81f8fee7c337d42afcef473e2300d433596393787","observation_id":"fdf48b54-8869-47c6-bf9a-03f922f803a9","resolution":{"observed_at":"2026-08-07T11:21:40.479121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10391","last_updated":"2025-02-14T18:59:51Z","snapshot_observed_at":"2026-08-07T18:16:55.312662Z","submitted_at":"2025-02-14T18:59:51Z","title":"MM-RLHF: The Next Step Forward in Multimodal LLM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10391","snapshot_observed_at":"2026-08-07T11:21:40.615790Z","title":"Mm-rlhf: The next step forward in multimodal llm alignment.arXiv preprint arXiv:2502.10391, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.615790Z"},"links":{"cited_paper":"/paper/2502.10391","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f5764a784f49ae78d992b1421720b23d3f01130d5487aeb41aae57638185d0bb","observation_id":"9b0ec985-fb2e-429e-bbeb-c23793eb36c8","resolution":{"observed_at":"2026-08-07T11:21:40.615790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18252","last_updated":"2025-04-26T08:33:32Z","snapshot_observed_at":"2026-08-07T20:55:15.330079Z","submitted_at":"2024-10-23T19:59:50Z","title":"Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18252","snapshot_observed_at":"2026-08-07T11:21:40.684605Z","title":"Asynchronous rlhf: Faster and more efficient off-policy rl for language models.arXiv preprint arXiv:2410.18252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.684605Z"},"links":{"cited_paper":"/paper/2410.18252","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:6a45a0c953fc7d223e0298e82e95493fe44c47f172257e054a0e70046b051cc1","observation_id":"0204eac1-f9af-4dc2-881c-4b43e76c53fe","resolution":{"observed_at":"2026-08-07T11:21:40.684605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08617","last_updated":"2025-06-10T03:19:33Z","snapshot_observed_at":"2026-07-06T20:21:18.369732Z","submitted_at":"2025-01-15T06:33:15Z","title":"RLHS: Mitigating Misalignment in RLHF with Hindsight Simulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08617","snapshot_observed_at":"2026-08-07T11:21:40.801007Z","title":"Rlhs: Mitigating misalign- ment in rlhf with hindsight simulation.arXiv preprint arXiv:2501.08617, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.801007Z"},"links":{"cited_paper":"/paper/2501.08617","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:897c7a6e122bf6a0800fbd37bd2028a905367e9d22b5af7f37fde67cfa8b982f","observation_id":"0434a918-f900-4b85-946d-c03d54180b4b","resolution":{"observed_at":"2026-08-07T11:21:40.801007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-07T11:21:40.927940Z","title":"Reinforce++: A simple and efficient approach for aligning large language models.arXiv preprint arXiv:2501.03262, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.927940Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:edd0587022392345720977a11e4e1ad725aaf25221287e7685a826034334d34d","observation_id":"82e0992e-7473-4faf-b2b3-07506c9ccda4","resolution":{"observed_at":"2026-08-07T11:21:40.927940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21046","last_updated":"2024-05-31T17:39:06Z","snapshot_observed_at":"2026-07-31T03:29:04.443362Z","submitted_at":"2024-05-31T17:39:06Z","title":"Exploratory Preference Optimization: Harnessing Implicit Q*-Approximation for Sample-Efficient RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21046","snapshot_observed_at":"2026-08-07T11:21:41.016055Z","title":"Exploratory preference optimization: Harnessing implicit q*-approximation for sample-efficient rlhf.arXiv preprint arXiv:2405.21046, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.016055Z"},"links":{"cited_paper":"/paper/2405.21046","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:898c1ee255b477d71124cce1bd35c8ec1f4a50f95d1aa27295dd6f4c627eeb74","observation_id":"12271706-1c52-45c2-9b33-393f1be2538e","resolution":{"observed_at":"2026-08-07T11:21:41.016055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.649162Z","title":null,"venue":null,"work_id":"c5c4df00-713a-4f90-bef1-9230ea872e89","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.058198Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:0f3ca7c71f1c12d92546cbac482dc75f981f15595abb5d79f9ff6efcbfb804cf","observation_id":"fad7e606-d01f-4894-84a3-b0e44b075c91","resolution":{"observed_at":"2026-08-07T11:21:46.854469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08685","last_updated":"2024-03-31T22:42:03Z","snapshot_observed_at":"2026-08-06T10:32:27.614964Z","submitted_at":"2023-11-15T04:22:22Z","title":"Safer-Instruct: Aligning Language Models with Automated Preference Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08685","snapshot_observed_at":"2026-08-07T11:21:41.130792Z","title":"Safer-instruct: Aligning language models with automated preference data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.130792Z"},"links":{"cited_paper":"/paper/2311.08685","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:1a03c12ef22b8e20087157e4896bbaeda8713e44adce08c5d348880f96e261b0","observation_id":"bbe81107-5f30-4627-ad40-7fa6c65256cc","resolution":{"observed_at":"2026-08-07T11:21:41.130792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06961","last_updated":"2024-10-09T14:57:31Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:57:31Z","title":"Self-Boosting Large Language Models with Synthetic Preference Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06961","snapshot_observed_at":"2026-08-07T11:21:41.210733Z","title":"Self-boosting large language models with synthetic preference data.arXiv preprint arXiv:2410.06961, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.210733Z"},"links":{"cited_paper":"/paper/2410.06961","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:01511136a416a32e632b833729fc4d00c939a63072998b061adc213de886e48b","observation_id":"710738de-a91c-4664-8a43-71f3c1dc08e5","resolution":{"observed_at":"2026-08-07T11:21:41.210733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.422316Z","title":"A comprehensive review of large language models: issues and solutions in learning environments.Discover Sustainability, 6(1):27, 2025","venue":null,"work_id":"fa9f9a7d-447f-4441-897f-959ced31aa22","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.269690Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f6f39fb8e350da98f101434f17273bbabb780e11efef92e55d86b2c4bbe2611c","observation_id":"a28d5641-84b1-4e89-a0e7-5e53d514116e","resolution":{"observed_at":"2026-08-07T11:21:46.524500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T11:21:41.322841Z","title":"Constitutional ai: Harmlessness from ai feedback.arXiv preprint arXiv:2212.08073, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.322841Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b4f55242b3c3ee582e1bab70d39169afc6d091601cfbe0ed6c7bcf0bccd7d7f5","observation_id":"148f7fa5-3df2-48f8-93f9-b611bc3a5f75","resolution":{"observed_at":"2026-08-07T11:21:41.322841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.221836Z","title":"Zhang and J","venue":null,"work_id":"5ede79df-ce0f-450d-b67b-f5eeaeb3a0c7","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.393033Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:30b9996a316a384c0189e6848fdc0c2ce408cdb3a6c5b0b5098f3a4974e7c7a5","observation_id":"cdf321d2-69d2-4864-8466-81151cfdede6","resolution":{"observed_at":"2026-08-07T11:21:46.337621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T11:21:41.484804Z","title":"Retrieval-augmented generation for large language models: A survey.arXiv preprint arXiv:2312.10997, 2(1), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.484804Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:d7c410210c344b9e208e834a12fe50e931612743456ebb85f11c538cef496d0a","observation_id":"3535564f-345b-4253-9118-ffd667784e46","resolution":{"observed_at":"2026-08-07T11:21:41.484804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.937748Z","title":null,"venue":null,"work_id":"c9267f30-1e84-489d-90d4-e3d1a3c81396","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.550399Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:4875ba62d9aa9eec773434990ef20d7a53e620ba97b75427ca7950179ba1e2ee","observation_id":"f5a0a599-c7ff-48f5-93b9-bc6aa98de06c","resolution":{"observed_at":"2026-08-07T11:21:46.013978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.803929Z","title":"Wang and Y","venue":null,"work_id":"5cce84ca-fc0b-4d67-9886-75f3a6a6fbdd","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.601069Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:45d7928b6d94552356befee66b608f6bee5afe60c04d89deb5eac94f00ec4e01","observation_id":"4a09417b-8f90-4f45-8b86-de503559f55b","resolution":{"observed_at":"2026-08-07T11:21:45.870818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.651250Z","title":"Feng and L","venue":null,"work_id":"359a381e-81ec-419e-ad52-b3a31dbc1284","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.653470Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:00b2201aaefb8a6cdf83b799103e1cd328c9ad4383f4dbd0ade8881c4daeb822","observation_id":"a92a8db8-8f5d-4ba3-9e81-588b0fa43f84","resolution":{"observed_at":"2026-08-07T11:21:45.725340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00309","last_updated":"2025-01-08T05:16:25Z","snapshot_observed_at":"2026-08-07T12:37:34.294206Z","submitted_at":"2024-12-31T06:59:35Z","title":"Retrieval-Augmented Generation with Graphs (GraphRAG)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00309","snapshot_observed_at":"2026-08-07T11:21:41.722040Z","title":"Retrieval-augmented generation with graphs (graphrag)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.722040Z"},"links":{"cited_paper":"/paper/2501.00309","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:7a5e19edf48449666cb39518f7ed0c4ae452a4809cce1fc61d03ac1d7cb550cd","observation_id":"aedea759-c1d4-422f-bc74-d0649ca28f24","resolution":{"observed_at":"2026-08-07T11:21:41.722040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04736","last_updated":"2025-04-28T01:20:59Z","snapshot_observed_at":"2026-08-07T16:08:06.094939Z","submitted_at":"2025-04-07T05:20:58Z","title":"Synthetic Data Generation & Multi-Step RL for Reasoning & Tool Use","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04736","snapshot_observed_at":"2026-08-07T11:21:41.804315Z","title":"Synthetic data generation & multi-step rl for reasoning & tool use.arXiv preprint arXiv:2504.04736, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.804315Z"},"links":{"cited_paper":"/paper/2504.04736","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:1b1ef40b49706e5ab18fa858e0f69f53b56127cc6acecbcfd7f6815234c02a16","observation_id":"a8369b8b-1fca-444f-92c3-4f022cc3f304","resolution":{"observed_at":"2026-08-07T11:21:41.804315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.478737Z","title":"Enhancing chain of thought prompting in large language models via reasoning patterns","venue":null,"work_id":"bbf16a09-aa9f-40d2-af79-aa3ca80a2572","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.874814Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:15b35aab0abcfc749277b661d644f393c0be9b0669242b4d8fa66ec0a5e4be77","observation_id":"a465f5ba-829c-4790-8c3e-56fc59df58af","resolution":{"observed_at":"2026-08-07T11:21:45.550033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08633","last_updated":"2025-03-11T14:26:41Z","snapshot_observed_at":"2026-07-06T19:31:40.352383Z","submitted_at":"2024-10-11T08:55:17Z","title":"Transformers Provably Solve Parity Efficiently with Chain of Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08633","snapshot_observed_at":"2026-08-07T11:21:41.931755Z","title":"Transformers provably solve parity efficiently with chain of thought.arXiv preprint arXiv:2410.08633, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.931755Z"},"links":{"cited_paper":"/paper/2410.08633","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:af0b7f46e17fd1cedfb17def58e91482a0aca7855e85317eca6cedd76ed3f6e0","observation_id":"09bcebd1-1f60-478e-90b7-79b246d1c87f","resolution":{"observed_at":"2026-08-07T11:21:41.931755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-07T17:49:06.764625Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-07T11:21:41.999082Z","title":"Chain of draft: Thinking faster by writing less.arXiv preprint arXiv:2502.18600, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.999082Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:7cb1de2b0e698e6d4f50dd6590efa8b6817d31e398f36d7609f9497ce93ea17e","observation_id":"43ec6d05-cebe-4146-a919-e602bba05855","resolution":{"observed_at":"2026-08-07T11:21:41.999082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:42.046502Z","title":"Tool learning with large language models: A survey.Frontiers of Computer Science, 19(8):198343, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.046502Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:17e8efb528963634d46b8e0363f36d9aba2b0603a4d8b8603752b374d187412a","observation_id":"4f1fe121-7f15-46fa-906c-5d85df9b3985","resolution":{"observed_at":"2026-08-07T11:21:42.046502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02144","last_updated":"2023-09-05T11:32:48Z","snapshot_observed_at":"2026-07-06T16:14:26.899440Z","submitted_at":"2023-09-05T11:32:48Z","title":"Making Large Language Models Better Reasoners with Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02144","snapshot_observed_at":"2026-08-07T11:21:42.079243Z","title":"Making large language models better reasoners with alignment.arXiv preprint arXiv:2309.02144, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.079243Z"},"links":{"cited_paper":"/paper/2309.02144","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:0ec94c9e90cb23bf492317aa7a10ff97ef79c08b986695bbc91ec42cae064d08","observation_id":"b3030e9e-68e9-480a-9bf1-70470f0c9d15","resolution":{"observed_at":"2026-08-07T11:21:42.079243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16061","last_updated":"2025-02-04T20:29:39Z","snapshot_observed_at":"2026-07-06T18:35:35.687129Z","submitted_at":"2024-06-23T09:51:06Z","title":"PORT: Preference Optimization on Reasoning Traces","version":2},"cited_work":{"arxiv_id":"2406.16061","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16061","snapshot_observed_at":"2026-08-07T11:21:43.557177Z","title":"PORT: Preference Optimization on Reasoning Traces","venue":"cs.LG","work_id":"c1c2c4e3-2cc8-4305-a79d-8a63d2b01552","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.154602Z"},"links":{"cited_paper":"/paper/2406.16061","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:61fc1bcebee331031d4932d8ec213668f4a029e5cb9cb3f3e212a8ce118f5e25","observation_id":"e9913d1b-478a-4d3d-b1c3-a4700efdfbb5","resolution":{"observed_at":"2026-08-07T11:21:43.674287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15676","last_updated":"2025-02-05T22:01:59Z","snapshot_observed_at":"2026-08-07T05:02:10.975472Z","submitted_at":"2024-04-24T06:12:00Z","title":"Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15676","snapshot_observed_at":"2026-08-07T11:21:42.204519Z","title":"Beyond chain-of-thought: A survey of chain-of-x paradigms for llms.arXiv preprint arXiv:2404.15676, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.204519Z"},"links":{"cited_paper":"/paper/2404.15676","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:175ace60e9cf1139d0022049f0fb85f7a375d16dbb0bb2f688a5629bb081cb71","observation_id":"e709ee68-ea43-4f99-907c-ab3a2df57a1d","resolution":{"observed_at":"2026-08-07T11:21:42.204519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.281086Z","title":"Preference tree optimization: Enhancing goal- oriented dialogue with look-ahead simulations","venue":null,"work_id":"ecf2591c-5f59-4121-a5f4-6601fd144485","year":null},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.271188Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:86fbc2dab6586b9c2e6bc15762a1bfe6fc58e38f3232c535d5cbb744e1100f7e","observation_id":"22ae8ed5-37c1-4c8a-95fe-75f8c167d131","resolution":{"observed_at":"2026-08-07T11:21:45.372913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.129946Z","title":"Large language models in traditional chinese medicine: A scoping review.Journal of Evidence-Based Medicine, 18(1):e12658, 2025","venue":null,"work_id":"374da69a-e4ac-4e25-bf15-84cc8e3d2dac","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.326058Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:0a3a52b885d7a7dddeaa9ac8e66c77b51d333796396b6ac937be1ea2fa88c04b","observation_id":"f98649cf-13d2-4964-9fa3-e4f9334cfae4","resolution":{"observed_at":"2026-08-07T11:21:45.203522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.981352Z","title":"Tcmchat: A generative large language model for traditional chinese medicine.Pharmacological Research, 210:107530, 2024","venue":null,"work_id":"64aa5e8b-018f-4314-9841-16ff0de7dcff","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.411645Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:5dcf85f0643ca589f78e5ed549181baca0e63c020758691bcbda6666aaf62b64","observation_id":"06d4c3d7-50f9-45b8-aae0-cfddaa4ce002","resolution":{"observed_at":"2026-08-07T11:21:45.046715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.11027","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:43.295106Z","title":"Biancang: A traditional chinese medicine large language model.arXiv preprint arXiv:2411.11027, 2024","venue":null,"work_id":"eb60e979-a486-4429-a94f-3140655456cf","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.480389Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:9691d030dd08bc4787f29873fab1eb636ee3e0a5e6c9c578e5a3ea6a20d91c8a","observation_id":"e99d14b3-39d3-4263-8b86-4882bb6c85ab","resolution":{"observed_at":"2026-08-07T11:21:43.446236Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16056","last_updated":"2024-06-22T05:43:53Z","snapshot_observed_at":"2026-08-02T04:12:30.238373Z","submitted_at":"2024-03-24T07:48:05Z","title":"Qibo: A Large Language Model for Traditional Chinese Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16056","snapshot_observed_at":"2026-08-07T11:21:42.548438Z","title":"Qibo: A large language model for traditional chinese medicine.arXiv preprint arXiv:2403.16056, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.548438Z"},"links":{"cited_paper":"/paper/2403.16056","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:fbbcf5874cb7d2691cd08007e6f128344961738560f77fd1463633713ec67178","observation_id":"17d4fd0d-80d0-4afe-b56d-8bcd6eb95937","resolution":{"observed_at":"2026-08-07T11:21:42.548438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.862710Z","title":"Ai-powered lawyering: Ai reasoning models, retrieval augmented generation, and the future of legal practice","venue":null,"work_id":"bf1cd7bb-0dcf-4430-92e0-5adff4139e75","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.619817Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:293c03bd54e59767cee8417d12e9a61e568321c1fbf131fd740bcd4388c2b040","observation_id":"2ea30630-77fc-4016-a820-90eff300a36a","resolution":{"observed_at":"2026-08-07T11:21:44.913465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.720112Z","title":"A comprehensive review on financial explainable ai.Artificial Intelligence Review, 58(6):1–49, 2025","venue":null,"work_id":"cc182a14-2d4c-4eb1-a088-962dfd5ebbc6","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.699536Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:28888f5d8539a26edb81cc2fb14a839726dfc937366149ad05cde557f58ce104","observation_id":"645540cd-f7b2-4593-be27-28e96ffafad7","resolution":{"observed_at":"2026-08-07T11:21:44.785971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.541665Z","title":"Findings of the association for computational linguistics: Eacl 2024","venue":null,"work_id":"a0981011-779b-43ea-a514-dfd33143b786","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.746394Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:8fe45891723840b8980e843bf33a86d2e2779729bb109bb3b5371348c0346d16","observation_id":"0595f1a3-41d5-4292-913c-e2cba6ba271f","resolution":{"observed_at":"2026-08-07T11:21:44.608922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14860","last_updated":"2025-08-11T03:23:40Z","snapshot_observed_at":"2026-08-07T18:00:56.637289Z","submitted_at":"2025-02-20T18:59:31Z","title":"ALFA: Aligning LLMs to Ask Good Questions A Case Study in Clinical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14860","snapshot_observed_at":"2026-08-07T11:21:42.818394Z","title":"Aligning llms to ask good questions a case study in clinical reasoning.arXiv preprint arXiv:2502.14860, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.818394Z"},"links":{"cited_paper":"/paper/2502.14860","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:8d87c34e7202c12aee01aa89ff90ba5ceda14e2d258f61496c76629cae3b42b0","observation_id":"673dff5e-42c1-4845-97dc-2fade4c69f74","resolution":{"observed_at":"2026-08-07T11:21:42.818394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.380657Z","title":"Shennong-tcm: A traditional chinese medicine large language model","venue":null,"work_id":"aee021bc-3be5-4608-869d-7b443b464fcb","year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.914094Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:5758a1da5e693b8746803f9b4a27ce5b95096c47ec33811dd8acf0952bb46f03","observation_id":"6dfbdf6e-383e-4290-b84e-a2609ada25ee","resolution":{"observed_at":"2026-08-07T11:21:44.433484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:42.986811Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.986811Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f156368c2cb78d00ef15d9a50ea6081531d955b686c7a9a9e5ce997611b93323","observation_id":"aada8a85-a2e7-412f-bb92-483f6a257300","resolution":{"observed_at":"2026-08-07T11:21:42.986811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:43.077882Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:43.077882Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:82911ea85d605ca65982a4c27c59bb6d9e80cc917d47ffe77e2b6bd61ec03af7","observation_id":"5f72547f-2c79-4385-95ec-873c5c2c23f2","resolution":{"observed_at":"2026-08-07T11:21:43.077882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:55:54.876475Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":36,"verified_exact":3,"verified_fuzzy":16},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2506.02726."}