{"as_of":"2026-08-08T15:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75f52bb240148c043ed3b4c0c2e4a49f9655a4fd013673a2663f536561712bd5","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T07:32:58.404947Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11974/citation-record","integrity":"/paper/2605.11974/integrity","json":"/paper/2605.11974/citation-record.json","paper":"/paper/2605.11974"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:d2de4f4a1a897db52f91ce11b42e6838a4f461ac6a16002f257a7e71b89698cf","observation_id":"0362c18f-461b-491d-9018-31192185d143","resolution":{"observed_at":"2026-05-13T07:37:29.974011Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:9e20b6dee25205e31a8e1e043ca95d8bf0d068e6d7ea7d42a7c267b04030f33c","observation_id":"06e54a4e-ca37-4498-9d21-88d01532a308","resolution":{"observed_at":"2026-05-13T07:37:29.963624Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:9f6a1d3d7f9f5cf3226281e23073b8fad6c8ae97d4f0c4f01e9ea3c53a11bdec","observation_id":"ae8ccd63-c0bc-4c16-9804-15bab25078da","resolution":{"observed_at":"2026-05-13T07:37:29.968523Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 47th international ACM SIGIR conference on research and development in information retrieval , pages=","venue":null,"work_id":"a5f9c721-a5b7-4992-8d56-68136cbe4f06","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:d5f019dd8c15b03a4be99b93bd3939db3d25534dfd82d8741d2daa71fc1d8848","observation_id":"d1d65bf8-1161-4fc0-8ce0-56e0b2fb919f","resolution":{"observed_at":"2026-05-13T08:17:32.323535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the AAAI conference on artificial intelligence , pages=","venue":null,"work_id":"0f61cebb-193f-4a58-a6c2-be0b5ee3c28c","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:27a6df6e95cf724576322daa50ed11599150fe6a9ace2f8bf83a0ea4370f7b70","observation_id":"eee5ce83-11cb-4c95-b8dd-35a5018dc367","resolution":{"observed_at":"2026-05-13T08:17:32.335650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2025 ACM Conference on Fairness, Accountability, and Transparency , pages=","venue":null,"work_id":"841be2aa-9644-41b1-8baa-0332674d6f25","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:234750ab05b9d4d9028de29db114ad738514d149a3a6ab185c2822eb2375dd6e","observation_id":"959e19b4-e66d-497e-93b9-591aa06dbd47","resolution":{"observed_at":"2026-05-13T08:17:32.327706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.17188","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.17188 , year=","venue":null,"work_id":"d669ef64-2a85-4a5f-a899-b6b9ea17b665","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:a285541ae55f95ddedf116a7d030c5b26747d3076e103c9979c2b87f7431ae63","observation_id":"fafc6f86-061f-4ac5-b3ff-97c189fdd996","resolution":{"observed_at":"2026-05-13T07:37:29.957813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 17th ACM International Conference on Web Search and Data Mining , pages=","venue":null,"work_id":"1703020c-cb9d-4b8c-a68e-ef52aaeb9de2","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:c902cdc43bae2990bb8f3635c460c0a47a07692c85e5f246ca608a8bc429a96b","observation_id":"2f94ca3c-12f3-4bfd-a427-0c5ca5b2ec5b","resolution":{"observed_at":"2026-05-13T08:17:32.331615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14431","last_updated":"2025-05-28T06:18:34Z","snapshot_observed_at":"2026-07-06T20:25:31.304367Z","submitted_at":"2025-01-24T11:57:39Z","title":"Domaino1s: Guiding LLM Reasoning for Explainable Answers in High-Stakes Domains","version":2},"cited_work":{"arxiv_id":"2501.14431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14431","snapshot_observed_at":"2026-07-02T16:57:09.922347Z","title":"arXiv preprint arXiv:2501.14431 , year=","venue":null,"work_id":"0272dbf7-750d-49d6-af9f-4793b82a5562","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2501.14431","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:39f7c06f71c5f110a4b3dd8fcb3c9634c9a8da78511693c27a0670a2c9c90ca9","observation_id":"2a949fc7-ad61-42f2-bd1f-849f64e4e844","resolution":{"observed_at":"2026-05-13T07:37:29.985874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Annual Meeting of the Association for Computational Linguistics , year=","venue":null,"work_id":"29f89d66-fa35-48ce-a7ff-21f845eef4ea","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:df6911b909ddf28e9776bdec4382281316cfd8e0a8760482f658656df2356ea2","observation_id":"7c2004d1-4194-45b3-8fb0-c54057773778","resolution":{"observed_at":"2026-05-13T08:17:32.318946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions of the Association for Computational Linguistics , year=","venue":null,"work_id":"907416c6-d4a2-4718-9830-d398091d2716","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:adca68bbaf33629dbb03dcb4eee050f389af8f23916647b30c60a5364d44861b","observation_id":"0185bf1e-103b-4537-89a5-767e8531119e","resolution":{"observed_at":"2026-05-13T08:17:32.312155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"ca01b706-adcb-4dc9-a235-65e664e58583","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:3847e3adffed91c70419d673cf7e4cff80224c35e5d01cfd132e4f786b96dd7f","observation_id":"1ab875a2-f7f7-4d64-8f5e-8f021281e532","resolution":{"observed_at":"2026-05-13T08:17:32.315375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"f1d7e0db-7c1d-473e-a731-319f845da44d","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:daedc6d45e2888cc0bac1bc667d1e3a0af6c8f490b10129b249630be493366a5","observation_id":"8ecd1e62-f088-4899-9c2d-8180c9e85dd6","resolution":{"observed_at":"2026-05-13T08:17:32.303993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16983","last_updated":"2024-10-22T13:05:11Z","snapshot_observed_at":"2026-07-06T19:37:47.763190Z","submitted_at":"2024-10-22T13:05:11Z","title":"Order Matters: Exploring Order Sensitivity in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.16983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16983","snapshot_observed_at":"2026-07-04T20:40:07.562350Z","title":"Order matters: Exploring or- der sensitivity in multimodal large language models","venue":null,"work_id":"6abdd4e1-26e5-4271-8ad3-3f1cea6a0fc4","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2410.16983","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:cfe69750bc71e0fe0c292791791253f05f3184f0db25b648bb9912253a3dbf75","observation_id":"95920722-c4a1-4df3-b8d9-5399024d2278","resolution":{"observed_at":"2026-05-13T07:37:29.979718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"605c94bb-b1d1-439f-8405-6627092714bf","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6a06a0e97aade7130248eee2a19bad9b8ed2d1a6b3010632ff0bd560df5f02d1","observation_id":"04f98399-2412-448f-8d27-a2456fa272a5","resolution":{"observed_at":"2026-05-13T08:17:32.308442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11364","last_updated":"2022-03-21T21:51:43Z","snapshot_observed_at":"2026-07-06T12:50:29.782287Z","submitted_at":"2022-03-21T21:51:43Z","title":"An Information-theoretic Approach to Prompt Engineering Without Ground Truth Labels","version":1},"cited_work":{"arxiv_id":"2203.11364","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.11364","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2203.11364 , year=","venue":null,"work_id":"9a9237f8-f49f-44b2-986d-50e0d9ebb78d","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2203.11364","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:cc044e860d99a9aa9ff8370d17e3ac33d8c5c640944944084256ab32cfd4e79d","observation_id":"c027ac73-8602-49dd-8ff5-a588af6921a9","resolution":{"observed_at":"2026-05-13T07:37:29.991486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Annual Meeting of the Association for Computational Linguistics , year=","venue":null,"work_id":"0f277551-7174-4210-9edb-c6583cfdf8a9","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:54ed2b81373df29da392c0de8e323a88754f36c886f8e927243884399968209f","observation_id":"35476a24-3d20-4d64-8c2f-f1ee1f11bbf5","resolution":{"observed_at":"2026-05-13T08:17:32.241263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"2856b886-a386-45a6-97d2-0335b99c298b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:bd16a8fb786497cdd9b0777cfa678eef68f815c9be0325b9c646745f3ad057ec","observation_id":"1c3fe5e4-05d7-40a0-b807-d2bb03a72065","resolution":{"observed_at":"2026-05-13T08:17:32.270262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"c25ee76e-3828-43bf-874d-6c7c57c45c11","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:bdf7b8941f2a13687619a9efd1ed081f6f57f5a3b548700bcac119e0415a6990","observation_id":"23cfb539-1254-4c46-b3bb-7c27938673dc","resolution":{"observed_at":"2026-05-13T08:17:32.257913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , note =","venue":null,"work_id":"66c1a223-a9de-42e2-8617-8656a90db4d5","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:bdf13adbff55271bedc9a69b4252ed8ae6d612461f77f63b025621cfeca582ac","observation_id":"1cd9193f-6189-4db2-909a-a3b1fd9fbf99","resolution":{"observed_at":"2026-05-13T08:17:32.253722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:31:44.815808Z","title":"ArXiv , year=","venue":null,"work_id":"c4253c11-d5c7-40d6-bf37-fcae9623b44b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e02d7c25f595b536b9f4256f615fda9257b50211341c92ccd65c9df3af004d6a","observation_id":"f091f349-633b-4d69-96d5-c6ec09f55695","resolution":{"observed_at":"2026-05-13T08:17:32.227942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages=","venue":null,"work_id":"df887d76-ebf3-4b09-a3f3-bffdd8975c31","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:52cedb28554fcd92b11dd54cb666331a1ab2019f94bf051fe3eb76ef98c6425b","observation_id":"d7b8a243-be82-4b97-b640-ee808be6c8bc","resolution":{"observed_at":"2026-05-13T08:17:32.223339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the AAAI Symposium Series , number=","venue":null,"work_id":"e465afec-3689-47bd-8569-3231a8651e67","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8f54595d77729291a040c2b2def9d9929b6dbdc973bcf53d7c614bc2d5727efd","observation_id":"39277bbd-3b76-4088-baf2-022cbeaede7b","resolution":{"observed_at":"2026-05-13T08:17:32.274001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"3948bca8-60f9-4a73-b7e3-33a060289813","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:0b75b849dd2ae8e11fae33137dbcebbeb768d43f152cdd5328c51fd48468577d","observation_id":"4c646333-71cf-4841-a174-ab96ca8692e3","resolution":{"observed_at":"2026-05-13T08:17:32.262203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02536","last_updated":"2025-05-23T10:01:57Z","snapshot_observed_at":"2026-08-06T08:12:55.523935Z","submitted_at":"2024-06-04T17:55:38Z","title":"Mitigate Position Bias in Large Language Models via Scaling a Single Dimension","version":3},"cited_work":{"arxiv_id":"2406.02536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02536","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2406.02536 , year=","venue":null,"work_id":"b3fec1b9-3d25-4084-a451-aae2ec524bd4","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2406.02536","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:00732afc5ac39d7739f8a0e50870258aa8d921f54d9753c0cd3c57dacb899b3c","observation_id":"fefbe4fd-a195-47d1-b00c-f0533076146c","resolution":{"observed_at":"2026-05-13T07:37:29.913435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"c16b27c1-3c88-420b-84fd-d61cb49cb535","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:9857c4c11f1bc2e8d6442f2fe6411a33a09a27d59d70850806c877d5b0bd4061","observation_id":"6aa3cdd2-2321-4ec5-a7cf-ae64d63c28de","resolution":{"observed_at":"2026-05-13T08:17:32.291111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03009","last_updated":"2024-06-05T07:16:51Z","snapshot_observed_at":"2026-08-03T17:12:19.082790Z","submitted_at":"2024-06-05T07:16:51Z","title":"Unveiling Selection Biases: Exploring Order and Token Sensitivity in Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.03009","doi":"10.48550/arxiv.2406.03009","metadata_source":"pith","pith_arxiv_id":"2406.03009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2406.03009 , year=","venue":"cs.CL","work_id":"64649f87-b577-455b-9300-5dfe149fbe3e","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2406.03009","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:aff28477f929831370beb444fd91fbf7a7b58fdb5a310376c2906bdf28d0c623","observation_id":"eee701a0-3d6c-46f1-8b6d-884e3077443f","resolution":{"observed_at":"2026-05-13T07:37:29.831887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 IEEE International Conference on Web Services (ICWS) , pages=","venue":null,"work_id":"9a3fe229-337f-41dc-aaa2-41b9b7e94ced","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:139e3930bc8ca9f03b02f48aba44b2ed15192750f4d2df01fb735253f371cb11","observation_id":"07c141d9-e3fb-4af2-8bdf-d341136cebe4","resolution":{"observed_at":"2026-05-13T08:17:32.287213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14427","last_updated":"2025-02-12T01:33:00Z","snapshot_observed_at":"2026-07-31T21:52:16.125779Z","submitted_at":"2025-01-24T11:55:57Z","title":"GraphSOS: Graph Sampling and Order Selection to Help LLMs Understand Graphs Better","version":3},"cited_work":{"arxiv_id":"2501.14427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14427","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.14427 , year=","venue":null,"work_id":"9d16bbcc-8112-42b8-8411-a86df6cb2b1c","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2501.14427","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:30d248259760f475d4e12fce56205c35ff2065c9d9b2aecc2072f9efad9a050d","observation_id":"f37073eb-81db-4968-a4f2-ef937aa54969","resolution":{"observed_at":"2026-05-13T07:37:29.818585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15433","last_updated":"2025-05-21T12:14:26Z","snapshot_observed_at":"2026-08-08T00:53:22.092574Z","submitted_at":"2025-05-21T12:14:26Z","title":"Set-LLM: A Permutation-Invariant LLM","version":1},"cited_work":{"arxiv_id":"2505.15433","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15433","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.15433 , year=","venue":null,"work_id":"590f7f38-c94e-4de9-88b8-a571265356a5","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.15433","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6c511980752a0cbbab42400d3352d7fe1e52edce196d4cb8b96a23bc38afd188","observation_id":"cb156072-3568-49d0-abda-e6c0d8b6697e","resolution":{"observed_at":"2026-05-13T07:37:29.928879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"bb5c15d2-d66e-4e6e-8818-5248267aec37","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:eea24fefe89f6c6520284edac8db997197250aa33ea331fb724fd24e0f83fd53","observation_id":"a18cb4a0-36a1-4e26-aac4-0a47b6e80192","resolution":{"observed_at":"2026-05-13T08:17:32.295049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:1d093943516cd051f8cf1c5f65481c61a422dc54a6696082d9be9c213ad112a5","observation_id":"42ea5fed-51e8-49d2-afe6-ee69b4fb1a02","resolution":{"observed_at":"2026-05-13T07:37:29.836589Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:da9e0bd6b353f29fd23558d3ba0af55bfdfe12d5daf6aeac494b83a1af4d56bb","observation_id":"d95be7c4-4c29-43f2-a4ad-0bafadbe4b76","resolution":{"observed_at":"2026-05-13T07:37:29.923782Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06332","last_updated":"2024-05-24T07:09:21Z","snapshot_observed_at":"2026-08-06T07:58:05.717753Z","submitted_at":"2024-02-09T11:22:08Z","title":"InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning","version":2},"cited_work":{"arxiv_id":"2402.06332","doi":"10.48550/arxiv.2402.06332","metadata_source":"pith","pith_arxiv_id":"2402.06332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Internlm-math: Open math large language models toward verifiable reasoning","venue":"cs.CL","work_id":"da7fe877-735e-4436-9e53-837121a0b2d0","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2402.06332","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:7e27bec6b105838a07ad2e90c82977255fd8b5f55eebe298602cca8a9dbfae77","observation_id":"9076d9d2-869e-42e8-baf6-73e554382b6c","resolution":{"observed_at":"2026-05-13T07:37:29.887905Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:b9068fc59309810f208151b4a395d4db12fd6d342d882aa97927601b6416a0e7","observation_id":"0b7c421d-921c-4f56-b5c0-8d242e25aee3","resolution":{"observed_at":"2026-05-13T07:37:29.933416Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16345","last_updated":"2025-02-14T09:32:11Z","snapshot_observed_at":"2026-07-06T19:56:30.344759Z","submitted_at":"2024-11-25T12:44:02Z","title":"Preference Optimization for Reasoning with Pseudo Feedback","version":2},"cited_work":{"arxiv_id":"2411.16345","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16345","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preference optimiza- tion for reasoning with pseudo feedback","venue":null,"work_id":"6a988540-d473-4683-b343-f74be1b17f35","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2411.16345","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:9e66b0fbfb3654d7452310869f4daccc25674fbc404a0cb0afd3db6d4a514831","observation_id":"1f28dbfd-d9dd-415e-8e08-3788e98bfeb9","resolution":{"observed_at":"2026-05-13T07:37:29.881455Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"7342c2d1-3614-4bf4-9fea-a29bed041db7","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:ab5534b2b6f3adabcb9baa832db633b872991aa941203dcb10d926705db27c8c","observation_id":"d9c77c58-691a-41e5-a802-469db297c38c","resolution":{"observed_at":"2026-05-13T08:17:32.237308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16400","last_updated":"2025-06-05T17:59:12Z","snapshot_observed_at":"2026-08-08T01:11:54.830004Z","submitted_at":"2025-05-22T08:50:47Z","title":"AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2505.16400","doi":"10.48550/arxiv.2505.16400","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Acereason-nemotron: Advancing math and code reasoning through reinforcement learning","venue":"ArXiv.org","work_id":"428ad314-c120-41da-9db7-b8bc1918fffb","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.16400","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:4e78ceacc86baf17b5aaf9f7c5d4b2addbe44177fdc7bef82371727d99942697","observation_id":"8cc6f019-6d8f-482f-924f-841fba0a9cdf","resolution":{"observed_at":"2026-05-13T07:37:29.841604Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05605","last_updated":"2025-06-03T09:19:46Z","snapshot_observed_at":"2026-07-06T19:29:27.705770Z","submitted_at":"2024-10-08T01:36:15Z","title":"CodeDPO: Aligning Code Models with Self Generated and Verified Source Code","version":2},"cited_work":{"arxiv_id":"2410.05605","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.05605","snapshot_observed_at":"2026-07-02T19:07:17.688200Z","title":"Codedpo: Aligning code models with self generated and verified source code.arXiv preprint arXiv:2410.05605, 2024a","venue":null,"work_id":"30b11c8b-9581-4f2f-93df-b6924fa36bbc","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2410.05605","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:cf2519b892342c8d8b447a973930a96a3c623d7d5d5c127356fafa444ede297a","observation_id":"903285d5-f30e-477b-99f6-3badcbb1d3b0","resolution":{"observed_at":"2026-05-13T07:37:29.939329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:f2f9543ca7666f331535168ceca241ea213f974b91bbf70be9506b40de59ab33","observation_id":"c9042bc7-b01f-43a6-91d0-859b5e513e6c","resolution":{"observed_at":"2026-05-13T07:37:29.893688Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.096579Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"c25e8154-fab2-455c-8a26-56e40aed5d2b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:a5a2eec8bd238f9ac38def5ab624bf722c57f5feea15aded8be3a4bf750a9831","observation_id":"9147c6af-295b-4b83-831d-307ff1f6eeeb","resolution":{"observed_at":"2026-05-13T08:17:32.282944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:55.730920Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"b0092220-e738-45d3-97b1-bd1f0bd834c5","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:d9568f8b44895c5c41969555ff0d6818d4ae16792042be1fe630d99dd6287385","observation_id":"618675be-7fab-41c9-ab5b-b7dad2daad01","resolution":{"observed_at":"2026-05-13T08:17:32.233080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10571","last_updated":"2024-06-06T12:02:37Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T10:55:38Z","title":"Direct Preference Optimization with an Offset","version":2},"cited_work":{"arxiv_id":"2402.10571","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.10571","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct preference optimization with an offset","venue":null,"work_id":"aca16f09-1a50-46c9-ba22-07ebf249d309","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2402.10571","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:c214db338a7192d5d5e253fcc34054203a4909aa20a37a75101ac386bca144f2","observation_id":"104d1f22-4915-4274-ac35-a8d19d9c7e2b","resolution":{"observed_at":"2026-05-13T07:37:29.874766Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10858","last_updated":"2024-09-27T08:03:07Z","snapshot_observed_at":"2026-07-06T18:31:40.910349Z","submitted_at":"2024-06-16T09:06:17Z","title":"Step-level Value Preference Optimization for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":"2406.10858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10858","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Step-level value preference optimization for mathematical reasoning","venue":null,"work_id":"2523ac3a-94a4-4667-a2ce-de8ecadb2936","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2406.10858","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:56905a7120761e2a115d1e69404b5de94efe1abc58e4f2b0fd42df1210c70f07","observation_id":"3dd2b738-438b-4692-8fc8-673e0334ace8","resolution":{"observed_at":"2026-05-13T07:37:29.952562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":"2401.10020","doi":"10.48550/arxiv.2401.10020","metadata_source":"pith","pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Rewarding Language Models","venue":"cs.CL","work_id":"b3903c9e-1bc7-4267-a171-6311902be2a4","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:db708addf9344478b30dfd08d0dde1eb7122d1a2cd9ad69acb6a554b31b7bcce","observation_id":"754e0a15-3f02-4279-b195-0293cbe81b07","resolution":{"observed_at":"2026-05-13T12:01:42.779186Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00168","last_updated":"2024-02-02T03:41:50Z","snapshot_observed_at":"2026-07-06T16:41:27.099792Z","submitted_at":"2023-10-31T21:52:41Z","title":"The Alignment Ceiling: Objective Mismatch in Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":"2311.00168","doi":"10.48550/arxiv.2311.00168","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2311.00168 , archiveprefix =","venue":"arXiv (Cornell University)","work_id":"c8842f79-72a6-4bd5-b060-22e797b4a71e","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2311.00168","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:f4b89051abdcd4753616fe76834ab6c62222c40ce6d2be2c079274ab7a7d009d","observation_id":"d37aecc7-4f51-4543-9e9a-8999ad36b06b","resolution":{"observed_at":"2026-05-13T07:37:29.854732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06080","last_updated":"2024-01-12T09:46:10Z","snapshot_observed_at":"2026-07-06T17:14:24.413664Z","submitted_at":"2024-01-11T17:56:59Z","title":"Secrets of RLHF in Large Language Models Part II: Reward Modeling","version":2},"cited_work":{"arxiv_id":"2401.06080","doi":"10.48550/arxiv.2401.06080","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06080","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Secrets of RLHF in large language models part II: Reward modeling","venue":"arXiv (Cornell University)","work_id":"f37659bb-882a-46af-89a3-bf53a8c0969c","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2401.06080","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e367e4307e8e323231d8ccee3cef384de77280a19267136503abf2a318ef3be3","observation_id":"9e9cfa9b-6513-47ce-a9ae-ac8768437ab2","resolution":{"observed_at":"2026-05-13T07:37:29.945673Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:59c156371000c7d6421033123ac302616b82d8d07e6e6e7a32845831c3540ace","observation_id":"46547bf7-8b40-4470-a8f0-60745dcae52a","resolution":{"observed_at":"2026-05-13T07:37:29.861770Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23558","last_updated":"2025-05-30T07:37:34Z","snapshot_observed_at":"2026-08-07T12:41:22.635980Z","submitted_at":"2025-05-29T15:34:15Z","title":"Qwen Look Again: Guiding Vision-Language Reasoning Models to Re-attention Visual Information","version":2},"cited_work":{"arxiv_id":"2505.23558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23558","snapshot_observed_at":"2026-07-01T20:56:13.710075Z","title":"Qwen look again: Guiding vision-language reasoning mod- els to re-attention visual information","venue":null,"work_id":"cc9e5e98-c226-4e12-bf74-ff438225c4c0","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.23558","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:f536fc5585037e86b9faf08a325b0af9a4c5d4e0802c6ddbbb99c160a4d81af0","observation_id":"2b9c0382-4228-465e-8d9e-8b8b7bad606c","resolution":{"observed_at":"2026-05-13T07:37:29.848712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.01431","last_updated":"2021-07-03T13:14:58Z","snapshot_observed_at":"2026-08-07T09:30:50.641173Z","submitted_at":"2021-07-03T13:14:58Z","title":"Neural-Symbolic Solver for Math Word Problems with Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":"2107.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.01431","snapshot_observed_at":"2026-07-02T22:47:26.055795Z","title":"arXiv preprint arXiv:2107.01431 , year=","venue":null,"work_id":"99955ad5-a79a-4f36-81a1-4c147178ca70","year":2021},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2107.01431","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:3a99a21669015a17048ba490d9013e9d92a1890eef5d029c8f8181943262f0b4","observation_id":"4439da91-bd72-4035-8751-93095a40737e","resolution":{"observed_at":"2026-05-13T07:37:29.868070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2013 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"1fa75c7c-fb00-4284-bca7-d57bef84d275","year":2013},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:4a71d70074cb43918acc80eb1f47dde319c59ffbd82fc16de6107055aa27e2b7","observation_id":"0a941f00-88e0-443b-9a98-151094ac51f8","resolution":{"observed_at":"2026-05-13T08:17:32.266220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03822","last_updated":"2018-06-11T06:10:11Z","snapshot_observed_at":"2026-08-02T00:06:16.208560Z","submitted_at":"2018-06-11T06:10:11Z","title":"Know What You Don't Know: Unanswerable Questions for SQuAD","version":1},"cited_work":{"arxiv_id":"1806.03822","doi":"10.48550/arxiv.1806.03822","metadata_source":"pith","pith_arxiv_id":"1806.03822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Know What You Don't Know: Unanswerable Questions for SQuAD","venue":"cs.CL","work_id":"0d268f3a-4ca4-4600-b238-9d35f0b3f691","year":2018},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/1806.03822","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8009eb8c7da98ec4d91dc5cb0693b6eee131e263c19d4c4280c8e698f5c63891","observation_id":"54900de6-464b-4bdd-bf27-8f128ab2e243","resolution":{"observed_at":"2026-05-13T07:37:29.908455Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01100","last_updated":"2025-03-31T20:37:34Z","snapshot_observed_at":"2026-08-06T01:45:56.485973Z","submitted_at":"2024-07-01T09:06:57Z","title":"Eliminating Position Bias of Language Models: A Mechanistic Approach","version":3},"cited_work":{"arxiv_id":"2407.01100","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01100","snapshot_observed_at":"2026-06-29T16:23:39.321459Z","title":"Hang Wu, Hongkai Chen, Yujun Cai, Chang Liu, Qingwen Ye, Ming-Hsuan Yang, and Yiwei Wang","venue":null,"work_id":"89fea47d-5a99-4d8a-af27-b46fa2460e27","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2407.01100","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:482b300e04ba50171a084a79393b5e5a752be73475f0df7c44ce86cfccfa11ce","observation_id":"088a2967-6062-4c44-b660-a3a96c2e2756","resolution":{"observed_at":"2026-05-13T07:37:29.918096Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:25:37.824930Z","title":"Qwen2.5: A Party of Foundation Models , url =","venue":null,"work_id":"22515bae-5281-424a-a494-4f952e1ee0c3","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:4fccec60efbf9a0162a4781b1c6f0d15e4087139777dcacfc758e241dd510247","observation_id":"f5af5d75-332c-4192-8ec7-1c89e6281408","resolution":{"observed_at":"2026-05-13T08:17:32.277998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00200","last_updated":"2025-03-03T19:53:28Z","snapshot_observed_at":"2026-08-04T16:59:22.807968Z","submitted_at":"2024-04-30T21:06:52Z","title":"In-Context Learning with Long-Context Models: An In-Depth Exploration","version":2},"cited_work":{"arxiv_id":"2405.00200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00200","snapshot_observed_at":"2026-07-03T09:17:48.381748Z","title":"Gormley, and Graham Neubig","venue":null,"work_id":"16af75a7-d946-4ab5-a85c-1a423767113b","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2405.00200","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:189b5ddc89c3a0039066a38df49842261fe008dc2c84dba4cec531e63fca34ac","observation_id":"67240abf-fa2e-4ba2-ae38-52d51a44508a","resolution":{"observed_at":"2026-05-13T07:37:29.901629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"e0815f7b-aec9-4740-85d2-2eee98febc0b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6d77b708c4fb953379b4db7466aeafaca4ba9b2371c13dc5f83a5d9a4aab224c","observation_id":"0d1d92ee-cd46-43f4-9788-2c0648c4691c","resolution":{"observed_at":"2026-05-13T08:17:32.299642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"e3a6bba2-3926-414c-b3f3-54c5abb3827b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:ef3fb00fb29903063601acd2739832501c015879fd447b77236c5946fd3f0e89","observation_id":"df55ac3c-4b56-4a94-8271-19d8d5c51517","resolution":{"observed_at":"2026-05-13T08:17:32.245085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"c7769c40-bf5a-40ba-95f6-6e017b44d711","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e7ccef52ab24587ee0e000d1c7cf9b088d173481c79d4609f32ba8d91924edb7","observation_id":"efcac845-91b7-4687-8860-e397f9c909fb","resolution":{"observed_at":"2026-05-13T08:17:32.249789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.05111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arm-thinker: Reinforcing multimodal generative reward models with agentic tool use and visual reasoning","venue":null,"work_id":"1d33f4b0-de71-411a-9ec9-358b038fa3e0","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:b9a1467bc6fbea026f0b797703b859761d336954403bf9920ae33ec1c097dea1","observation_id":"1243ead2-91b6-4eb9-9fc9-a88278b240b1","resolution":{"observed_at":"2026-05-13T07:37:29.824883Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":19,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":28},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2605.11974."}