{"as_of":"2026-08-07T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:551e0f0fd1dceb5617515d6504c0796cc7e8163e076e03dd35ca8bde7af6864d","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:19:42.977063Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02984/citation-record","integrity":"/paper/2507.02984/integrity","json":"/paper/2507.02984/citation-record.json","paper":"/paper/2507.02984"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-06T21:19:33.852245Z","title":"arXiv preprint arXiv:2310.09478 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:33.852245Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5d2e2696313e07e038cf5f34f812b91868712dfc3c5bfa8c01cefebcb584e3de","observation_id":"f416be21-c02a-4b9b-af2c-fcf74533376d","resolution":{"observed_at":"2026-08-06T21:19:33.852245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T21:19:33.912791Z","title":"arXiv preprint arXiv:2306.15195 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:33.912791Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4552915379b7ab32e61854b24a25cbac31d8cf4e681bc7765946822cb6b85834","observation_id":"6b577f96-c747-4113-88ce-7e575130aeed","resolution":{"observed_at":"2026-08-06T21:19:33.912791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-06T21:19:34.013688Z","title":"arXiv preprint arXiv:2306.14824 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.013688Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:338a44a3848f1a4a8278ef6ae1e75e7880643771355549d4a2123263d43b6c97","observation_id":"13ec6268-f581-4eb7-a91e-dd40699eb75b","resolution":{"observed_at":"2026-08-06T21:19:34.013688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-05T11:54:14.447608Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-06T21:19:34.077710Z","title":"arXiv preprint arXiv:2408.16500 (2024) 14","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.077710Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:02c480c4ed507a0537e3f6f80ca91891139d4bcdac43fa8d0aeb29675adecf95","observation_id":"fe18d58a-759a-4aeb-a4ab-e676cca4ece0","resolution":{"observed_at":"2026-08-06T21:19:34.077710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.177966Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.177966Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5ad7d5efda5fcbe553b276c4bb378b7ac7901df9fa25a4f2821d05644cd800e3","observation_id":"9f277b7f-a5e5-4af2-999b-fbd7e98ae66f","resolution":{"observed_at":"2026-08-06T21:19:34.177966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.243662Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.243662Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:9e5bcc689c8c764acbc68df9f509efdd2d7f846bff2da62c4f97fd6862901c26","observation_id":"1f93425b-bfc9-47e1-a7d1-4d58c7ce2b8d","resolution":{"observed_at":"2026-08-06T21:19:34.243662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.353123Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.353123Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:1ca604e1918c5785af34f3e151034ec0d7be6c9a87e27ca40668a1feb03ce5ff","observation_id":"9a18fa4d-9cd2-47c2-b3ad-e2f59471e96d","resolution":{"observed_at":"2026-08-06T21:19:34.353123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T21:19:34.422630Z","title":"arXiv:2311.07575 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.422630Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:31fe3341d23d7fc545192a2115951d0e4a938fe4199e3934bcbbef82c079ecfa","observation_id":"927fd270-58f6-46c2-ade2-ded5b8f8ed54","resolution":{"observed_at":"2026-08-06T21:19:34.422630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-06T21:19:34.505690Z","title":"arXiv preprint arXiv:2404.16821 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.505690Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a2faea46dcfaf808bbd297b65c8c259d193f9265afe44b796406f84340123ba8","observation_id":"3d524dfb-0e36-4805-ba3e-b1bbf50ed920","resolution":{"observed_at":"2026-08-06T21:19:34.505690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-06T21:19:34.629464Z","title":"arXiv preprint arXiv:2403.05525 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.629464Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:98c795b4a0ebe249aa17ddbe31a57f28142aec60c9d448fabfc46864ecdbd4a9","observation_id":"6c9756ba-a469-4149-b741-3c25008706bd","resolution":{"observed_at":"2026-08-06T21:19:34.629464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-06T21:19:34.703051Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.703051Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f4ac00e27bfc02da41a490c878c51ed9d114c991b444e98e6a687f5034255f24","observation_id":"e3ec2494-dc05-4060-ae76-a6cb5f1f5a56","resolution":{"observed_at":"2026-08-06T21:19:34.703051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.772600Z","title":"https://llava-vl.github","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.772600Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:84ad7f310b707041e1d108de79d0ff2d82e93b10010060253fe4050d926b990a","observation_id":"cc9022a1-7334-4aff-8f1d-9af90499af99","resolution":{"observed_at":"2026-08-06T21:19:34.772600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-06T21:19:34.859505Z","title":"arXiv preprint arXiv:2408.01800 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.859505Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:1a5a9eb683bbf12d4758da6f3722874617cecac5006cf257222cf6d28641278c","observation_id":"055f57a2-4f6f-4f21-b0e6-8ab138540039","resolution":{"observed_at":"2026-08-06T21:19:34.859505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T21:19:34.937712Z","title":"arXiv preprint arXiv:2409.12191 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.937712Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:06928fa8154435dd1d2ae3eef976e298aa112a8479aad437473b20587c72593e","observation_id":"2422e848-f067-473f-bb2f-4a07fd237b05","resolution":{"observed_at":"2026-08-06T21:19:34.937712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07397","snapshot_observed_at":"2026-08-06T21:19:35.022823Z","title":"arXiv preprint arXiv:2311.07397 (2023) 15","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.022823Z"},"links":{"cited_paper":"/paper/2311.07397","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:72d570889f7e3df77ef1bbdde4043af7da2a81d7dca0590747f5f93485bf6b30","observation_id":"4708ab48-5e6b-485b-9155-412f188f8d23","resolution":{"observed_at":"2026-08-06T21:19:35.022823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.110223Z","title":"NeurIPS (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.110223Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e3f8c13489d3eeabb321ce10d1eb70dfdaa800ca40fd7864b4d2985f5179da8d","observation_id":"7900ed98-6e53-4bac-8741-2e33725432fe","resolution":{"observed_at":"2026-08-06T21:19:35.110223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T21:19:35.203253Z","title":"arXiv:2306.13394 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.203253Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:c12e232fad9f78f9dd5ab60e5924bd9a9633b1156620fde2bd29f0d08cfb40cd","observation_id":"b2ad41e5-2682-428e-b7ab-be0596cb1577","resolution":{"observed_at":"2026-08-06T21:19:35.203253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.260301Z","title":"In: Proceedings of the IEEE International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.260301Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:24daceca95f5aeafc60cecbfbdcdacc13a7e8feaf2a277719eca5ccffb9c5323","observation_id":"e4225a55-a0a2-487c-9e2e-1be11a7eea43","resolution":{"observed_at":"2026-08-06T21:19:35.260301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.355158Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.355158Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:431e85293a70e6858b5a72a8ca12d50aa820ae58bf657d75b233cb6ca6ebefd2","observation_id":"26b4a820-0ff1-4e90-b6c6-3dfd42f199ec","resolution":{"observed_at":"2026-08-06T21:19:35.355158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-06T13:03:19.727877Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T21:19:35.419588Z","title":"arXiv preprint arXiv:2308.02490 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.419588Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3820b5b32cd0ed86d4f25dcd7ee71ca4e88e1e2af649360f756835e8da4c64b1","observation_id":"04819b31-00e6-4373-a1cb-084c8649815d","resolution":{"observed_at":"2026-08-06T21:19:35.419588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.492421Z","title":"In: International Conference on Learning Representations (ICLR) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.492421Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:fe3901738cbd45d8ef60cb606a2c249f914fa6d9b39c25e3c06f93a7029eeb18","observation_id":"89997c7a-e103-4a9d-ad83-bba8518244d1","resolution":{"observed_at":"2026-08-06T21:19:35.492421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.556816Z","title":"ACL (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.556816Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:92da9bf4cbd65f9d2be38e0ac9de6d058f9662f58095166d82da22ae21ccef39","observation_id":"284e0a8b-399e-456d-b674-0fcf5fb39f21","resolution":{"observed_at":"2026-08-06T21:19:35.556816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.650695Z","title":"NeurIPS (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.650695Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e094d91cc5c59a617b671655fc5749f9df1a41ba5b05f9c30d455f67256c8805","observation_id":"f07419c3-9f53-422c-82e6-d0314e8f14f2","resolution":{"observed_at":"2026-08-06T21:19:35.650695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-07-06T14:47:34.480641Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-06T21:19:35.695869Z","title":"arXiv preprint arXiv:2302.00923 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.695869Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:0b1def0d117931fee39a4fc03c5672c419ec52c009a1aad7980a30315eb51155","observation_id":"d64192ec-5a48-479b-98c3-4c1ae57b6b90","resolution":{"observed_at":"2026-08-06T21:19:35.695869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.779999Z","title":"NeurIPS (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.779999Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:73b270b2d903d1f2cdb05e40181461acb7632172b9270b1979a5178af10e4aa4","observation_id":"5dd3c81e-b9b3-49bf-8400-c58b711e5f56","resolution":{"observed_at":"2026-08-06T21:19:35.779999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.846251Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence, vol","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.846251Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:2604e18df941331823743061656debf09d07f6001fa7896651e806cc15cd3d4c","observation_id":"089aa579-19a6-41ed-875b-9525f7e724b3","resolution":{"observed_at":"2026-08-06T21:19:35.846251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.912123Z","title":"ACM MM (2024) 16","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.912123Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a8570596a17bb84585807b6dfe99e74f34c2377e0a934f2106ceb8e18f9d6994","observation_id":"9fe9cbd2-4458-4d38-98ff-8964cf14f0fc","resolution":{"observed_at":"2026-08-06T21:19:35.912123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.992476Z","title":"In: CVPR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.992476Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:64fb70926d9bac630001e85ae938c1f0f2a50a9cb7c2a094d79cf14f71eb0cf0","observation_id":"207edfa8-d3a2-4a54-a274-d4ba0697749a","resolution":{"observed_at":"2026-08-06T21:19:35.992476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09193","last_updated":"2023-11-15T18:39:21Z","snapshot_observed_at":"2026-08-02T16:45:54.807090Z","submitted_at":"2023-11-15T18:39:21Z","title":"The Role of Chain-of-Thought in Complex Vision-Language Reasoning Task","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09193","snapshot_observed_at":"2026-08-06T21:19:36.092686Z","title":"arXiv preprint arXiv:2311.09193 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.092686Z"},"links":{"cited_paper":"/paper/2311.09193","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5aca3f0f094c4ac04f84a59b847a8191865bb1a8a6feac18856e18aceec59b02","observation_id":"518bea90-bf82-478e-9b14-1bafb206c194","resolution":{"observed_at":"2026-08-06T21:19:36.092686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19716","last_updated":"2024-11-24T03:47:38Z","snapshot_observed_at":"2026-08-04T15:18:22.654819Z","submitted_at":"2024-05-30T05:53:49Z","title":"Enhancing Large Vision Language Models with Self-Training on Image Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19716","snapshot_observed_at":"2026-08-06T21:19:36.169281Z","title":"arXiv preprint arXiv:2405.19716 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.169281Z"},"links":{"cited_paper":"/paper/2405.19716","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e65857e7568a80297c0cd74b6f4b6fdf89a4931da726094bd67d63c7631bba26","observation_id":"5b546750-8f74-4020-b4b0-484e32544102","resolution":{"observed_at":"2026-08-06T21:19:36.169281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11280","last_updated":"2025-01-08T03:18:23Z","snapshot_observed_at":"2026-07-06T18:32:02.206165Z","submitted_at":"2024-06-17T07:33:30Z","title":"ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO","version":2},"cited_work":{"arxiv_id":"2406.11280","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11280","snapshot_observed_at":"2026-08-06T21:19:43.326409Z","title":"ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO","venue":"cs.CV","work_id":"60ff8cbe-089a-4dc1-8665-d4ff0bfb410e","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.242869Z"},"links":{"cited_paper":"/paper/2406.11280","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e3883d17d2abe7b4d64894cd0a14b32315af799e53601baa4ccb526c5e1dae54","observation_id":"dcc6de35-d0ab-40e1-9116-b0127168f179","resolution":{"observed_at":"2026-08-06T21:19:43.391954Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15973","last_updated":"2025-02-08T21:50:41Z","snapshot_observed_at":"2026-07-06T18:19:38.561528Z","submitted_at":"2024-05-24T23:09:27Z","title":"Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15973","snapshot_observed_at":"2026-08-06T21:19:36.307866Z","title":"arXiv preprint arXiv:2405.15973 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.307866Z"},"links":{"cited_paper":"/paper/2405.15973","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:738e3b5133d78b14fce4af90a7352a3839c01f12f9fb968fb93c832cc926c790","observation_id":"898c1883-d398-4829-a80a-277d07070c79","resolution":{"observed_at":"2026-08-06T21:19:36.307866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15650","last_updated":"2024-12-20T08:06:00Z","snapshot_observed_at":"2026-07-06T20:10:41.978020Z","submitted_at":"2024-12-20T08:06:00Z","title":"Beyond Human Data: Aligning Multimodal Large Language Models by Iterative Self-Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15650","snapshot_observed_at":"2026-08-06T21:19:36.373666Z","title":"arXiv preprint arXiv:2412.15650 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.373666Z"},"links":{"cited_paper":"/paper/2412.15650","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4d6ed9954161509ee01989334ad776ca2dcb8f42c670c2cfe1bd2fc2d8a630fa","observation_id":"f00da12f-f109-47a1-9460-1bdec9af2d54","resolution":{"observed_at":"2026-08-06T21:19:36.373666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.451178Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.451178Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:b77e71a2e034466a252d4a99ea98a2a5e2cfd2ec7917febe81e9750c9fc01716","observation_id":"c9fb9dea-dadb-44bc-9070-4029abaf468e","resolution":{"observed_at":"2026-08-06T21:19:36.451178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.528716Z","title":"In: Computer Vision–ECCV 2016: 14th European Conference, Amsterdam, The Netherlands, October 11–14, 2016, Proceedings, Part IV 14, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.528716Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:759155529eb682d672d547bdf832fd54d7e9350ce82f579a4fc44211146391d2","observation_id":"56362f2f-5a59-4b3c-83fc-daa77b6a2a8b","resolution":{"observed_at":"2026-08-06T21:19:36.528716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.608901Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.608901Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:c6fa0e6c12de68e4a64a9a43e6c8f68377b49ffc62c01f04058c769f84d8945a","observation_id":"18401eb3-51b1-4d45-bc32-17a14552b1ca","resolution":{"observed_at":"2026-08-06T21:19:36.608901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T21:19:36.653815Z","title":"arXiv preprint arXiv:2103.03874 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.653815Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:79bca47e0cb853d5c49bcb97f18d21fb03605c8df723277bdbf16b1340e8db53","observation_id":"e0aec378-e836-4353-a392-163c639c9984","resolution":{"observed_at":"2026-08-06T21:19:36.653815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.720980Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.720980Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6549e75831d1648bc85294cc3a94fb6b77dc62375155011220845cd2de0a17e4","observation_id":"b1d80a42-65fc-418e-a042-88622768a4dd","resolution":{"observed_at":"2026-08-06T21:19:36.720980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02582","last_updated":"2024-01-05T00:26:07Z","snapshot_observed_at":"2026-07-06T17:11:50.961895Z","submitted_at":"2024-01-05T00:26:07Z","title":"CoCoT: Contrastive Chain-of-Thought Prompting for Large Multimodal Models with Multiple Image Inputs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02582","snapshot_observed_at":"2026-08-06T21:19:36.765868Z","title":"arXiv preprint arXiv:2401.02582 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.765868Z"},"links":{"cited_paper":"/paper/2401.02582","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:bcbc3d5fdad42f1e3c072958f3fce60423223e701c01f41b43496dbb9025f08b","observation_id":"90347a6c-eb5a-4ac5-9b91-3134c0d0cba6","resolution":{"observed_at":"2026-08-06T21:19:36.765868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16999","last_updated":"2024-11-04T05:50:56Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:59:23Z","title":"Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16999","snapshot_observed_at":"2026-08-06T21:19:36.818352Z","title":"arXiv preprint arXiv:2403.16999 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.818352Z"},"links":{"cited_paper":"/paper/2403.16999","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:9f7ba79051824fa0c04ccb1c86aaba9482d7839325eb61aa4bc7c348d8defb0e","observation_id":"ce0619b4-d8bf-4350-9aa7-441eacbc1a92","resolution":{"observed_at":"2026-08-06T21:19:36.818352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.276048Z","title":"Journal of machine learning research 21(140), 1–67 (2020)","venue":null,"work_id":"5126cdf0-b4ee-4f54-8170-b8bc1326f013","year":2020},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.869481Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:20987abd0943be1719d9f99fa19fd34b0a3ddfdd092b076fda36943f8469fac2","observation_id":"488629da-b6f5-4919-b848-b543690d8c37","resolution":{"observed_at":"2026-08-06T21:19:45.279871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.264472Z","title":": Training language models to follow instructions with human feedback","venue":null,"work_id":"51ab8689-ba39-4344-9ba4-2fe2209882cb","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.945519Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:959af2b103bf55a9bfa347da06676302eb4c1244c22c99f22264929fc5b0ae0e","observation_id":"a9ac94fc-c90b-4f57-b292-963270d15c1e","resolution":{"observed_at":"2026-08-06T21:19:45.268677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-06T21:19:36.992645Z","title":"arXiv preprint arXiv:2407.07895 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.992645Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:8d9f9e2a4c6be3456349b96b334f7d59e7a8ba4fed3710e7b87cbb1c1aa498fd","observation_id":"8ad19dd6-f942-4ace-90d9-dab0c91f6bc5","resolution":{"observed_at":"2026-08-06T21:19:36.992645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.253511Z","title":"In: Proceedings of the 37th International Conference on Neural Information Processing Systems (2024)","venue":null,"work_id":"22e4bb04-8868-4013-963d-e2e66b517de0","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.046109Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a230ef43205aaa31b46a04a0a309c11d2b7951dbf868c5d68519800505aaf200","observation_id":"009094eb-d556-4465-a87d-d4e5bc3d9846","resolution":{"observed_at":"2026-08-06T21:19:45.257314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.242173Z","title":"https://openai.com/research/ gpt-4v-system-card","venue":null,"work_id":"c080aaae-6600-49fc-9df7-76f08400ab5c","year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.124103Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3542476361714b02ece9a0dec3f9d184d3d91785e8b99dcf39fff88ba0e3ddd7","observation_id":"a56f1546-e8ca-4dee-91e8-64d5b58d6023","resolution":{"observed_at":"2026-08-06T21:19:45.245815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04792","last_updated":"2024-02-29T20:59:17Z","snapshot_observed_at":"2026-08-07T05:40:44.041304Z","submitted_at":"2024-02-07T12:31:13Z","title":"Direct Language Model Alignment from Online AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04792","snapshot_observed_at":"2026-08-06T21:19:37.182865Z","title":"arXiv preprint arXiv:2402.04792 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.182865Z"},"links":{"cited_paper":"/paper/2402.04792","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f9f6e434ff7e74eea5f57bb0506b11b26d6854a6773cfd9c004443aceaed306e","observation_id":"1f54acb1-611e-49c7-ba95-7ebfe0a7f823","resolution":{"observed_at":"2026-08-06T21:19:37.182865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-06T21:19:37.231697Z","title":"arXiv preprint arXiv:2401.10020 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.231697Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e4b2cc3dd1452d1e2f4e87b0a7f8a40e5c77ed16ef4e62933dc52d0322bfba91","observation_id":"7c78759c-5123-4548-b72a-5f8e56dc45c4","resolution":{"observed_at":"2026-08-06T21:19:37.231697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08635","last_updated":"2024-03-13T15:47:26Z","snapshot_observed_at":"2026-07-06T17:44:00.848335Z","submitted_at":"2024-03-13T15:47:26Z","title":"Human Alignment of Large Language Models through Online Preference Optimisation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08635","snapshot_observed_at":"2026-08-06T21:19:37.284453Z","title":"arXiv preprint arXiv:2403.08635 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.284453Z"},"links":{"cited_paper":"/paper/2403.08635","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5a37e06ab9aeab7921d082edbbba34bda15d87537935a0fb06fda9c94cbc03ee","observation_id":"15b86385-82d0-4368-b077-1c142b2587e1","resolution":{"observed_at":"2026-08-06T21:19:37.284453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-07T08:32:00.916309Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-06T21:19:37.331130Z","title":"arXiv preprint arXiv:2405.07863 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.331130Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:8fe640393fb9fe091276031de7258c670de58186bf6d5ac6b77b6cc4699aae2f","observation_id":"67e203a4-c003-42bd-a4d7-b46b6906879b","resolution":{"observed_at":"2026-08-06T21:19:37.331130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-06T21:19:37.398160Z","title":"arXiv preprint arXiv:2401.01335 18 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.398160Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:7941ed87a9d2d6f25a02dbe7d2d868b07d97122f09a02a4891c847a66bf5e0e0","observation_id":"884b4a97-d57d-43a0-98d2-87d6e9ac026f","resolution":{"observed_at":"2026-08-06T21:19:37.398160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.230225Z","title":"Advances in Neural Information Processing Systems 35, 15476–15488 (2022)","venue":null,"work_id":"1b8e63d3-6a17-4240-9154-aaf65f6988c7","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.456187Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:309d00754d73dde32a956ef5e5a65cd753a2f88f904a66f431dcdf24dcb9dc47","observation_id":"07f27bc1-2ecd-417a-b148-5556b19f72db","resolution":{"observed_at":"2026-08-06T21:19:45.234825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19733","last_updated":"2024-06-26T01:28:35Z","snapshot_observed_at":"2026-08-06T12:20:08.657659Z","submitted_at":"2024-04-30T17:28:05Z","title":"Iterative Reasoning Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19733","snapshot_observed_at":"2026-08-06T21:19:37.514013Z","title":"arXiv preprint arXiv:2404.19733 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.514013Z"},"links":{"cited_paper":"/paper/2404.19733","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a844ff16533bf521bd90e3ca498009e08d3010becb052ec9d2b3f1cc15c91fa1","observation_id":"d2bfe77f-6232-485e-94f8-8b69dbbaa289","resolution":{"observed_at":"2026-08-06T21:19:37.514013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.569087Z","title":"arXiv preprint arXiv:2405.17220 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.569087Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:7ae38c1394ea70a15268c7146c08052d45b42fc0ce7bce3ac3bc2e7ee9233654","observation_id":"1160b51d-4ce0-42a1-a8d0-d48d17eccc78","resolution":{"observed_at":"2026-08-06T21:19:37.569087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14622","last_updated":"2024-11-02T02:51:51Z","snapshot_observed_at":"2026-07-30T21:22:18.339303Z","submitted_at":"2024-05-23T14:30:33Z","title":"Calibrated Self-Rewarding Vision Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14622","snapshot_observed_at":"2026-08-06T21:19:37.631397Z","title":"arXiv preprint arXiv:2405.14622 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.631397Z"},"links":{"cited_paper":"/paper/2405.14622","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:45362e0eb8e45daaf0e2f78c241f292a30fa81e6a4701a4c59ede226d9c14130","observation_id":"064b4759-aea7-4fb9-ab43-37bc3456dccd","resolution":{"observed_at":"2026-08-06T21:19:37.631397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.219236Z","title":"ACM MM (2024)","venue":null,"work_id":"0212aa2d-59bb-4e41-82ea-de01e7f543ea","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.684578Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:fd0fca3801cf95f45d6b55b9ae94c425424a5ba6f7585f0ddb63ba20f218e1d1","observation_id":"38fbfaff-8ca6-4452-b784-652d4f837eca","resolution":{"observed_at":"2026-08-06T21:19:45.222385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-04T00:41:59.024387Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T21:19:37.737245Z","title":"arXiv preprint arXiv:2406.17294 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.737245Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4743a45052a726d1d0aa5fb38889db1a3b814b193da3ce9f6e50129d6926f8ef","observation_id":"7c2861a9-00e8-44db-8dbe-f02ff5886416","resolution":{"observed_at":"2026-08-06T21:19:37.737245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.208311Z","title":"In: Findings of the Association for Computational Linguistics: ACL 2022, pp","venue":null,"work_id":"84f0ea08-1553-43e2-b732-99c01f372dae","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.787387Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:440bfd92bc34a91aad27feb7807d98f282634043f6ea0c0e7beb669b6651b487","observation_id":"df92a167-3d00-4554-abbe-a401f8be36b3","resolution":{"observed_at":"2026-08-06T21:19:45.212095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.196028Z","title":null,"venue":null,"work_id":"1564a5d9-bc84-4f6c-b883-216f25f3c156","year":2021},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.847899Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6370c2d4a0c2a7096bc46899c3ee70e508e8e3ebaed87612ffb4bbad43dc6a55","observation_id":"a6837e4b-3184-4146-8a75-ec98fa7cac91","resolution":{"observed_at":"2026-08-06T21:19:45.200325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.183832Z","title":"NeurIPS (2022)","venue":null,"work_id":"288f5928-2b68-46d9-a6a9-3bd122ed204d","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.904281Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:05cf840dee2cfa5a8c2fee3a573772bebd10d42b6bf3021b1bfe029914c9f345","observation_id":"76c29561-5953-47e2-9bd0-8e5a3f1e83af","resolution":{"observed_at":"2026-08-06T21:19:45.187971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.978169Z","title":"Advances in neural information processing systems 33, 6840–6851 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.978169Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4cfce7632261fc411ac4cf0ce1456043bd486035bf7e6f2c45dfd7d6293edd59","observation_id":"506ad1ae-9ee1-4c99-bd5d-de37afc5029a","resolution":{"observed_at":"2026-08-06T21:19:37.978169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.165906Z","title":"In: Findings of the Association for Computational Linguistics: EMNLP 2024, pp","venue":null,"work_id":"e0e715b5-095f-486f-a1a9-0c7a2f6b6423","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.078828Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:04d993d0a242c45767320beb7dfb64ef2bc98796836211a053fb5fa5e741f949","observation_id":"902e720f-9e47-4ccb-9474-628f406e1f2c","resolution":{"observed_at":"2026-08-06T21:19:45.169529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.154130Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern 19 Recognition, pp","venue":null,"work_id":"1ab71aab-2d7e-40a3-9f05-7669fc796be1","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.187584Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:eab65a0239dfef53d7fe0f4a9146367c9059378be7d10ce2ce2cf6277575a658","observation_id":"b62d63ba-ff73-417d-8a51-463c0431f0e5","resolution":{"observed_at":"2026-08-06T21:19:45.159105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T21:19:38.241871Z","title":"CoRR abs/2308.12966 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.241871Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:c65a0ddbda127f537cdb9f4216506c108a64ef5b29662906c096d9032c6cc7c7","observation_id":"b747dfa7-a7fa-4294-97d0-637d11820d2a","resolution":{"observed_at":"2026-08-06T21:19:38.241871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T21:19:38.244912Z","title":"arXiv preprint arXiv:2312.11805 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.244912Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3d071ebed3a03aa122ea2464b3ee6969bad7be6a84905efcded7ab169b8bd138","observation_id":"363b3e55-d3a6-48f2-a8fb-aa67c8c7ff9f","resolution":{"observed_at":"2026-08-06T21:19:38.244912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19443","last_updated":"2025-01-22T08:25:25Z","snapshot_observed_at":"2026-07-06T17:52:34.385599Z","submitted_at":"2024-03-28T14:15:10Z","title":"Mixed Preference Optimization: Reinforcement Learning with Data Selection and Better Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19443","snapshot_observed_at":"2026-08-06T21:19:38.248448Z","title":"arXiv preprint arXiv:2403.19443 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.248448Z"},"links":{"cited_paper":"/paper/2403.19443","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4155ba45ae535099ff63ebc105e91e20d8546c95baa4f092aa0aaab5089b2cf2","observation_id":"e61e0aa2-a79c-49ca-a8a6-0e3d3924ef27","resolution":{"observed_at":"2026-08-06T21:19:38.248448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T21:19:38.285085Z","title":"arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.285085Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6befd36bf561936b04f4103ad22dcf2e3dd69f30a175f66d4084f3bf81ffe7d6","observation_id":"27597d7a-d8a5-40f7-a23d-2c0e71ada57e","resolution":{"observed_at":"2026-08-06T21:19:38.285085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T21:19:38.412010Z","title":"generate-train","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.412010Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:37dbbfc6ace43542e7e579877c443e9a07165ed1dca164e07049fd98ecdb5063","observation_id":"d137d441-3785-40b9-8f92-a61768b12a98","resolution":{"observed_at":"2026-08-06T21:19:38.412010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.142624Z","title":"Sub-answers:","venue":null,"work_id":"b65020a5-fda3-4e1f-b634-28351c787d69","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.524221Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:dd5e5cfb89e44ea89ba23b0d3c5cd5d9f5dc12db2f7581e6593174a6a37db153","observation_id":"b7f589be-bd18-4eec-babf-f731bf6cb5c3","resolution":{"observed_at":"2026-08-06T21:19:45.146448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.130766Z","title":null,"venue":null,"work_id":"21f90ca8-7363-4984-9c77-a482235969f9","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.640246Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:750545902e0d3d1258a968ca9bf5a40e3ae7d6b2ad98a00c42d85b23ef719454","observation_id":"30d283c8-525d-4455-9304-d74c5c41f5a0","resolution":{"observed_at":"2026-08-06T21:19:45.134735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.119230Z","title":"Uncertain","venue":null,"work_id":"d126e7fb-34e5-4f61-b16d-32cc27357150","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.712756Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:bf1081c16828c1d347a7ccc1bd997b7ee966a34ff3eab72f54261a902ef25c33","observation_id":"e81b333b-9878-4b08-9774-621548c8a829","resolution":{"observed_at":"2026-08-06T21:19:45.123412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.107961Z","title":null,"venue":null,"work_id":"dfff6b02-56f4-467e-871e-ddd6eb81a3b5","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.821657Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f8b652eb402651cb9c7f053ec350690e69a672d3b9661b800010e9b190745c29","observation_id":"ff08c9b2-35bd-46ab-aee7-14311f515173","resolution":{"observed_at":"2026-08-06T21:19:45.111855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.097568Z","title":null,"venue":null,"work_id":"e3c535bc-37d0-481d-8236-4197c8342601","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.986073Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:15ca24675e253860ea9591ab00541496e0539e152c69829a587e130433c874da","observation_id":"28c47846-b7a7-4869-bd4c-9f3c93f91451","resolution":{"observed_at":"2026-08-06T21:19:45.101612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.086271Z","title":"The formula for the circumference C of a circle is given by: C = 2πr, where r is the radius of the circle","venue":null,"work_id":"d5d89391-77ed-4e69-8a7a-cca744b690b2","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.149496Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:341fe246e56f4a42146a97502d045624c805642b0a04c20fe3a79a66cc0d1fef","observation_id":"0934a1a5-231d-4d5a-84a4-3258eaca149e","resolution":{"observed_at":"2026-08-06T21:19:45.090837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.074071Z","title":"- Each side of the square is equal to the height of the rectangle, which is given as 32 units","venue":null,"work_id":"2b257e45-b8aa-47ba-b9d0-433e1da20d08","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.353941Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:03bab7db59baa190616671f76be50d94cf492e9fadf5c2c2c678bfc60a2de103","observation_id":"21841584-672d-4710-bfc0-f5a8b1dbf116","resolution":{"observed_at":"2026-08-06T21:19:45.078402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.061648Z","title":"- The diagonal of a square with side length s is given by s\\sqrt{2}","venue":null,"work_id":"df4d260b-603e-4854-bc5f-3d8c220ed59b","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.555704Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:28b7f009410a128564039858b07cbe82f41c796b0099eeb57d09c2679825dfb1","observation_id":"fe9dc88b-a511-49e8-b5a3-7bb538349296","resolution":{"observed_at":"2026-08-06T21:19:45.066148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.051943Z","title":"objects\": [ {","venue":null,"work_id":"74d3faa9-9b4b-4617-b096-c23b084bca6a","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.697546Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:0c7f2746b363516813734f1a83e96767989c8dfebaa4dae3222a7de016c31e6b","observation_id":"75072758-ec69-4e69-ae37-13309c87ea6b","resolution":{"observed_at":"2026-08-06T21:19:45.055324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.042205Z","title":null,"venue":null,"work_id":"ca1d07a0-03c7-4d61-9757-3353a01e0d83","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.904367Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4b9812156e7c7ccd3b352b2922fe4864568f3e03c07f5243175a2af1384d2b03","observation_id":"ce7acc8a-7b65-4e0e-a640-cca607d7fb03","resolution":{"observed_at":"2026-08-06T21:19:45.045568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.032407Z","title":"objects\": [ {","venue":null,"work_id":"e825adf1-045f-42db-93eb-a1429111ee2d","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.066958Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:dcb55b5d6be48ea7dbd9547ac6cee602f23f48c7d2822650e69d8b6e4eecb0c6","observation_id":"7b657692-e593-4303-be7e-ab141c48ca68","resolution":{"observed_at":"2026-08-06T21:19:45.036316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.021884Z","title":null,"venue":null,"work_id":"e1ae715c-b847-4bfa-bcad-050e557844ee","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.197225Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6ed74909a23b25cd7643559ea849869dcae90fa55c4706a31bdbd9165619fe9e","observation_id":"ee271c14-4e87-4c91-bd70-311482409aea","resolution":{"observed_at":"2026-08-06T21:19:45.026104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.012697Z","title":null,"venue":null,"work_id":"80c793f1-3c21-44db-a19a-28b1e8436e4a","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.353407Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:b5a83a991ed674a301e0e693c79f179dccbe35e27b8d592018523657fc8fb28e","observation_id":"f88a98fc-b701-4a4d-bfd9-f731d866947b","resolution":{"observed_at":"2026-08-06T21:19:45.016416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.003436Z","title":null,"venue":null,"work_id":"41c3f8ed-a8ea-4d54-9e05-8b260db04c04","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.505961Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d285315f34f8f3374550a899d1aba83069cc689338c5aa2170db90ba2b3a6053","observation_id":"1883a4f1-7c59-4490-bf2f-b2cf1a354f1c","resolution":{"observed_at":"2026-08-06T21:19:45.007140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.994502Z","title":null,"venue":null,"work_id":"b58efc1c-55c5-42b0-aa2d-bb85c3b5f7d5","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.674246Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:bd2b8ea7173056de2ca2687471a0af8ecd1a14572ee0f7d45b4c2ee1136285c2","observation_id":"2ad79d24-12a9-441e-91b7-affaaf63f698","resolution":{"observed_at":"2026-08-06T21:19:44.997450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.986204Z","title":null,"venue":null,"work_id":"ee93b5e1-e425-4129-aa3c-7e283ff4cbbc","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.913540Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:c767fcac41812d48f8d1605737f490ddc3f324465d207b0db8bd8f92e55a4b39","observation_id":"d0b55959-a5ab-490a-98d2-0e3beca719df","resolution":{"observed_at":"2026-08-06T21:19:44.988969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.978154Z","title":null,"venue":null,"work_id":"6dab8268-44f3-4d24-b154-2adbcc6a84a4","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.053299Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:39182374165adb327c718f241aa2080ce49a0074b32238d17754ce031b11ceda","observation_id":"c222e408-bde4-4718-89c1-13c4082e2752","resolution":{"observed_at":"2026-08-06T21:19:44.981093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.969907Z","title":null,"venue":null,"work_id":"c6d3037b-8215-4b0b-8a85-400e07a1e3e3","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.231965Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:2899dc1f23df2424cc6869d5a03a257a9f6674463f265c4f40fe8cdc6951c12a","observation_id":"e7512077-b686-4bd8-a9b3-5cea7199c551","resolution":{"observed_at":"2026-08-06T21:19:44.972431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.962527Z","title":"objects\": [{","venue":null,"work_id":"37d4780f-1c5d-4811-8b85-162812fd8517","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.411657Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4563751104adf666d4a4d316ce7cbbae960fc1508dab19366b755ee756cf07b9","observation_id":"56bc3bf0-545e-492a-9f06-abd4b9e3ffb5","resolution":{"observed_at":"2026-08-06T21:19:44.964871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.954251Z","title":"**E** - Early blastocyst 3","venue":null,"work_id":"802e7550-8cf2-471d-abe3-46e00f616b8d","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.562213Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:1e1b7ce43809d442f5658d3afc0b1d2887b9e67dc400ea21864b45d4a7966fbb","observation_id":"f684a584-5991-4a67-a1aa-b443994bcc49","resolution":{"observed_at":"2026-08-06T21:19:44.957213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.945947Z","title":"(D) No","venue":null,"work_id":"230b7fc9-b1b8-4b45-88a4-0f392284f6da","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.753763Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d36e083a52f1c5ff942526772195627c3f993ef4274b6c737eb1ae3d5d4bdd2f","observation_id":"11dbcc7f-07d4-4bfd-9fd0-89dcdfd5d89f","resolution":{"observed_at":"2026-08-06T21:19:44.948916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.936772Z","title":null,"venue":null,"work_id":"fc96639c-b25f-42fe-b6cb-d055f6e8b50a","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.888306Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:b2b474507592353a76b187bb5e3b8f6763454649ae5e4c536afd4d6e5bec7913","observation_id":"7448bd87-3e1f-46a6-9bd6-fc8b96006fee","resolution":{"observed_at":"2026-08-06T21:19:44.939965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.927040Z","title":null,"venue":null,"work_id":"c39a3972-f038-4609-bd58-b1b8314a0756","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.048251Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f09c68ad00535493cbdd4363e57f9185ac22f73519fb2f0e366f9363496369c2","observation_id":"fc7a62d8-836e-4b9c-85a4-3c8aa8f6a1cd","resolution":{"observed_at":"2026-08-06T21:19:44.930051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.898597Z","title":null,"venue":null,"work_id":"d08470e2-d343-4131-803d-e89a3cc3a010","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.250601Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:19d2ce3f376f8e1421057cacbce9880e961be0a482ccbc82f4f45e61525579c0","observation_id":"e6b28067-6d4a-4129-a304-bffe378bbf2b","resolution":{"observed_at":"2026-08-06T21:19:44.920005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.773153Z","title":null,"venue":null,"work_id":"c8d9cb9c-07fc-46e8-b400-3252571dbdf0","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.419828Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f94663026d0356330a5571d8529dc987e523cc5772f3bce8e1656edf2165c958","observation_id":"52c84aee-7ee7-4961-a5b7-29a97ddc5936","resolution":{"observed_at":"2026-08-06T21:19:44.850249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.538528Z","title":null,"venue":null,"work_id":"721f9198-ad13-4200-a329-f50280659dd1","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.629321Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:0be26c767a0baac410c62f9feb7b69097bba57ca19929d26d606ce50fcc7c11b","observation_id":"ab215d8c-386d-424d-8cac-6d20dfabc0da","resolution":{"observed_at":"2026-08-06T21:19:44.638857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.325061Z","title":"objects\": [ {","venue":null,"work_id":"7021d8f6-7593-4e51-b598-886836568428","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.743404Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a9898a08406b66808f58f6e7c10ad8dc1a744c67e3f458e2724114a476592fa7","observation_id":"bdeacc47-2d6a-4866-ae5d-8a665d175dc6","resolution":{"observed_at":"2026-08-06T21:19:44.429933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.160372Z","title":null,"venue":null,"work_id":"592eff81-840a-480e-b60c-ed656000d359","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.783517Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:88d1f8a08bab92a8a0635237b3e0ed9e8e251316b1cb0acf5402616ba14c7540","observation_id":"35053a44-ae4e-4854-9b81-98b7c152a411","resolution":{"observed_at":"2026-08-06T21:19:44.238427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:43.988283Z","title":null,"venue":null,"work_id":"556f6007-5872-40cf-b80a-26a3d49bf859","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.836296Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:58769fb18cf25e3074ccbccde7b20daa019f1211f3f4fb96aa5faecbf08f51a0","observation_id":"5b2c26af-e05c-445d-ad92-00dc4fc1c7ec","resolution":{"observed_at":"2026-08-06T21:19:44.075489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:43.646477Z","title":null,"venue":null,"work_id":"00580a8a-50cb-4dcf-b04c-9dd0b461c57b","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.927117Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f879144810ecb834eecb7cd4b8db3c5cf544c1c52c96644674a83bf2fccdd1bf","observation_id":"0700ebef-9854-4246-8fec-40276333546d","resolution":{"observed_at":"2026-08-06T21:19:43.777934Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:43.613818Z","title":"The correct answer is: (C) smaller than Qwen-VL-7B + SMART ： The derivative of the function y = log_2(x) is \\frac{1}{x ln(2)}","venue":null,"work_id":"b976852f-759c-4882-9b41-32f7eec17898","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.977063Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d27f8562fb253a4346d37a10c3f6deaf7ed244369a91103683873003cfc9af8c","observation_id":"5da17c2f-9656-45aa-af6a-8b064383b604","resolution":{"observed_at":"2026-08-06T21:19:43.630021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 0 inbound Pith citation observations for arXiv:2507.02984."}