{"as_of":"2026-08-08T09:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a7c1271caf42029e6aeb2b8a7fb03fcf3d4d3f058115b15653c14c7f8c1b89d","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:50.752373Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03875/citation-record","integrity":"/paper/2608.03875/integrity","json":"/paper/2608.03875/citation-record.json","paper":"/paper/2608.03875"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.519465Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.519465Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:f5d655e7e62fd7be49f4f63b82d1d5f13d0c5c6e45ef334a868716ff467ddb55","observation_id":"4279d3ba-80c9-46e0-b426-abdf5d33acce","resolution":{"observed_at":"2026-08-05T10:39:50.519465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.524495Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.524495Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:cae4b8c185f58665d054aee25a6995803a2b9fa17a187a1af3e993509663b0bc","observation_id":"0c9cea06-160d-489a-b4a6-cc69f83ce696","resolution":{"observed_at":"2026-08-05T10:39:50.524495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.495892Z","title":"2023 , eprint=","venue":null,"work_id":"79cd1952-ed55-42ee-8500-2e325e576e47","year":2023},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.530757Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:275c8135d5d2293ef415dd4e8f7b58b864d0414e0be22f0c95eff0da43f29517","observation_id":"da5d7d47-7bf4-4332-b98b-89c168f7540a","resolution":{"observed_at":"2026-08-05T10:39:51.504100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.470838Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":"b249c955-532b-44dc-9ab7-34b389edf65a","year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.535388Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:24e3a5b78d5f639ae6a6d3f895bd2b63e2459820a7eacbdfca7d73449e16e3c9","observation_id":"6e93e426-9d50-4590-bab2-519f6f2f0640","resolution":{"observed_at":"2026-08-05T10:39:51.479874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.540135Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.540135Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:78d2b4ce2cea6b62a21347ff70998f6531eda3542db20f0a3aaaaa4eefbb2015","observation_id":"eb11ea94-73ad-4046-9771-598b66381d70","resolution":{"observed_at":"2026-08-05T10:39:50.540135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.436942Z","title":"2023 , eprint=","venue":null,"work_id":"5d23174c-7589-4ebd-ac2e-149724ce6f74","year":2023},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.545453Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d18e77342b75afea85c7f3efac856efe0ce8f69d82b48da876522774bdb92438","observation_id":"d2ad46b7-3186-4055-81e6-b8a7c2b0c75f","resolution":{"observed_at":"2026-08-05T10:39:51.447292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.410467Z","title":"2022 , eprint=","venue":null,"work_id":"857d540f-bba0-464e-a9f5-7e36f8b55f85","year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.550424Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:578ae60346f0bb5b1724458740f2be84450289a69dd8a7f982f528cf0c7556c7","observation_id":"d86fdeef-ecb6-4929-8785-4b3b8a6ad079","resolution":{"observed_at":"2026-08-05T10:39:51.419003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.555423Z","title":"2022 , url=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.555423Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:e7efb9a2685373e9aeee7ea64a7871a9888e3068eb63f63470f89a969315e77a","observation_id":"f176532b-ce3c-4666-b258-8110c5d44b83","resolution":{"observed_at":"2026-08-05T10:39:50.555423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.374813Z","title":"2024 , eprint=","venue":null,"work_id":"7f396b7c-b4af-489b-9dac-d678a6967b81","year":2024},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.560038Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:0aa0b1511ce464ac412c223169afb937026b56b1c2eee04fb5d7fb2a0d55c2ea","observation_id":"1e928e64-4e62-4b2f-868d-9cb07d19d1eb","resolution":{"observed_at":"2026-08-05T10:39:51.383719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.359856Z","title":"2024 , eprint=","venue":null,"work_id":"abf408fa-4ba9-4fb6-8d14-3b2eeba7dd8b","year":2024},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.565505Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:71ab06c37a985251e78c6782f28e6f94045c9c89e171da451988897501944b51","observation_id":"2de98b43-4866-4f04-ba23-3d47deebec18","resolution":{"observed_at":"2026-08-05T10:39:51.364357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.569787Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.569787Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:2ca82e99fcfa31a5b2b1dbe22688923482ca2f2bb27fab74d9edb515ebff0132","observation_id":"a5030185-93e5-4fae-b9d9-f7ef05f35f9f","resolution":{"observed_at":"2026-08-05T10:39:50.569787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.335053Z","title":"2023 , eprint=","venue":null,"work_id":"354810a5-354b-4886-93cc-686ac413a986","year":2023},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.575026Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:04f1f0a32972e8579a83ffff18f8aab9d3f5582778755521f2c6b0e2bef42d80","observation_id":"855f8db7-72fe-466e-9442-0573f39f360f","resolution":{"observed_at":"2026-08-05T10:39:51.339810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.318343Z","title":"2025 , eprint=","venue":null,"work_id":"e29adc00-7542-436b-915d-4bb0ce90ecb9","year":2025},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.579474Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:37186483e4b30ff1dfec36ebc0774b6eb45c50c3386902bd1503604d4ff62462","observation_id":"5f93d832-d65b-4b71-853f-8ab816697dc6","resolution":{"observed_at":"2026-08-05T10:39:51.323575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.301040Z","title":"2020 , eprint=","venue":null,"work_id":"faf3e9bf-2261-44e0-8365-23c1e6110e53","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.584515Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:7e817a582bb89b0e919d1f412f70a092a2d546833010176dc78963b969c5a6e4","observation_id":"ff478223-4fa7-4fe5-b643-3fd9402f3f29","resolution":{"observed_at":"2026-08-05T10:39:51.305876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.284653Z","title":"2018 , eprint=","venue":null,"work_id":"a2cd99c3-d606-42c8-9299-9359c61bc96b","year":2018},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.589264Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:0141961fd52e03ee4aa4b10361f9b97d9c6743598ed44b2d74cd3ca654f7f183","observation_id":"6108c9d0-7535-4de9-862e-a0a456a15019","resolution":{"observed_at":"2026-08-05T10:39:51.289695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.268236Z","title":"2020 , eprint=","venue":null,"work_id":"65d048c2-17a7-41cd-8bf9-3251dd9eff63","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.594281Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:110b6195343b4476dcaca46c699b4f7f6fd0e8f4a30bb69a98eaf809d2a22a1c","observation_id":"dd945a46-8720-4882-840e-e5b8aac1afd7","resolution":{"observed_at":"2026-08-05T10:39:51.273409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.252026Z","title":"2019 , eprint=","venue":null,"work_id":"8b6ce6ce-ba70-43f5-99c1-5a489b24284e","year":2019},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.598763Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d0063dd899b7ca233926b9403af5b859de74d3cffa944433aa28a13feb634b2b","observation_id":"92eb70fb-db87-481d-b287-a2be7f460f56","resolution":{"observed_at":"2026-08-05T10:39:51.256752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.237210Z","title":"2020 , eprint=","venue":null,"work_id":"b9d351b5-d0c4-4a73-91f8-53f88103335c","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.603600Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:505fefd68da05fe6498cfe25713f730aecbe0b34aa1db6831a0470ee9e1dab41","observation_id":"c9a9337f-84fc-44ba-8167-fd02662756f3","resolution":{"observed_at":"2026-08-05T10:39:51.241948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.608134Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.608134Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:8fca451635e36acf3608378c847c92249a4baa0effd961d844f2c8bb1b3057c3","observation_id":"1f3c0fa2-603a-41c4-b27e-c554a746c283","resolution":{"observed_at":"2026-08-05T10:39:50.608134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.210970Z","title":"2020 , eprint=","venue":null,"work_id":"68147462-8221-47f9-884e-00db3c072769","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.612961Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:8494fb9f65a910ffdd816954664953ae40c54713cd34a3b41ae8f2a4e04f068a","observation_id":"d8cb0426-bfd1-4237-b9cd-28a277474898","resolution":{"observed_at":"2026-08-05T10:39:51.215734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.195761Z","title":"2016 , eprint=","venue":null,"work_id":"6116f641-c53b-4720-a9b9-50cd2e1d617c","year":2016},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.617384Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:5dcf4a15c733d770f8d2b7015ab0f0cc4d693a224953102b9e205fdf04bbd3b0","observation_id":"e147877a-9bd5-443a-89e7-d44690e6f953","resolution":{"observed_at":"2026-08-05T10:39:51.200721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.181023Z","title":"2017 , eprint=","venue":null,"work_id":"f1c89a4b-9ace-4e59-a618-68c5daac10a7","year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.622299Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:4b0f3ec580907d7f3b5b597829d53b6d44eacef83a8639fb2fb1b7d4ab785643","observation_id":"852696a5-60c7-4a6b-8e41-a92a6f60ca3d","resolution":{"observed_at":"2026-08-05T10:39:51.185616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.626656Z","title":"and Chopra, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.626656Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d1a3226ed49f868c9afb0ee8d7993c17248eed5201213b7ea94da2784183ab28","observation_id":"af9a05c5-f104-478f-9d2e-3490563e456a","resolution":{"observed_at":"2026-08-05T10:39:50.626656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.631629Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.631629Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:6618997d1476569ec345854d55ee0840332288eef4b323af6d047a48f328214e","observation_id":"791ebae3-a422-47de-8c30-7863aa9aadc2","resolution":{"observed_at":"2026-08-05T10:39:50.631629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.146853Z","title":"2020 , eprint=","venue":null,"work_id":"addd4769-1e2a-448e-a1b8-ce8063bec60e","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.635768Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:045b7b5ffe243e3062baf85e86c7b8253a0f40334f144885b0c234afbba646e6","observation_id":"6f61f2e8-7695-43d3-a705-016d6c32ac06","resolution":{"observed_at":"2026-08-05T10:39:51.151714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.641243Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.641243Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:9cf947a642bb4eacf2d3933330998c62af730c1752f862f5f5e26204f87cf0c0","observation_id":"b3c343aa-00c8-4a2b-ac3a-d9b2a109b67c","resolution":{"observed_at":"2026-08-05T10:39:50.641243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.645676Z","title":"Terry , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.645676Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:1a6976036f4c3ede31aec14be920d5192e0f206bb8c93907e3b2a86a4e191b21","observation_id":"4804c65d-3590-4068-b72a-5631840182cd","resolution":{"observed_at":"2026-08-05T10:39:50.645676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.651522Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.651522Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:8c1d0aadd5216cb48b1187f9fcfa8b9ef6e6ca28a3057d3c8ac128595a93727d","observation_id":"52756f09-709f-447d-838e-b671fbf34fcb","resolution":{"observed_at":"2026-08-05T10:39:50.651522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.101850Z","title":"2021 , eprint=","venue":null,"work_id":"c3aed295-2b5d-4a28-b834-c8a6dee6e787","year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.656277Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:5398f2aeeeb1e947db205dec16342dfd60fb882650d2cf2d47947029ccc8a76f","observation_id":"bab72f3d-c83a-41bb-9146-2707268ac6b3","resolution":{"observed_at":"2026-08-05T10:39:51.107328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.086221Z","title":"2016 , eprint=","venue":null,"work_id":"0975b401-f1c0-4d67-8af3-6f5bff285894","year":2016},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.660979Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:5fbcc8909249df28c6025258c053b0f09cfe9835fd7b062ef3dbeca1c606e3b3","observation_id":"ca7abcee-b447-4840-9c8c-31deea35477f","resolution":{"observed_at":"2026-08-05T10:39:51.091116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.666428Z","title":"and Mathieu, Micha","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.666428Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:431adae1ad8728ff5ada2934461aa03413eb875993f18fad9119c9d6cf0c88ac","observation_id":"a1f17e65-97a5-49a4-a4bf-0d20f3c328e4","resolution":{"observed_at":"2026-08-05T10:39:50.666428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.670958Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.670958Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d00bda6de6a4b151ca8c61aea377e0713853a0c8d5779f3766d36e80633cfef5","observation_id":"62133fbe-576f-4b89-9860-5bcd918ce65d","resolution":{"observed_at":"2026-08-05T10:39:50.670958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22062","last_updated":"2025-08-01T06:40:13Z","snapshot_observed_at":"2026-08-06T12:08:20.848892Z","submitted_at":"2025-07-29T17:59:58Z","title":"Meta CLIP 2: A Worldwide Scaling Recipe","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22062","snapshot_observed_at":"2026-08-05T10:39:50.676419Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.676419Z"},"links":{"cited_paper":"/paper/2507.22062","citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:cc4ab88f472ea0224e27fb44bb4ccdcfa3814dd60f61d3dbbfe7dcf0343f5ec2","observation_id":"5c7b89bf-88f1-4b03-9f7e-bfa49d0f73af","resolution":{"observed_at":"2026-08-05T10:39:50.676419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.681579Z","title":"and Harada, Daishi and Russell, Stuart J","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.681579Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:ad68871ba182e99aa1e60b9d9e338c664246d0505df15fd9781744e0a667b4ef","observation_id":"60c8d64b-2833-41cd-a27a-27aaa4bf5b15","resolution":{"observed_at":"2026-08-05T10:39:50.681579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.051240Z","title":"Model-free preference-based reinforcement learning , year =","venue":null,"work_id":"1e483007-24c9-424c-b14e-ef3918bc7f51","year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.686239Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:21f2121720011b5adfb11e5b7a9842f5430f80e5a8e7f0039dc16700c8af4fc0","observation_id":"fd6706e6-b98a-4fa7-a407-84757c1a28f9","resolution":{"observed_at":"2026-08-05T10:39:51.055957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.690772Z","title":"Advances in Preference-based Reinforcement Learning: A Review , url=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.690772Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:26a59edb41c89723a03f2d0a6a7a340be4fe1d1f5ea09aa0f99af5c7d36a93db","observation_id":"b0ce3377-1c2e-47f9-8df8-3190f9272aca","resolution":{"observed_at":"2026-08-05T10:39:50.690772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.035378Z","title":"2022 , eprint=","venue":null,"work_id":"6253fe9b-2546-49b4-87ed-3e71e95205dd","year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.695332Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:6d47d942011ee4ed4cd16a0095c6284b83df6ae10a6e60ed3ccf518a9a1f085e","observation_id":"70ec5bae-62db-4930-9eee-39f7ee1f0f28","resolution":{"observed_at":"2026-08-05T10:39:51.040226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.699762Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.699762Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:18db20d5fcf3d716e948eabbdf356df3f2154330684f922fc3294ab151506d3f","observation_id":"8d18a458-ddf5-41cf-8804-967c43382758","resolution":{"observed_at":"2026-08-05T10:39:50.699762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.705098Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.705098Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:dfb2be1bbb7dc00af7913c62de64f83cddbdad7f862499af3689d05d73b3b005","observation_id":"49fa5bb8-9792-4850-ab0d-5ce27d823c5a","resolution":{"observed_at":"2026-08-05T10:39:50.705098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.709584Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.709584Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:0f1b1f61cd7ed68137d8bbcb4c764185df173c99f06aa5a7415c824ea0fb917c","observation_id":"21c27120-5b76-477b-bb74-9b219db682ee","resolution":{"observed_at":"2026-08-05T10:39:50.709584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.714563Z","title":"Orbit: A Unified Simulation Framework for Interactive Robot Learning Environments , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.714563Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:3ab0b63db967fe5099c45f167f2edefce2ac1d1b0689a07ff718e99be6cbc009","observation_id":"a3ad831b-8c00-462b-a78e-9ac9868ae026","resolution":{"observed_at":"2026-08-05T10:39:50.714563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.719216Z","title":"doi:10.5281/zenodo.5143773 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.719216Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:1a82f2998b5e1acd91a56b04f2a194a34919e523814f5cdd4f047d959ad03559","observation_id":"3177818c-292a-4d75-b414-b2c617dee1da","resolution":{"observed_at":"2026-08-05T10:39:50.719216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.723949Z","title":"Journal of Machine Learning Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.723949Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:19cc9af956a8582f5c70bae655abcbcda693a1ded8487fa9e7f4a35e46a04225","observation_id":"72cd421a-458a-4d36-bff6-c22cc9c9cc1e","resolution":{"observed_at":"2026-08-05T10:39:50.723949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.969562Z","title":"Proceedings of the 5th Conference on Robot Learning , pages =","venue":null,"work_id":"048485f8-085e-4332-977d-b5e2aff3933b","year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.728946Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:4efc9b9fe9ace180684a64e0e923194e974bfef19adbebdb3bdab645a0f67711","observation_id":"8f5c9055-2cf0-4edd-b9e7-feec406362d3","resolution":{"observed_at":"2026-08-05T10:39:50.974416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.734020Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.734020Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:b4b260d78db1a403cbad52cee7358f99229634f8118ff7a9e6c188443ebc230e","observation_id":"008e05c9-2908-42b9-83f6-ba15edf5f56d","resolution":{"observed_at":"2026-08-05T10:39:50.734020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.943606Z","title":"2017 , eprint=","venue":null,"work_id":"b97f8f43-ea72-42f7-b89a-d021ae85856d","year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.738647Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:191f8fac0e2e7c6f443e1b1b50d5ccabfae7428405583756b6d27b99398c557e","observation_id":"fa12b9cf-840e-4cd2-91a3-fa59ef54ee9c","resolution":{"observed_at":"2026-08-05T10:39:50.948927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.926324Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"7788181f-7745-47d8-8595-a144873b7b2d","year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.742948Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:0d3315f5d982ec13a32f2abe9a2d18e1fc4706c47bf11d723ff95ded4bcbf428","observation_id":"49152e4f-97ec-49e7-a1af-cc5a6c0a0653","resolution":{"observed_at":"2026-08-05T10:39:50.932471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.748020Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.748020Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:ae1b792b7b605ad336c5938ec133a837cc3af7d5bb30660d35d0a564a190074e","observation_id":"8f86e78d-6c1a-444c-bb78-a82660a1a4bc","resolution":{"observed_at":"2026-08-05T10:39:50.748020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.900071Z","title":"2025 , eprint=","venue":null,"work_id":"5feec701-791b-46b5-b0c5-bb5a10baf577","year":2025},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.752373Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d01ab2e2d69945a6511dee515f3bdaa29e007f456d54ea671713938653de934a","observation_id":"7bd474c2-2496-415d-b125-aad8541e5c83","resolution":{"observed_at":"2026-08-05T10:39:50.906097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T23:12:35.914036Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.03875."}