{"as_of":"2026-08-03T11:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf98f986a5f1cdba29cfca674d5b0cda9996f04a3b8b3403c811745264d29422","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T00:58:53.626310Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:28:06.378236Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08354","snapshot_observed_at":"2026-08-01T08:28:06.378236Z","title":"Auto-rubric as reward: From implicit preferences to explicit multimodal generative criteria","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27380","last_updated":"2026-07-29T18:38:23Z","snapshot_observed_at":"2026-08-02T23:26:16.524563Z","submitted_at":"2026-07-29T18:38:23Z","title":"VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T08:28:06.378236Z"},"links":{"cited_paper":"/paper/2605.08354","citing_paper":"/paper/2607.27380"},"observation_digest":"sha256:17db9ea08525409c185cbff6f430ba92d32d6df233148b19f0af0b99db535739","observation_id":"4f787585-04d1-4d5b-8429-ec8508c652b4","resolution":{"observed_at":"2026-08-01T08:28:06.378236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.08354/citation-record","integrity":"/paper/2605.08354/integrity","json":"/paper/2605.08354/citation-record.json","paper":"/paper/2605.08354"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.11791","last_updated":"2024-08-21T17:24:15Z","snapshot_observed_at":"2026-07-06T19:04:09.389583Z","submitted_at":"2024-08-21T17:24:15Z","title":"Critique-out-Loud Reward Models","version":1},"cited_work":{"arxiv_id":"2408.11791","doi":"10.48550/arxiv.2408.11791","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11791","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Critique-out-loud reward models","venue":null,"work_id":"adbb5d79-de43-49c4-abd5-ad004e77abea","year":2024},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2408.11791","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:e7f1f5df9bf87f826b62808721263230e683fa8dc8eb79e8c576af489191bca4","observation_id":"3950b2ef-8a37-4881-a12a-ed5e522102e3","resolution":{"observed_at":"2026-05-12T08:36:24.356872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:e26300fffafbd34cfdcd1876b4eedce331583bf4c779ce396515b39b2197ae50","observation_id":"3c1de410-f99e-4810-9016-3affbb0af498","resolution":{"observed_at":"2026-05-12T08:36:24.331270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07685","last_updated":"2024-09-13T19:06:13Z","snapshot_observed_at":"2026-07-06T16:31:21.196640Z","submitted_at":"2023-10-11T17:35:55Z","title":"Moderate Deviations for the Capacity of the Random Walk range in dimension four","version":3},"cited_work":{"arxiv_id":"2310.07685","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.07685","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving image generation with better captions","venue":null,"work_id":"f1ddc27c-236f-479c-bae8-502f3fff2aab","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2310.07685","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:11d0d5f12649ba94ddf0b98fc6d9d8cf967da70fac75c4930c0878888b3a3af5","observation_id":"67e4e27a-9bf3-4a2e-bd66-08d3fb699d2d","resolution":{"observed_at":"2026-05-12T08:36:24.292545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-01T15:43:51.739518Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2305.13301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-07-08T19:25:32.506868Z","title":"Training Diffusion Models with Reinforcement Learning","venue":"cs.LG","work_id":"67684dda-3930-452a-b91a-36cbb8e2e219","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:8a7054f3aa10b3dcb73fe6c8fbffd7be3bd2d18df690352b66055fdcc0a960fd","observation_id":"751c03d4-9d29-4bd9-b0fa-7bd35d7c2d10","resolution":{"observed_at":"2026-05-12T08:36:24.298241Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.546729Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"182396b0-39b5-4e35-adfd-c6dbe856535f","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:5d8fb9ceb7a8297fce327a3634a7ddb978a5f8277b70568b4829be8d0b62cfc5","observation_id":"3028d25a-25a0-4fcb-b689-756345ae9744","resolution":{"observed_at":"2026-05-14T09:07:27.718423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09568","last_updated":"2025-05-14T17:11:07Z","snapshot_observed_at":"2026-07-06T21:23:57.084147Z","submitted_at":"2025-05-14T17:11:07Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","version":1},"cited_work":{"arxiv_id":"2505.09568","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.09568","snapshot_observed_at":"2026-07-08T00:04:22.585543Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","venue":"cs.CV","work_id":"86d896d2-592f-4d9b-938e-dfeb11f9388f","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2505.09568","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:bcb07565061a7e62905564ba6f7e3d8b65400f614ab9f4473619db5f81fd0f41","observation_id":"94ec0c11-2b73-4052-ade5-f0e772219fb8","resolution":{"observed_at":"2026-05-12T08:36:24.266270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18095","last_updated":"2025-06-22T16:51:09Z","snapshot_observed_at":"2026-07-06T21:45:57.248156Z","submitted_at":"2025-06-22T16:51:09Z","title":"ShareGPT-4o-Image: Aligning Multimodal Models with GPT-4o-Level Image Generation","version":1},"cited_work":{"arxiv_id":"2506.18095","doi":"10.48550/arxiv.2506.18095","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18095","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sharegpt-4o-image: Aligning multimodal models with gpt-4o-level image generation","venue":null,"work_id":"089b1c33-975f-4482-9c6f-590a1181c2dd","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2506.18095","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:b82f08d5644db1f63f246a174028a09dc4d8b31dffb582494bcb1fc3d41334d7","observation_id":"bb07873a-e4b5-4054-b07a-f76fb25daa70","resolution":{"observed_at":"2026-05-12T08:36:24.278633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":"2501.17811","doi":"10.48550/arxiv.2501.17811","metadata_source":"pith","pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","venue":"cs.AI","work_id":"67d9e391-26d1-459e-ab56-07e60511c886","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:46ecfef39b752155466041bc8e62daa7b7c5fb8876f2d412f6813e06f8244cde","observation_id":"14a70efd-31b6-4aef-8aab-62b2bfe6e0db","resolution":{"observed_at":"2026-05-12T08:36:24.236265Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerging properties in unified multimodal pretraining","venue":null,"work_id":"155c7092-d49b-4e7c-8e01-d4874f3bcc63","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:d8a3fb921499a5b1e457cbfb67e73238489c1e0b76fb22155be7b8f4ae25a239","observation_id":"7e40d11d-1492-47f6-b196-1ce587337ad4","resolution":{"observed_at":"2026-05-14T09:07:27.708913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dpok: Reinforcement learning for fine-tuning text-to-image diffusion models.Advances in Neural Information Processing Systems, 36:79858–79885","venue":null,"work_id":"4ff16f3b-a7ad-4059-a360-dbaff6d01ff4","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:5b53dd8055fb5289d113795b235294c994d8e7d34b6534f990ffe4f97d7ac391","observation_id":"220490a5-c16f-4634-9554-e69ecdd5b569","resolution":{"observed_at":"2026-05-14T09:07:27.705009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.608887Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152","venue":null,"work_id":"d52d3151-6a24-42dc-b3a2-75958047958c","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:dfbb10c3976eebffb3fcce1ee3f030521203018db97685bdae78587339f134cf","observation_id":"94418f0c-a87d-4137-8814-a051a95c7b09","resolution":{"observed_at":"2026-05-14T09:07:27.700699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini 3.1 Pro - Model Card","venue":null,"work_id":"40d4c840-2b13-4470-a0c0-ba3295079fbd","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:37ea197fe20f09b59e243906de6b504de50c27ab39498e91a0ac0145f04f4908","observation_id":"aac6e40c-4f2e-499c-a4ec-3e83fe2e7850","resolution":{"observed_at":"2026-05-14T09:07:27.702418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm- rubric: A multidimensional, calibrated approach to automated evaluation of natural language texts","venue":null,"work_id":"82ce0f4c-dd7a-4c14-ad78-fc9b7c534bf8","year":2024},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:1577544ed47c287ad5a508f9465b2eddc43ba310ee9d82a11c64332d7ba69a86","observation_id":"82e0c2ce-0264-4cb4-8b98-f868390fdc05","resolution":{"observed_at":"2026-05-14T09:07:27.710887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":"7a4ce7c2-7e96-4322-bdda-35b4dbbf6481","year":2022},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:ecdc9ac286862f0a4972af8f72a64b7ea23cd676ba9547207ab6b3a4ef548956","observation_id":"611c32cd-5636-45e5-9627-99183a15092b","resolution":{"observed_at":"2026-05-14T09:07:27.714590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-02T05:01:21.775493Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":"2403.05135","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-07-04T16:59:58.040795Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","venue":"cs.CV","work_id":"94248955-4bc5-4517-98a0-66224a36d865","year":2024},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:450136bbe68bd876366a27db8c715cc3182a6e7babdd5a27f7da3fd6d131e6dd","observation_id":"ebd8055c-2e99-4e29-a399-075628cbe76e","resolution":{"observed_at":"2026-05-12T08:36:24.230342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16899","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.730738Z","title":"Multimodal rewardbench 2: Evaluating omni reward models for interleaved text and image","venue":null,"work_id":"f6cf1c5f-00bf-4edc-8218-d6258684e202","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:ea41b1bbc82f4a2531e34bb2100ed2df8b77817fa91c09726aebcd3449d89f12","observation_id":"0042b714-77f7-44f0-84a3-baadee46c78e","resolution":{"observed_at":"2026-05-12T08:36:24.388067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Au- torubric: Rubric-based generative rewards for faithful multimodal reasoning","venue":null,"work_id":"84b118f1-41f7-4b8d-8c71-4d0fb6b96f33","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:505cd33cff8398e9633ba4d156457de1a54e0753563116d6495968edb40f1d6e","observation_id":"77ff6fad-6979-4da5-a4cc-1e04d4a728b1","resolution":{"observed_at":"2026-05-14T09:07:27.712808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prometheus: Inducing fine-grained evaluation capability in language models","venue":null,"work_id":"c6f7f7b4-8a70-41d4-9e95-6987fc49ba3a","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:4e8a4a69d62bb46d86a1d3fe7196dc2157d5c3e38cfd034684907154e1d7bd72","observation_id":"29a40cbd-35da-484a-97d3-ce1fc4c956a0","resolution":{"observed_at":"2026-05-14T09:07:27.722346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:05:55.757899Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Advances in neural information processing systems, 36:36652–36663","venue":null,"work_id":"00e2bd13-9259-4c19-8ac6-cfe745a0da17","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:9402f83930c6b0a3d4ad106bc24b4503f768dae90966e0512b7955c51387fe3c","observation_id":"de4bc6dd-4494-4cfa-a0b4-536200de7216","resolution":{"observed_at":"2026-05-14T09:07:27.724310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:2360cd8a3d281a2d8dcd5b9558b8b2b37c31ca1a271964248024e0ae5046baa4","observation_id":"35ad89ad-905c-41bb-bb79-72a63a99e4c9","resolution":{"observed_at":"2026-05-12T08:36:24.272052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Holistic evaluation of text-to-image models.Advances in Neural Information Processing Systems, 36:69981–70011","venue":null,"work_id":"b2391c80-1be4-4173-9d06-2007847b4606","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:376e7fe94901a8e9667f1d01e3a11f519051e64a3c3a1169ff0181b35078b7b0","observation_id":"c9924609-55b8-447e-b3ef-2815b36d444a","resolution":{"observed_at":"2026-05-14T09:07:27.720279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hp-edit: A human- preference post-training framework for image editing","venue":null,"work_id":"8242a7e7-c530-4732-9b0e-b3c85077e160","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:36596b9c100340fcd257b2d1f24b8ddfc19d0bb7e21ebd0bf029b6bc7081a851","observation_id":"c413196e-4f77-489b-afb1-8e4643481b88","resolution":{"observed_at":"2026-05-14T09:07:27.716499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16888","last_updated":"2025-11-04T13:15:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-19T15:38:06Z","title":"Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback","version":3},"cited_work":{"arxiv_id":"2510.16888","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.16888","snapshot_observed_at":"2026-07-05T16:51:14.250864Z","title":"Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback","venue":"cs.CV","work_id":"9687bd6c-c4f6-4f49-ba59-ca7e825f0710","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2510.16888","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:b6f35012fac7dccb06b5bd8101dd65408678e54bb7bfc39f0a74da07a61b25fb","observation_id":"35f3e1ca-2e85-4bea-8df1-2b605d8329aa","resolution":{"observed_at":"2026-05-21T18:01:19.940440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":"2504.17761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-10T01:46:41.223286Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","venue":"cs.CV","work_id":"3392f2c8-a1cb-4d6c-8c82-2cdccffa33f9","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:07a21118a8e311f51af26705c8b492b808aec1aeaf46d913d42544a16d0911b9","observation_id":"dda05972-e772-46f8-b8de-1766a9614bae","resolution":{"observed_at":"2026-05-12T08:36:24.303623Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.12246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:17:29.553589Z","title":"Examining reasoning llms-as-judges in non-verifiable llm post-training","venue":null,"work_id":"456b967b-36cc-4821-a262-e65ba01044ec","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:8cf1c5ecf9140a490744eae8a7ada38b40f6386c43351f28cce52b7beb828feb","observation_id":"a2450f75-5b43-4524-8d30-c51414d54a7b","resolution":{"observed_at":"2026-05-12T08:36:24.309907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.733583Z","title":"Editscore: Unlocking online rl for image editing via high-fidelity reward modeling","venue":null,"work_id":"478d04d3-d99b-4a09-b3b5-cc62c6528bf7","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:93c5c2eba137cc8805937ffd4d3dc24a1c820886c22086f0c90e505f9aac401e","observation_id":"5fe14fc3-612b-47fa-bcbc-4ef25e8ad837","resolution":{"observed_at":"2026-05-12T08:36:24.248228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:13:49.455908Z","title":"Janusflow: Harmonizing autoregression and rectified flow for unified multimodal understanding and generation","venue":null,"work_id":"fc2beb77-f62c-4e7d-8c18-179e3b92ff63","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:9fc35ada2a16ebf4918fc907c8f3247a49d168ef32a06858d172ab62e88d97c3","observation_id":"726d36de-27e6-452d-81be-9bcd8be1e5b9","resolution":{"observed_at":"2026-05-14T09:07:27.756326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:13:50.609285Z","title":"Hpsv3: Towards wide-spectrum hu- man preference score","venue":null,"work_id":"7f1f4d17-3402-496d-a645-5ef5bc5cd4fa","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:9de58b2350bc3b24a5bab729c2953a622f15de2a0f970c1bfbf157b8655a50ce","observation_id":"8a51b68d-fe4a-4d2d-8c29-077d82a2c921","resolution":{"observed_at":"2026-05-14T09:07:27.751895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.25133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T20:47:23.339252Z","title":"Rubriceval: A rubric-level meta-evaluation benchmark for llm judges in instruction following","venue":null,"work_id":"88c1cf0d-0d56-42af-8edc-227452387c3d","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:0c9459ab110ba7b28b6e00191973ba3fd23aa6858f2f31768105281cae88f271","observation_id":"17f98ef0-ee7a-41bd-9971-374c7a90c3b5","resolution":{"observed_at":"2026-05-12T08:36:24.350557Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rubric is all you need: Improving llm-based code evaluation with question-specific rubrics","venue":null,"work_id":"a722a053-da2b-4b70-b9f1-c1733674df76","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:900d7b94e8a6fb1b51c9044707b27150ed8578fe724f3f63fb3fcf26afb782bf","observation_id":"86311528-4dd1-4a20-a056-6891e40b38c8","resolution":{"observed_at":"2026-05-14T09:07:27.747713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"a3cac700-cadb-4255-a3a7-6892538d9c99","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:7d3037aaf3d08b44707677bc2b5395d41f55a94294d0ba56b81f93ff3c936906","observation_id":"a103dbe1-ae2d-40c5-a7c2-a3f824e621ca","resolution":{"observed_at":"2026-05-14T09:07:27.739283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:24:01.718232Z","title":"Emu edit: Precise image editing via recognition and generation tasks","venue":null,"work_id":"929420c3-fdff-4cf4-996d-371a67bedd6a","year":2024},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:b6fbdc3131434193c099fa841974618fd7c6372aa026d4bcad903f9b9bfa8e7b","observation_id":"ed96d2fd-1377-400c-b345-3b3f4a14330f","resolution":{"observed_at":"2026-05-14T09:07:27.741093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":"2601.03267","doi":"10.48550/arxiv.2601.03267","metadata_source":"pith","pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-07-11T02:17:46.480513Z","title":"OpenAI GPT-5 System Card","venue":"cs.CL","work_id":"ca87689a-0d29-4476-b504-b65dbbb08af4","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:c906d64fad2b380c877de84521eb5bf8d135d3914421a567be2ca98d055e8bca","observation_id":"678c22b1-9ed1-47d1-80a1-6820a95bebfd","resolution":{"observed_at":"2026-05-12T08:36:24.325683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.248784Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"0b297904-18b2-4679-85d9-c59ac060f7e4","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:6b610c988cc0c59e20a9680377a2e66b110e1c84a0cb695f42c0ad3b6accfcda","observation_id":"f1ef059a-2c0d-4321-9b23-3d1817874303","resolution":{"observed_at":"2026-05-14T09:07:27.743213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models are not fair evaluators","venue":null,"work_id":"adafe813-6f36-46b7-8de4-3fa45ea950d3","year":2024},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:d6afb85550b5c792dddd9a0c02015c91eef6726db7cce930aaa5bf23459dc7e9","observation_id":"6cec0736-4e59-48bd-b680-57ae61cf8c34","resolution":{"observed_at":"2026-05-14T09:07:27.745480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-07-10T06:36:52.573462Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:c3f61ee6cc5fb8842e8a71fc0102b50c0a26cc1e6a06159663feaa819ff5d3e1","observation_id":"c47fdb40-26ed-4b05-abe8-a256c3429519","resolution":{"observed_at":"2026-05-12T08:36:24.285094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unigenbench++: A unified semantic evaluation benchmark for text-to-image generation","venue":null,"work_id":"3afc2993-8c04-4cf2-943c-4fc8a4ab9b07","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:9e17fe2916d90d76edfbd151bcd95080095b75e24f21c5e8420a4af960a77311","observation_id":"7b4a540b-ee6c-4d0f-8429-2e42f7c35e6b","resolution":{"observed_at":"2026-05-14T09:07:27.749780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unified multimodal chain-of-thought reward model through reinforcement fine-tuning","venue":null,"work_id":"96b511ff-db04-4934-a86e-6e59043a1601","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:514b11300994426efcbb80995b145dae8390ce04dc5b86b47baee43b30bc4bd8","observation_id":"5aa8752d-adbe-44ac-a7ce-fc7e59aee817","resolution":{"observed_at":"2026-05-14T09:07:27.758453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2503.05236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-07-04T16:59:58.010213Z","title":"Unified Reward Model for Multimodal Understanding and Generation","venue":"cs.CV","work_id":"bf9fcf9a-1781-4008-960e-2bec1a717e4e","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:f41bcfa3f3facc102e0ae0310aee5e14d814b92ac7c150383da251e2e94c78ac","observation_id":"7fc6c5ce-6d3f-41cd-b607-275f81146135","resolution":{"observed_at":"2026-05-14T00:44:31.060111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tiif-bench: How does your t2i model follow your instructions?","venue":null,"work_id":"a2613dfc-58e5-409d-acea-3d38b36c42f5","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:d094945752692630522f5a2120f5d70ee194abf5c9450235e45ee8e200734a05","observation_id":"f0eeac27-edf0-4553-bf15-334b90c1b2d2","resolution":{"observed_at":"2026-05-14T09:07:27.706839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-07-11T00:07:42.221444Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:9ba868efc31de789105da38e94483d9588a5a3edad6075dd421968d754bcfbb7","observation_id":"db1432e4-5424-4d15-802e-b1174662c4e7","resolution":{"observed_at":"2026-05-12T08:36:24.375973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":"2506.18871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-10T01:46:41.215139Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","venue":"cs.CV","work_id":"d3153e5f-b6e2-4ab3-9f41-e24e24d64496","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:18853fc232aeb22077a589f41a4892abdd40599b11928cced147f449327d343e","observation_id":"74ef5eb8-a994-4b05-96d2-987a0ca67840","resolution":{"observed_at":"2026-05-12T08:36:24.337092Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26346","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.698229Z","title":"Editreward: A human- aligned reward model for instruction-guided image editing","venue":null,"work_id":"44f2e6b9-ba11-41a2-9c4f-aee7a3bc1178","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:b0739763027d74e657a27d645161453c0b2bfab16e2378d26c53e1c5cf1edd0c","observation_id":"0168d091-d002-4654-8ff9-6885d5a3c785","resolution":{"observed_at":"2026-05-12T08:36:24.254754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-07-06T15:43:07.989730Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-07-11T01:57:49.722825Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:b9eb72dc7cdbc2bc9bb70b22271d8e01f1c3478d4cefec3f7e0d6e95d64936cd","observation_id":"b074d729-56c5-4882-8486-bb5b95583ec0","resolution":{"observed_at":"2026-05-12T08:36:24.260284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"cited_work":{"arxiv_id":"2506.15564","doi":"10.48550/arxiv.2506.15564","metadata_source":"pith","pith_arxiv_id":"2506.15564","snapshot_observed_at":"2026-07-10T13:37:06.829021Z","title":"Show-o2: Improved Native Unified Multimodal Models","venue":"cs.CV","work_id":"77f00563-1ce6-4fba-9d4e-c8ce83f716ac","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2506.15564","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:3e9d8b1e4451225873ef26e57fe76a5b3535409842710f3188c6955e9f91d918","observation_id":"44cda7a7-86de-4f23-a84f-482ac0943aa9","resolution":{"observed_at":"2026-05-12T18:51:16.424084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17314","doi":"10.48550/arxiv.2510.17314","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Auto-rubric: Learning from implicit weights to explicit rubrics for reward modeling","venue":null,"work_id":"66c4c984-2f9f-4553-9acc-b1b1d4431cfd","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:eb69012a0abd17876eb2c84a359d28aa078690f06679a9dc1fb4e0d7b06a421c","observation_id":"6078169b-dba5-4f1d-a15a-ad1c7a1278aa","resolution":{"observed_at":"2026-05-12T08:36:24.363530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.618368Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"5c5c3eee-061e-4af7-b5f2-2e03489973ae","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:676367b8572892d1c830272ab78cd7ae048b3c3a47650df8e60b220ff596ded2","observation_id":"755eb721-4eb5-42e5-b070-53f743032229","resolution":{"observed_at":"2026-05-14T09:07:27.731663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10928","last_updated":"2024-04-14T04:29:51Z","snapshot_observed_at":"2026-08-02T02:46:23.506253Z","submitted_at":"2023-07-20T14:56:35Z","title":"FLASK: Fine-grained Language Model Evaluation based on Alignment Skill Sets","version":4},"cited_work":{"arxiv_id":"2307.10928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.10928","snapshot_observed_at":"2026-07-07T12:53:50.256862Z","title":"Flask: Fine-grained language model evaluation based on alignment skill sets.ArXiv, abs/2307.10928","venue":"cs.CL","work_id":"a3b792dd-8794-49d6-a684-2d75d7546c83","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2307.10928","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:10f7d721b6b58d45004973f6329b7193e9ed371b5e68ca1539c337d464bd3b5c","observation_id":"1a017449-6d68-4f02-ba82-adcdb4578c77","resolution":{"observed_at":"2026-05-12T08:36:24.343551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imgedit: A unified image editing dataset and benchmark","venue":null,"work_id":"5d0efd3f-b626-4c60-aeb0-a8c8ea097b9d","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:69d9607120301317209a946f62c29f026f7b152e19e756b6542880ed1f237993","observation_id":"a7c18b8b-711a-4fef-b022-43eee0fbff61","resolution":{"observed_at":"2026-05-14T09:07:27.733363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyedit: Mastering unified high-quality image editing for any idea","venue":null,"work_id":"3694229d-0da1-4be8-87d3-c8222e273e22","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:ff2083e8ebbf8cd8e160440693546e4bdc48bc8f740255c1335fdf82e7f5a2e7","observation_id":"f975d7cb-14a3-4f58-a567-83870abf3486","resolution":{"observed_at":"2026-05-14T09:07:27.735115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:24:01.736153Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing.Advances in Neural Information Processing Systems, 36:31428–31449","venue":null,"work_id":"f188cfa5-c2f6-46ca-8ccb-13112b85f663","year":2023},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:2a5edb51db62c663e5fba6245787ab81738bfda796f00c5abef584b5104d56e5","observation_id":"c2014af7-da42-4db9-9a2b-0df6d4396492","resolution":{"observed_at":"2026-05-14T09:07:27.726705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.12247","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T00:19:13.633040Z","title":"Trust your critic: Robust reward modeling and reinforcement learning for faithful image editing and generation","venue":null,"work_id":"b3f45812-f6e7-4b37-b4d8-d21687843ce2","year":2026},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:e6cfdd63d3323a27184882cf7ddf9b98ef68417b0c688bd99a5b471d311435b9","observation_id":"44412989-a5e7-4983-9dc1-32f30ac3e326","resolution":{"observed_at":"2026-05-12T08:36:24.242285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:968d90e1ea8f5c2394cc699a6a7a5727426d429619ad9224d5d27535317828a6","observation_id":"37c8974f-2203-41d6-8cb1-0f07f3b734fb","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"474a4383-f7e9-400d-98b9-e0a707a77bfc","year":null},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:fc88b54de297450d608e1f7213fe3a419afccf4fb048562f343412ba9b010daa","observation_id":"ef488f60-6337-473d-b08b-eebaafdf2909","resolution":{"observed_at":"2026-05-14T09:07:27.729933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"This preserves inter- criterion dependencies and avoids inconsistencies introduced by independent scoring and aggregation","venue":null,"work_id":"711e1aba-2568-429b-b053-0c5e1c542376","year":null},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:8841d017560c222cd0e992c7f6cdf3ef2cade983d7fb98beea076e6e5e3eee14","observation_id":"42fe79d6-ed6f-4fdd-8b64-958bef705378","resolution":{"observed_at":"2026-05-14T09:07:27.737387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d682ad79-8cc6-4c89-838d-7ce37ea09f5a","year":null},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:7a6a62cfbdf259eb77ef5640c89ca4384bd01232c79d2e08dea8f280ea5b3dd0","observation_id":"2d79d28b-204c-4235-ae57-a10fde60d571","resolution":{"observed_at":"2026-05-14T09:07:27.753811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"rank\": [rank_of_Image1, rank_of_Image2]","venue":null,"work_id":"aba10688-cb1a-4a6a-beff-6529e188c606","year":null},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:5ea78f140f2a7c9eed40e0d4c0855564935decedad4259f85571cbd37691f942","observation_id":"8d987a97-220b-4312-8642-088580d5ca10","resolution":{"observed_at":"2026-05-14T09:07:27.760486Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":27,"verified_fuzzy":27},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 1 inbound Pith citation observation for arXiv:2605.08354."}