{"as_of":"2026-08-23T00:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:028036cc8f6a56de7b6da5b02f4a5332454ade53f25796080b82ba0e4af06f46","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":38,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:32:05.943513Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:46:40.955868Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-11T14:40:29.367255Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11763","last_updated":"2024-12-16T13:28:29Z","snapshot_observed_at":"2026-08-21T04:33:39.642850Z","submitted_at":"2024-12-16T13:28:29Z","title":"QUENCH: Measuring the gap between Indic and Non-Indic Contextual General Reasoning in LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T14:40:29.367255Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2412.11763"},"observation_digest":"sha256:d367f417a4475ca2153d5f0909c397908b76a8061a706f44621f13e60e8dcb22","observation_id":"37605045-8e07-4fcc-aa71-3a1ea11bbad7","resolution":{"observed_at":"2026-08-11T14:40:29.367255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T23:05:32.595632Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2503.20314"},"observation_digest":"sha256:80fc62658193b551b110cdf1bab7b13c2a2708148d75bde32727769af889e22e","observation_id":"366c756a-efa0-4229-88a5-3193cb14597c","resolution":{"observed_at":"2026-05-22T23:07:14.582748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-08-20T10:21:54.278311Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-14T20:23:04.022599Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2504.13074"},"observation_digest":"sha256:fdc9a1c964cd343bbf882fa9a6c887ecc15dc25c3f6b99992a3f1d7a9cf87ba0","observation_id":"3d39d3fa-0f16-4b89-b751-fdc8ad602748","resolution":{"observed_at":"2026-05-14T20:23:04.084718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-15T20:32:05.943513Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-21T23:10:17.868149Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.943513Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:424c30afe9728acd29d59bee676aef6e484a28f47d8cf8cd1bf4276da6d58cb9","observation_id":"5a1604d0-71ad-4c33-ae1a-156ae6de2079","resolution":{"observed_at":"2026-08-15T20:32:05.943513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-07T12:19:27.565628Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24871","last_updated":"2025-06-05T05:13:46Z","snapshot_observed_at":"2026-08-18T17:13:47.373678Z","submitted_at":"2025-05-30T17:59:38Z","title":"MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:19:27.565628Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2505.24871"},"observation_digest":"sha256:f638731fdeef76fd47501bab29d3f100d9abd2364c76db69d912a208f8cd40a1","observation_id":"2344a5a9-f500-4012-b701-1bcb8274e308","resolution":{"observed_at":"2026-08-07T12:19:27.565628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-06T16:39:32.032008Z","title":"W.; Constant, N.; Garcia, X.; Roberts, A.; Tay, Y.; Narang, S.; and Firat, O","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12956","last_updated":"2025-07-17T09:50:43Z","snapshot_observed_at":"2026-08-14T03:32:27.029084Z","submitted_at":"2025-07-17T09:50:43Z","title":"FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.032008Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2507.12956"},"observation_digest":"sha256:7b4e57d069f65895d96ce0704173a2963a1d77a614c93f6ae48538eca924c81d","observation_id":"3001ef96-4f98-4c3c-84dc-95869d5cce32","resolution":{"observed_at":"2026-08-06T16:39:32.032008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-06T14:45:31.924141Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17744","last_updated":"2025-07-23T17:57:09Z","snapshot_observed_at":"2026-08-18T01:15:50.607208Z","submitted_at":"2025-07-23T17:57:09Z","title":"Yume: An Interactive World Generation Model","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:31.924141Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2507.17744"},"observation_digest":"sha256:ad54cff12cc382cce7e848d59d279b576cb0eb3d8eeecf5e81bb212f8d2014b0","observation_id":"47b51283-8552-4ce3-824f-d52d1ae6d56b","resolution":{"observed_at":"2026-08-06T14:45:31.924141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-05T00:05:47.735487Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.arXiv preprint arXiv:2304.09151, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06155","last_updated":"2025-09-07T17:55:03Z","snapshot_observed_at":"2026-08-20T05:56:51.995983Z","submitted_at":"2025-09-07T17:55:03Z","title":"UniVerse-1: Unified Audio-Video Generation via Stitching of Experts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T00:05:47.735487Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2509.06155"},"observation_digest":"sha256:2bf487e277b702433a564c18b6d754a32dc300874138ea4afaa13e76cf802472","observation_id":"fd72e770-87ad-4019-b081-af66d1d2c683","resolution":{"observed_at":"2026-08-05T00:05:47.735487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2510.01186","last_updated":"2026-04-14T16:17:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-01T17:59:56Z","title":"ASTRA: Let Arbitrary Subjects Transform in Video Editing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T10:13:10.141426Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2510.01186"},"observation_digest":"sha256:6017311e27da8c5786b3f23c36bec3368189b61a0d7b81a566b5c2c9f3218e21","observation_id":"25155bd6-91ba-470b-8054-077cc211f6c4","resolution":{"observed_at":"2026-05-18T10:16:14.304564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-03T16:25:54.531863Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.arXiv preprint arXiv:2304.09151, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13677","last_updated":"2026-07-31T15:26:54Z","snapshot_observed_at":"2026-08-16T01:03:28.277020Z","submitted_at":"2025-12-15T18:58:18Z","title":"JoVA: Unified Multimodal Learning for Joint Video-Audio Generation and Editing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T16:25:54.531863Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2512.13677"},"observation_digest":"sha256:55867978c66e75fff99b7515f1a0a31bb13400840c195194babb6e95f597bcda","observation_id":"d57b0d29-2d33-4b37-8203-aba4a80749cc","resolution":{"observed_at":"2026-08-03T16:25:54.531863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2512.15840","last_updated":"2026-05-08T06:37:02Z","snapshot_observed_at":"2026-08-11T06:04:17.319434Z","submitted_at":"2025-12-17T18:35:54Z","title":"Large Video Planner Enables Generalizable Robot Control","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T21:26:32.048309Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2512.15840"},"observation_digest":"sha256:ab95afad6e306717d1f75964070cbe17295f037f7cecfaae645042f76f927b6c","observation_id":"c4e2633c-c022-4130-9f89-0536ef95c03e","resolution":{"observed_at":"2026-05-16T21:28:33.914353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2512.20340","last_updated":"2026-04-29T12:00:44Z","snapshot_observed_at":"2026-08-02T10:18:36.960036Z","submitted_at":"2025-12-23T13:15:31Z","title":"The devil is in the details: Enhancing Video Virtual Try-On via Keyframe-Driven Details Injection","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T20:06:30.109866Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2512.20340"},"observation_digest":"sha256:e426a6212528a591d72705fad93dad98b58de8c1c058a1877bd156fa0617b714","observation_id":"d73184d1-0066-41e7-8542-3204490ee170","resolution":{"observed_at":"2026-05-16T20:08:22.965517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2512.21714","last_updated":"2026-04-08T16:31:40Z","snapshot_observed_at":"2026-08-19T16:19:12.886023Z","submitted_at":"2025-12-25T15:31:24Z","title":"AstraNav-World: World Model for Foresight Control and Consistency","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T19:23:58.769472Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2512.21714"},"observation_digest":"sha256:259eddb1089fe4e5dcf576a0eabf485bbbd77e24d7a845895f15cdf3f360451e","observation_id":"7b084fd6-e7fe-492b-bc2d-5d235c48517b","resolution":{"observed_at":"2026-05-16T19:28:20.880096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2602.07775","last_updated":"2026-05-03T01:49:14Z","snapshot_observed_at":"2026-08-15T00:49:04.808892Z","submitted_at":"2026-02-08T02:16:02Z","title":"Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion","version":6},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T07:02:38.876518Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2602.07775"},"observation_digest":"sha256:498ec1f8254374a31fb87e9725d804e66ea340e079dcf02cd79f6238da379e32","observation_id":"08e8f5c2-578d-4450-a68e-0b901e2f8be5","resolution":{"observed_at":"2026-05-16T07:07:30.020350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-13T12:26:54.361488Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.arXiv preprint arXiv:2304.09151,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.03723","last_updated":"2026-06-24T08:25:16Z","snapshot_observed_at":"2026-08-14T15:26:57.559974Z","submitted_at":"2026-04-04T12:59:24Z","title":"SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T12:26:54.361488Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2604.03723"},"observation_digest":"sha256:4e9632b42090fa46d2f019d8f014e74a9c84a486ca6caafba9f00d8c59fae1bf","observation_id":"ff1b578b-5f2a-4657-868b-53954f229892","resolution":{"observed_at":"2026-07-13T12:26:54.361488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2604.08121","last_updated":"2026-04-09T11:41:58Z","snapshot_observed_at":"2026-08-13T22:43:53.484835Z","submitted_at":"2026-04-09T11:41:58Z","title":"Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T18:34:06.558546Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2604.08121"},"observation_digest":"sha256:9ea93b77178fbc58fd7e03f9cbbc3fb9e24db0f82f05533b05bcf4f387efac9c","observation_id":"9265b3c4-665d-4f51-905b-ce09d4ebe32c","resolution":{"observed_at":"2026-05-11T00:20:55.518942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-08-15T22:16:01.152280Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:79d06e09b94ded04d09bbf7c1094d35bb5d9634c451656d3ad7a584176930251","observation_id":"b9ad33c5-c8cd-4f18-a04f-cc1979124bce","resolution":{"observed_at":"2026-05-15T00:58:25.680145Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2604.18648","last_updated":"2026-04-27T07:52:59Z","snapshot_observed_at":"2026-08-14T14:37:04.643881Z","submitted_at":"2026-04-20T01:59:30Z","title":"DanceCrafter: Fine-Grained Text-Driven Controllable Dance Generation via Choreographic Syntax","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T05:57:22.694855Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2604.18648"},"observation_digest":"sha256:93631894b897f8dbf018f1942125e87aea66bcb376437d3fe63a51a94d02bd71","observation_id":"90246a91-eb48-4248-a865-bdf13f80a3e4","resolution":{"observed_at":"2026-05-10T06:01:13.580652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2605.06859","last_updated":"2026-05-07T19:00:12Z","snapshot_observed_at":"2026-08-02T07:36:10.858134Z","submitted_at":"2026-05-07T19:00:12Z","title":"Knowledge Transfer Scaling Laws for 3D Medical Imaging","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:30:50.324360Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2605.06859"},"observation_digest":"sha256:f7ab1c84fd32ef35e3a9c517863c04ae1112c210c296b91824882911c57e83c0","observation_id":"dda758c0-5883-48da-b879-e0c59b376edf","resolution":{"observed_at":"2026-05-11T01:45:51.577140Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2605.17488","last_updated":"2026-05-17T14:56:52Z","snapshot_observed_at":"2026-08-16T04:42:39.882027Z","submitted_at":"2026-05-17T14:56:52Z","title":"Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T14:08:30.802619Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2605.17488"},"observation_digest":"sha256:2f68aef70704b193f2057f49afacb858e3777d4fe6e030dc24e3bf7c8fab18a8","observation_id":"d3a5f21d-48bd-4266-9816-5c1790df75b5","resolution":{"observed_at":"2026-05-20T14:13:21.407463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2606.05290","last_updated":"2026-06-03T18:00:04Z","snapshot_observed_at":"2026-08-17T13:16:54.526457Z","submitted_at":"2026-06-03T18:00:04Z","title":"Do Models Share Safety Representations? Cross-Model Steering for Safe Visual Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T06:16:53.305354Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.05290"},"observation_digest":"sha256:a58d4944205a0b714a30ee00c76940651905dfa05fc7d961def0f5e0a4ccd1bb","observation_id":"a41c8c3d-1a24-482a-9d0f-ea01e3a4d1fe","resolution":{"observed_at":"2026-07-02T08:16:47.717960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2606.13676","last_updated":"2026-06-11T17:59:45Z","snapshot_observed_at":"2026-08-16T17:09:29.605884Z","submitted_at":"2026-06-11T17:59:45Z","title":"Modality Forcing for Scalable Spatial Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T06:45:00.481276Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.13676"},"observation_digest":"sha256:4945acddf230b79c3476216b8b885670a3e5364dd37141ab30bb6a7f96c9453e","observation_id":"903ab17c-a7d7-4d4b-ac83-63d4e7e40313","resolution":{"observed_at":"2026-07-03T15:08:32.570994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2606.17730","last_updated":"2026-06-16T09:47:32Z","snapshot_observed_at":"2026-08-17T09:52:08.829286Z","submitted_at":"2026-06-16T09:47:32Z","title":"ActWorld: From Explorable to Interactive World Model via Action-Aware Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T01:22:12.771098Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.17730"},"observation_digest":"sha256:13385b711306aef0c7dd9dab22a953914d93ce5d2bd79aa053d65b4eb54f83d3","observation_id":"e393fc62-52d1-4ecd-99f9-5838b563ceeb","resolution":{"observed_at":"2026-07-03T20:28:55.384368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2606.26058","last_updated":"2026-06-24T17:33:13Z","snapshot_observed_at":"2026-08-10T18:08:57.833777Z","submitted_at":"2026-06-24T17:33:13Z","title":"DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-25T19:00:23.260939Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.26058"},"observation_digest":"sha256:74e6571819fac3d2bf7360f42a265f9b949f9bc72802815f56db5f94d2f5afb1","observation_id":"ee99e1af-d32d-4128-a9fd-fbb1ff44fae1","resolution":{"observed_at":"2026-07-04T21:10:09.705377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2606.30514","last_updated":"2026-08-01T12:16:01Z","snapshot_observed_at":"2026-08-06T23:11:22.249942Z","submitted_at":"2026-06-29T16:22:54Z","title":"3D Scene-Adaptive Trajectory-Controllable Human Image Animation with Camera Movement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T06:30:11.466718Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.30514"},"observation_digest":"sha256:fd22d0ead6dedbf7f5ccd9a67a09ce316d88c0ef2a89e693f2fee98086175394","observation_id":"891fece8-3675-4cfc-824e-d7b61796b19a","resolution":{"observed_at":"2026-06-30T06:34:18.984750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2606.30514","last_updated":"2026-08-01T12:16:01Z","snapshot_observed_at":"2026-08-06T23:11:22.249942Z","submitted_at":"2026-06-29T16:22:54Z","title":"3D Scene-Adaptive Trajectory-Controllable Human Image Animation with Camera Movement","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-02T20:31:55.826198Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.30514"},"observation_digest":"sha256:3e511e1db2f57b07f686345822d63a48baab73cd423f0a385c1e171061bce8d5","observation_id":"e2a0710d-8a3d-4749-b4d5-60bfce44e90b","resolution":{"observed_at":"2026-07-02T20:37:22.320693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-04T02:02:24.540625Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30514","last_updated":"2026-08-01T12:16:01Z","snapshot_observed_at":"2026-08-06T23:11:22.249942Z","submitted_at":"2026-06-29T16:22:54Z","title":"3D Scene-Adaptive Trajectory-Controllable Human Image Animation with Camera Movement","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T02:02:24.540625Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2606.30514"},"observation_digest":"sha256:42472cf34fe5133426f968fcf64b6f8a6e86241d8d879bfa45c798b9fb6f8df3","observation_id":"14211dfd-948f-4ef7-af5c-14edb6733d98","resolution":{"observed_at":"2026-08-04T02:02:24.540625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":"2304.09151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-10T01:46:40.955868Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":"cs.CL","work_id":"9da4d481-3b5d-4112-a875-d7485df66a3b","year":2023},"citing_paper":{"arxiv_id":"2607.08763","last_updated":"2026-07-09T17:58:29Z","snapshot_observed_at":"2026-08-05T16:08:05.447561Z","submitted_at":"2026-07-09T17:58:29Z","title":"OpenCoF: Learning to Reason Through Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T01:43:37.265723Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.08763"},"observation_digest":"sha256:87caab01a7286ea9218759ed12c992ea411c55869b4b030aa6e754cbb3e49065","observation_id":"188fa137-da5c-4ef5-8765-2935a5d615e1","resolution":{"observed_at":"2026-07-10T01:46:40.957102Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-13T01:59:43.167178Z","title":"arXiv preprint arXiv:2304.09151 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09581","last_updated":"2026-07-17T08:46:32Z","snapshot_observed_at":"2026-08-14T08:42:13.193692Z","submitted_at":"2026-07-10T16:30:29Z","title":"Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T01:59:43.167178Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.09581"},"observation_digest":"sha256:45ef67f26d406cdeb4ec37c22a9c09c6d1dc1df9f26d2fd4ea815cc12d9a3e5a","observation_id":"ae6d63a9-4b13-4cf6-a3f5-508a66bc5b62","resolution":{"observed_at":"2026-07-13T01:59:43.167178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-14T15:10:13.757131Z","title":"arXiv preprint arXiv:2304.09151 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09581","last_updated":"2026-07-17T08:46:32Z","snapshot_observed_at":"2026-08-14T08:42:13.193692Z","submitted_at":"2026-07-10T16:30:29Z","title":"Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T15:10:13.757131Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.09581"},"observation_digest":"sha256:0bc5c8980bc5e891cd473244975cfce200300d1ab0587db23eb74976dc0fbc57","observation_id":"43d787af-45a2-4151-9efd-e1e3045dacea","resolution":{"observed_at":"2026-07-14T15:10:13.757131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-02T07:35:22.524486Z","title":"arXiv preprint arXiv:2304.09151 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09581","last_updated":"2026-07-17T08:46:32Z","snapshot_observed_at":"2026-08-14T08:42:13.193692Z","submitted_at":"2026-07-10T16:30:29Z","title":"Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T07:35:22.524486Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.09581"},"observation_digest":"sha256:ffc6625d53632427557d7bc7ef397c09173f551a993e08bba464a52d6002ac3a","observation_id":"3feec889-4ca8-4bfa-a254-de2842719aa9","resolution":{"observed_at":"2026-08-02T07:35:22.524486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-14T03:51:24.547781Z","title":"arXiv preprint arXiv:2304.09151 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11689","last_updated":"2026-07-13T15:22:56Z","snapshot_observed_at":"2026-08-20T06:23:24.871101Z","submitted_at":"2026-07-13T15:22:56Z","title":"From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-14T03:51:24.547781Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.11689"},"observation_digest":"sha256:d53b558f143f49b504e827691a7f8c3bbd6d71dfa9cda43ec2eaeff3883ba9b1","observation_id":"fa91a39c-8815-4492-9f8c-8d5788893576","resolution":{"observed_at":"2026-07-14T03:51:24.547781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-01T15:42:18.896956Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.arXiv preprint arXiv:2304.09151, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18217","last_updated":"2026-07-21T02:55:50Z","snapshot_observed_at":"2026-08-18T12:40:58.574283Z","submitted_at":"2026-07-20T17:51:35Z","title":"HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T15:42:18.896956Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.18217"},"observation_digest":"sha256:649a2d264fef8827e28f3b62471899e930efcbfb3a8b6d3ad318603e53588aaa","observation_id":"b7790bb9-2b43-4fc1-ab2c-6120f1af6921","resolution":{"observed_at":"2026-08-01T15:42:18.896956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-31T23:01:23.077667Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.arXiv preprint arXiv:2304.09151, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24124","last_updated":"2026-07-27T08:06:29Z","snapshot_observed_at":"2026-08-14T17:47:17.559619Z","submitted_at":"2026-07-27T08:06:29Z","title":"ViDS: Video Diffusion Shader using 3D Face Tracking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T23:01:23.077667Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.24124"},"observation_digest":"sha256:15027caea3bd2fb2fcc122a1703bbf83c2430263a33876d4d82769a071a119df","observation_id":"d4d7d0df-b3c4-4a70-b128-48c2d68f83be","resolution":{"observed_at":"2026-07-31T23:01:23.077667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-01T00:52:24.766040Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.ArXiv, abs/2304.09151, 2023.https://api","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26037","last_updated":"2026-07-28T17:45:25Z","snapshot_observed_at":"2026-08-19T07:03:31.070300Z","submitted_at":"2026-07-28T17:45:25Z","title":"Wonder: Video World Model Done Better","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T00:52:24.766040Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.26037"},"observation_digest":"sha256:31e4015be6648a8a109e9dfe2e99e8f9ea741df6289918a290b90f4869e2e1ff","observation_id":"723d299c-333f-4fe5-a369-bb3023d5619d","resolution":{"observed_at":"2026-08-01T00:52:24.766040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-30T22:05:36.512149Z","title":"W.; Constant, N.; Garcia, X.; Roberts, A.; Tay, Y.; Narang, S.; and Firat, O","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26754","last_updated":"2026-07-29T10:49:30Z","snapshot_observed_at":"2026-08-17T03:09:18.549959Z","submitted_at":"2026-07-29T10:49:30Z","title":"StatePlay: State-Aware Game World Models for Mechanics-Consistent Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-30T22:05:36.512149Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.26754"},"observation_digest":"sha256:b3f4c26636ae7965c466538959053a81af1515d7382112b3b3b90afd4657a4fd","observation_id":"7d1862bc-4d52-4bef-9023-ce5242b5e0fc","resolution":{"observed_at":"2026-07-30T22:05:36.512149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-07-31T02:16:07.969747Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining.arXiv preprint arXiv:2304.09151, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28611","last_updated":"2026-07-30T17:58:02Z","snapshot_observed_at":"2026-08-17T10:02:12.384570Z","submitted_at":"2026-07-30T17:58:02Z","title":"Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T02:16:07.969747Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2607.28611"},"observation_digest":"sha256:be36d2b0f858865496b7ba891136b72859145576dd15c1cc61f8f38b409000ac","observation_id":"8674616c-2509-4dbd-903f-49993d1da42a","resolution":{"observed_at":"2026-07-31T02:16:07.969747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-07T22:27:36.444014Z","title":"arXiv preprint arXiv:2304.09151 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05850","last_updated":"2026-08-06T10:24:08Z","snapshot_observed_at":"2026-08-16T22:31:14.353137Z","submitted_at":"2026-08-06T10:24:08Z","title":"MameLoshnLM: Yiddish Language Model and Evaluation Benchmark","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T22:27:36.444014Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2608.05850"},"observation_digest":"sha256:02d13f6339aec873f0fac9180571c9a3ebf31815305cabbe6ee26c3df780ba51","observation_id":"b0a88c5b-bb6b-46c5-80b6-7c9896fda374","resolution":{"observed_at":"2026-08-07T22:27:36.444014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2304.09151/citation-record","integrity":"/paper/2304.09151/integrity","json":"/paper/2304.09151/citation-record.json","paper":"/paper/2304.09151"},"outbound":[],"paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T21:04:53.920781Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 38 inbound Pith citation observations for arXiv:2304.09151."}