{"as_of":"2026-08-10T10:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98a6a44556c9d3285cb7bb208b6f902c4df9132d282cb94492d176ef2bb741e5","coverage":[{"denominator":106,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:41:11.486329Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:34:23.972864Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T13:34:24.602813Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"cited_work":{"arxiv_id":"2607.27372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.27372","snapshot_observed_at":"2026-08-08T13:34:24.602813Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","venue":"cs.LG","work_id":"eda9dbd3-ceb1-48ef-8e67-7a51f8495d6f","year":2026},"citing_paper":{"arxiv_id":"2608.05423","last_updated":"2026-08-05T21:34:42Z","snapshot_observed_at":"2026-08-10T03:50:45.145161Z","submitted_at":"2026-08-05T21:34:42Z","title":"Why the Third Axis Is Freedom","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T13:34:23.972864Z"},"links":{"cited_paper":"/paper/2607.27372","citing_paper":"/paper/2608.05423"},"observation_digest":"sha256:8a7e4b38488669a1bd86b1f99abfe27b047ae9e2ca8dc3b5f127f54c68e3cf73","observation_id":"4d4ddc57-f415-4674-9633-d7d9c8efde87","resolution":{"observed_at":"2026-08-08T13:34:24.607979Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.27372/citation-record","integrity":"/paper/2607.27372/integrity","json":"/paper/2607.27372/citation-record.json","paper":"/paper/2607.27372"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.193202Z","title":"Imagenet classification with deep convolutional neural networks.Advances in neural information processing systems, 25, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.193202Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:e3b11f0d0ffca3325199319a3d4e66a15428a720d0070295284eb7aef9996767","observation_id":"d6a6a7f1-ddd0-4ec2-96fd-7cca7dc7448d","resolution":{"observed_at":"2026-08-01T08:41:02.193202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.236697Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.236697Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:202b3c80dc0b2f3e91be9ec7bb239bd56473f633e8c13fd5a096cb06a0f3ed99","observation_id":"c42e6a53-460b-482a-b99a-eaeabb3453c7","resolution":{"observed_at":"2026-08-01T08:41:02.236697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.322985Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.322985Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:f3d889db16702088a9f89943b27cc1191ab203a3d7dfe842f7f12117a6bd909b","observation_id":"b4a4a141-9822-41c8-a5ce-3ec55a0cb439","resolution":{"observed_at":"2026-08-01T08:41:02.322985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.403109Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.403109Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:bff5d4dc61a30bc747b5fd6ec0cec5b0b9fde2c5dfec500a90a6a75a22481b28","observation_id":"209beb9e-a7d5-44fd-a14e-50b45515fda4","resolution":{"observed_at":"2026-08-01T08:41:02.403109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.490896Z","title":"Do imagenet classifiers generalize to imagenet? InInternational Conference on Machine Learning (ICML), 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.490896Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:75c016c19f519e1308f01864ae3b763bc9244a907d4d75dbab96967b7cc7bcaf","observation_id":"a852621a-0a7a-454a-9541-f8c06abc8255","resolution":{"observed_at":"2026-08-01T08:41:02.490896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.585471Z","title":"Benchmarking neural network robustness to common corruptions and perturbations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.585471Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ec03402fae7820208baee8a16e6cc2bd0c29684b9ce4f6d1681efad44128efb4","observation_id":"6c9f19ba-4c99-4e10-86df-13477be6c13d","resolution":{"observed_at":"2026-08-01T08:41:02.585471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.732631Z","title":"Earnshaw, Imran S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.732631Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ed52747febc67ba3164a1734f6d36e2001c927c41f3e3a096fc06417d59d5cd8","observation_id":"0f50c475-efeb-44e7-980b-d30940b785f6","resolution":{"observed_at":"2026-08-01T08:41:02.732631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:02.887784Z","title":"Sequence level training with recurrent neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:02.887784Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:4d319af4688308b810cc571513a58b911d12d589c28a719c2be8417eb78c21fa","observation_id":"ed243729-0b4c-4f3c-b97f-58ce6bf47e15","resolution":{"observed_at":"2026-08-01T08:41:02.887784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:03.033091Z","title":"Scheduled sampling for sequence prediction with recurrent neural networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.033091Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:9257d5d4fd7d25f4c333f29638d843de00ee2588c2ac587d5e53c5517462e103","observation_id":"bac78bac-91a9-4cdf-810f-b380c287c2aa","resolution":{"observed_at":"2026-08-01T08:41:03.033091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:03.133187Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.133187Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ff5d6c3beccecc3e39d26370e1cc552b33490b22c5bab98f319f5ef1fe6d8126","observation_id":"871d312d-d61a-413e-a262-584745b90fd2","resolution":{"observed_at":"2026-08-01T08:41:03.133187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15321","last_updated":"2024-04-10T18:13:00Z","snapshot_observed_at":"2026-07-06T16:11:47.380913Z","submitted_at":"2023-08-29T14:16:09Z","title":"Elucidating the Exposure Bias in Diffusion Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15321","snapshot_observed_at":"2026-08-01T08:41:03.244967Z","title":"Elucidating the exposure bias in diffusion models.arXiv preprint arXiv:2308.15321, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.244967Z"},"links":{"cited_paper":"/paper/2308.15321","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:2b9f516b82eb11a5bf06c180ffee224de7554f75557b76b518f4fe1ac4ac0a21","observation_id":"45862ed8-d303-4514-bddf-cba526943ad5","resolution":{"observed_at":"2026-08-01T08:41:03.244967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15583","last_updated":"2024-06-16T15:12:11Z","snapshot_observed_at":"2026-07-06T15:32:58.159006Z","submitted_at":"2023-05-24T21:39:27Z","title":"Alleviating Exposure Bias in Diffusion Models through Sampling with Shifted Time Steps","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15583","snapshot_observed_at":"2026-08-01T08:41:03.363097Z","title":"Alleviating exposure bias in diffusion models through sampling with shifted time steps.arXiv preprint arXiv:2305.15583, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.363097Z"},"links":{"cited_paper":"/paper/2305.15583","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:d163dbc104819c989004d3bb0c41569389e802977e0f6b1f60cf8748f77d82bf","observation_id":"656272d7-642f-496e-b680-a34c7c2ebd46","resolution":{"observed_at":"2026-08-01T08:41:03.363097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:03.482385Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.482385Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:2f6c19070c18a204fe79d4705b442ecce5cf1d79569eb75522b63a5492460b44","observation_id":"48c42cc6-c5e4-4df1-866f-93a82c50eebc","resolution":{"observed_at":"2026-08-01T08:41:03.482385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:03.590973Z","title":"Consistency models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.590973Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0e4fe9cb64e53993de2f73427117b0ee1dae10dd984e3ee16585ee94a9ff1f77","observation_id":"a60a6fab-67ab-47b9-9637-70bf95ae869f","resolution":{"observed_at":"2026-08-01T08:41:03.590973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:03.705034Z","title":"Mean flows for one-step generative modeling.Advances in Neural Information Processing Systems, 38:75460–75482, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.705034Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:4a1a1624696ca79370f385d97b4d8c5c20cefbaee1900811a35efe931562d663","observation_id":"92c151cc-babd-474f-a470-080a8f16cb93","resolution":{"observed_at":"2026-08-01T08:41:03.705034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-01T08:41:03.813837Z","title":"Training compute-optimal large language models.arXiv preprint arXiv:2203.15556, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.813837Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:bca8b748f4c0cc4d4fc0766d201da7853b755a5707669e1ae3a606132d38efb2","observation_id":"f288041e-935f-42ed-9f3d-939403f7e500","resolution":{"observed_at":"2026-08-01T08:41:03.813837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:03.894829Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion.The International Journal of Robotics Research, page 02783649241273668, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.894829Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0bc81ab654045819499a7a679582b128a6df6442fdfd99d9dc93db7b148d487c","observation_id":"59749137-1800-4187-828c-3cb848770ff7","resolution":{"observed_at":"2026-08-01T08:41:03.894829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09991","last_updated":"2022-12-21T01:06:18Z","snapshot_observed_at":"2026-08-06T05:32:02.292779Z","submitted_at":"2022-05-20T07:02:03Z","title":"Planning with Diffusion for Flexible Behavior Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09991","snapshot_observed_at":"2026-08-01T08:41:03.999870Z","title":"Planning with diffusion for flexible behavior synthesis.arXiv preprint arXiv:2205.09991, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:03.999870Z"},"links":{"cited_paper":"/paper/2205.09991","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:853c637c797a586bdbc05755a58785ccb77b08b42adee9c31a4f6d97fd6f575f","observation_id":"f63fa51e-8bd2-4013-8316-714d7b01eba9","resolution":{"observed_at":"2026-08-01T08:41:03.999870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.119962Z","title":"Mode forcing: A unifying and predictive theory of genera- tive modeling","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.119962Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:06163a73b9d4f6c077ce4a24377b4ca552aa2ba5b244942d693652f83ce1c910","observation_id":"6b026885-9b5c-4024-9039-4b1de2b9206e","resolution":{"observed_at":"2026-08-01T08:41:04.119962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.195580Z","title":"Generative adversarial nets.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.195580Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:cd640029515761b8344a26049c7017781b4a272e5106b1414894b7b5df3cee72","observation_id":"ab4df2e0-6f59-4965-b7db-a13c0a0317e0","resolution":{"observed_at":"2026-08-01T08:41:04.195580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.288275Z","title":"Training products of experts by minimizing contrastive divergence.Neural computa- tion, 14(8):1771–1800, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.288275Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:8305697e66c67c7422d2a5411993031cb66c5def2492370083e9c721ab8ff25b","observation_id":"4bc664db-14c5-4b86-9d62-82b6a6c0fcab","resolution":{"observed_at":"2026-08-01T08:41:04.288275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.403511Z","title":"Implicit generation and modeling with energy based models.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.403511Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:22cda3921c9ded92dc9f595da4cf1261f09e935f2767cd6d6d2ecce3b7ce1a6b","observation_id":"2d336a95-0bed-48e6-8c9c-ea53dfd7bf5d","resolution":{"observed_at":"2026-08-01T08:41:04.403511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-01T08:41:04.502848Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.502848Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:2dd8b45c44529614421eec6ff4d480c25ddc108cfabc412431897066eaa19b32","observation_id":"2ddb17f4-1aea-4c71-969f-1803ba307def","resolution":{"observed_at":"2026-08-01T08:41:04.502848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.615640Z","title":"A note on the evaluation of generative models","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.615640Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ea1d6aeab0d0ffb96e9968da51f27456be7e0b3389e0f1a486fc429417993a34","observation_id":"056f79f0-56e0-41d4-b4f9-324ab0b2fe92","resolution":{"observed_at":"2026-08-01T08:41:04.615640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-01T08:41:04.726377Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.726377Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:c31ff5e394409cff4bc889dde6e88605fd53e987d39879684e767903d8524c19","observation_id":"98db6841-9e9e-45f7-94eb-4db49bb665a0","resolution":{"observed_at":"2026-08-01T08:41:04.726377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.797716Z","title":"Guiding a diffusion model with a bad version of itself","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.797716Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:a6d71db02e4bd099cd3e95a45da9627dda297887d9109feac21c4f582e8483f0","observation_id":"a50a89b0-1654-4f7b-93bf-d12762bc3040","resolution":{"observed_at":"2026-08-01T08:41:04.797716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07524","last_updated":"2024-11-10T20:34:34Z","snapshot_observed_at":"2026-08-10T09:59:40.027064Z","submitted_at":"2024-06-11T17:51:40Z","title":"Simple and Effective Masked Diffusion Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07524","snapshot_observed_at":"2026-08-01T08:41:04.875834Z","title":"Simple and effective masked diffusion language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.875834Z"},"links":{"cited_paper":"/paper/2406.07524","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:fb587614979e3b9e9f952edb0f8f49499deb74017e863438178700fb5a9683d9","observation_id":"fecf4ec4-b578-40a2-9d8a-4126edc89f39","resolution":{"observed_at":"2026-08-01T08:41:04.875834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:04.954535Z","title":"Murphy, and Tim Salimans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:04.954535Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:b14407268a7e607c9ab1864ed9de718c0a6c2fe405e2610c9de4960375171cd6","observation_id":"97505943-2724-4971-991a-d4837d80e494","resolution":{"observed_at":"2026-08-01T08:41:04.954535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.028534Z","title":"Albergo, Nicholas M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.028534Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:92fae7f577da8833669c7f59ebc87d1c837314c56ce156e5467cc962a4e27c03","observation_id":"28e4784a-f022-4969-b643-f2a842975a24","resolution":{"observed_at":"2026-08-01T08:41:05.028534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.106042Z","title":"Jumpy generative models: Unleashing the hidden spectrum in generative modeling","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.106042Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:3e3ea5873b21ffbc3eb234a046e14656c3796e615e6f3928b6e4e596a2e9da7f","observation_id":"63a360aa-43ed-4212-aa85-2c9987664f8e","resolution":{"observed_at":"2026-08-01T08:41:05.106042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.180828Z","title":"Gpt-4 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.180828Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:13c17fd4586f334f1eb880de168633aff794f1e450bcd62f6f68ed69ab71807c","observation_id":"43525473-fc14-48e9-abdc-34b83d559b55","resolution":{"observed_at":"2026-08-01T08:41:05.180828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.251243Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.251243Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:bc8c5d5d56a86ba1c88eff692f69cda190cf5825fe9376163e0546b4ba743c35","observation_id":"c1e2d7b5-9007-41e2-901c-568e36e1e006","resolution":{"observed_at":"2026-08-01T08:41:05.251243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.341597Z","title":"Stochastic multiple choice learning for training diverse deep ensembles","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.341597Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ae8e337879f0668aeb1e1b32cf0d14ac8516712775f4930520bf92b096103179","observation_id":"8ee63ce4-9132-4d9a-893d-6ebbd89be3d2","resolution":{"observed_at":"2026-08-01T08:41:05.341597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09087","last_updated":"2018-10-22T17:56:37Z","snapshot_observed_at":"2026-08-09T19:24:23.296891Z","submitted_at":"2018-09-24T17:57:25Z","title":"Implicit Maximum Likelihood Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09087","snapshot_observed_at":"2026-08-01T08:41:05.500579Z","title":"Implicit maximum likelihood estimation.arXiv preprint arXiv:1809.09087,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.500579Z"},"links":{"cited_paper":"/paper/1809.09087","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:846911f4bb8ef708d717b16dfbe9cc9ddf1b2fe78a99a7077b71bf5df8f06c40","observation_id":"c648228e-36b2-467e-bc1d-d0d0c3155e9a","resolution":{"observed_at":"2026-08-01T08:41:05.500579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.576080Z","title":"Diverse imitation learning via self-organizing generative models.IEEE Transactions on Neural Networks and Learning Systems, 36(4):7145–7157, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.576080Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:75d367847b05b06d1c7c22c1d926eac0d91e6ea87e91f2372232111ed4129d96","observation_id":"27afe137-d983-4718-8d26-58238c57ac25","resolution":{"observed_at":"2026-08-01T08:41:05.576080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-01T08:41:05.671457Z","title":"Auto-encoding variational bayes.arXiv preprint arXiv:1312.6114,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.671457Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:afd4af057ee7a7b473e3d8ad59c118ddd0a593263dd0ea6dfe9bd670bd4d45bd","observation_id":"3348015c-e95a-4fc2-8db4-2dde7b8132bb","resolution":{"observed_at":"2026-08-01T08:41:05.671457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:05.749253Z","title":"NV AE: A deep hierarchical variational autoencoder","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.749253Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:9bbbd853ee6a18db1714a6d0aaa0dc8b503122a011671d3882d063a212d39936","observation_id":"938fd98b-8ca5-44c2-93a3-b3fe0052fcc7","resolution":{"observed_at":"2026-08-01T08:41:05.749253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07804","last_updated":"2022-04-04T18:55:28Z","snapshot_observed_at":"2026-08-10T01:50:09.823474Z","submitted_at":"2021-12-15T00:09:38Z","title":"Tackling the Generative Learning Trilemma with Denoising Diffusion GANs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.07804","snapshot_observed_at":"2026-08-01T08:41:05.827379Z","title":"Tackling the generative learning trilemma with denoising diffusion gans.arXiv preprint arXiv:2112.07804, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.827379Z"},"links":{"cited_paper":"/paper/2112.07804","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:06405dd7d635690510bdf97392808b52f4e1fa6c96dafe243a09c5d040bc9d19","observation_id":"c7cf0faf-d03f-403c-bf84-3c6363b7cd9a","resolution":{"observed_at":"2026-08-01T08:41:05.827379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00482","last_updated":"2024-03-11T14:27:48Z","snapshot_observed_at":"2026-07-06T14:47:04.817434Z","submitted_at":"2023-02-01T14:47:17Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00482","snapshot_observed_at":"2026-08-01T08:41:05.922352Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport.arXiv preprint arXiv:2302.00482, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:05.922352Z"},"links":{"cited_paper":"/paper/2302.00482","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0145b22ec8ad6ae0bc4ec8e4c43287d29f08efb41c145d9ab4e5f766b9d5e751","observation_id":"02480333-c11d-4330-8b61-9bad12f6756e","resolution":{"observed_at":"2026-08-01T08:41:05.922352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:06.030448Z","title":"Learning with minibatch Wasserstein: asymptotic and gradient properties","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.030448Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0131f636299fd10398c48e805a6044358f8b426e85710d4dd396719149dde04b","observation_id":"9dec99ac-33c9-4bd6-bdf5-5b9f5755eb7c","resolution":{"observed_at":"2026-08-01T08:41:06.030448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:06.137753Z","title":"The bitter lesson.Incomplete Ideas (blog), 13(1):38, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.137753Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:e3fbe03a663c2bc520bf68c0be293f4c64d2cabed514f9ac58f794c99533096a","observation_id":"6512728f-ad0b-4c62-bac3-15aa79e97626","resolution":{"observed_at":"2026-08-01T08:41:06.137753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:06.254003Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.254003Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:737c301cc76961565a60ff169c4ac378dfe96a1132f240f34fa277ae1fc297a8","observation_id":"ff5cb82f-7496-4f36-a148-425e766e1ee9","resolution":{"observed_at":"2026-08-01T08:41:06.254003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.28190","last_updated":"2026-04-30T17:59:51Z","snapshot_observed_at":"2026-07-30T01:53:26.758901Z","submitted_at":"2026-04-30T17:59:51Z","title":"Representation Fr\\'echet Loss for Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.28190","snapshot_observed_at":"2026-08-01T08:41:06.375333Z","title":"Representation Fréchet loss for visual generation.arXiv preprint arXiv:2604.28190, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.375333Z"},"links":{"cited_paper":"/paper/2604.28190","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:6f9c520e1a5574400950b5c55a3fa2f461f16c4f8d30273f12e8dc4739251c4e","observation_id":"95fdf436-7b12-4c18-b026-94c9d6033fee","resolution":{"observed_at":"2026-08-01T08:41:06.375333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18324","last_updated":"2026-05-18T12:42:34Z","snapshot_observed_at":"2026-07-06T23:29:14.916114Z","submitted_at":"2026-05-18T12:42:34Z","title":"Improved Baselines with Representation Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18324","snapshot_observed_at":"2026-08-01T08:41:06.501303Z","title":"Improved baselines with representation autoencoders.arXiv preprint arXiv:2605.18324, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.501303Z"},"links":{"cited_paper":"/paper/2605.18324","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:623c62c18c0519fd39cf54170d186ae02cfaf81a41b8cb0d92c473137302723c","observation_id":"44be4544-1aef-4a81-a48e-b79e111ff4f6","resolution":{"observed_at":"2026-08-01T08:41:06.501303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.11690","last_updated":"2025-10-13T17:51:39Z","snapshot_observed_at":"2026-07-06T22:32:32.632779Z","submitted_at":"2025-10-13T17:51:39Z","title":"Diffusion Transformers with Representation Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.11690","snapshot_observed_at":"2026-08-01T08:41:06.611843Z","title":"Diffusion transformers with representation autoencoders.arXiv preprint arXiv:2510.11690, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.611843Z"},"links":{"cited_paper":"/paper/2510.11690","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:a6ee27c42ba35b4d8e2a130c5c5c42543b4e839adec1a7cc354d54c8d2ba7687","observation_id":"c981edfa-b637-4f04-888f-c15eda786170","resolution":{"observed_at":"2026-08-01T08:41:06.611843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02908","last_updated":"2025-04-30T08:39:26Z","snapshot_observed_at":"2026-08-09T12:40:33.547471Z","submitted_at":"2024-09-04T17:48:19Z","title":"Masked Diffusion Models are Secretly Time-Agnostic Masked Models and Exploit Inaccurate Categorical Sampling","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02908","snapshot_observed_at":"2026-08-01T08:41:06.695356Z","title":"Masked diffusion models are secretly time-agnostic masked models and exploit inaccurate categorical sampling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.695356Z"},"links":{"cited_paper":"/paper/2409.02908","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:d79bebad00b86b539d8c23892d544c931aebfd22e2b8575c7b188005655b987d","observation_id":"b47c3290-5575-436a-ba1e-a7f2251738e0","resolution":{"observed_at":"2026-08-01T08:41:06.695356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02718","last_updated":"2026-04-03T04:21:20Z","snapshot_observed_at":"2026-07-06T22:52:02.162758Z","submitted_at":"2026-04-03T04:21:20Z","title":"Generative Frontiers: Why Evaluation Matters for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.02718","snapshot_observed_at":"2026-08-01T08:41:06.719845Z","title":"Generative frontiers: Why evaluation matters for diffusion language models.arXiv preprint arXiv:2604.02718, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.719845Z"},"links":{"cited_paper":"/paper/2604.02718","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:a5200e87e1a0319dcb2a815c60d1fcbe8f622d7a544cb7a208f311f8bba3fdf4","observation_id":"3b5c18fe-151b-434e-8ba0-cb426d178d57","resolution":{"observed_at":"2026-08-01T08:41:06.719845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16834","last_updated":"2024-06-06T21:06:44Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:59:12Z","title":"Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16834","snapshot_observed_at":"2026-08-01T08:41:06.786957Z","title":"Discrete diffusion modeling by estimating the ratios of the data distribution.arXiv preprint arXiv:2310.16834, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.786957Z"},"links":{"cited_paper":"/paper/2310.16834","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:537f969c738455bef9c2a6a2b4d5e1d59b09d389c17e400a1354289c4b7a75a3","observation_id":"8760b9d3-a16a-4546-9c15-874efeb6938b","resolution":{"observed_at":"2026-08-01T08:41:06.786957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:06.942897Z","title":"something something","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:06.942897Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:121d139b17d86c8aa1cadd99d48756e592df0947fd68236d2d19f700c0903ad3","observation_id":"e43cacd8-259f-40f0-ad5b-4fabd1a32690","resolution":{"observed_at":"2026-08-01T08:41:06.942897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.087782Z","title":"Diffusion beats autoregressive in data-constrained settings.Advances in Neural Information Processing Systems, 38:10581–10606, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.087782Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:a607fe05eedae94c680e6669a7e1bce9681cec46d54d84d8ef76c67845d4e5b6","observation_id":"79782013-9f20-46c6-8303-b0b40128b22f","resolution":{"observed_at":"2026-08-01T08:41:07.087782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.164424Z","title":"Deep double descent: Where bigger models and more data hurt.Journal of Statistical Mechanics: Theory and Experiment, 2021(12):124003, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.164424Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:97aa33160a7041dc7bf1ebcecefcee9fded9c18fe3773253a5cd08da26417374","observation_id":"dad8b34d-87de-4a2e-a435-c31a3732d5f9","resolution":{"observed_at":"2026-08-01T08:41:07.164424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02113","last_updated":"2025-07-10T13:56:52Z","snapshot_observed_at":"2026-08-07T17:39:13.854586Z","submitted_at":"2025-03-03T22:56:04Z","title":"Deep Learning is Not So Mysterious or Different","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02113","snapshot_observed_at":"2026-08-01T08:41:07.252186Z","title":"Deep learning is not so mysterious or different.arXiv preprint arXiv:2503.02113,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.252186Z"},"links":{"cited_paper":"/paper/2503.02113","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:a926794984489efbe49ff13731b7a1be47c1b07554da54ac25728ef6add244a1","observation_id":"5ee2a5e1-1984-4a6e-b34a-9f492ee146e2","resolution":{"observed_at":"2026-08-01T08:41:07.252186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.311294Z","title":"Slowrun: Language modeling with infinite compute, fixed data, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.311294Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:bd57e5df9dc0299eb4ad6ce7d0226438bdb641ad0a59167411afcfa6fcac0b1a","observation_id":"c3b248c5-9a30-46a3-b87e-05e27a5e6fe9","resolution":{"observed_at":"2026-08-01T08:41:07.311294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.425835Z","title":"Pre-training under infinite compute","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.425835Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:2e72f35dfeb2ffd9f4026ac12089a70c9a6aed0200b3d8841d7fca8077aa9d0f","observation_id":"cffc3888-ece0-4a0e-a482-50a8eeb44672","resolution":{"observed_at":"2026-08-01T08:41:07.425835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.486830Z","title":"sd-vae-ft-mse, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.486830Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:e10e08a111163897f078f46bfef53dcd2158fa473bcb154b5842026823247e1c","observation_id":"0dc97cd9-72cf-4963-9c20-d542b4903cac","resolution":{"observed_at":"2026-08-01T08:41:07.486830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.558635Z","title":"Scalable diffusion models with transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.558635Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:4ce156c9a36917303b2807c03ca9d21714236893dc05651ad7ad729ee1b19bd0","observation_id":"17ed9dba-a2fd-4df0-a313-b9478ce0f835","resolution":{"observed_at":"2026-08-01T08:41:07.558635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.616961Z","title":"Fast training of diffusion models with masked transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.616961Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:7da7bf2319d9db62f688db8128a0c28ef9c27edb9540b6819ebfbb143440bd7d","observation_id":"0e5ef910-2136-4c76-b44c-ef221bac426b","resolution":{"observed_at":"2026-08-01T08:41:07.616961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.691086Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.691086Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:49bf0285e18338faf58a05f17b89bacfc7ea5e3b8e0542d1f4f8921f2bd3abc8","observation_id":"40f64df5-1871-45ba-95ae-15ffe27885a1","resolution":{"observed_at":"2026-08-01T08:41:07.691086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.759675Z","title":"Reconstruction vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.759675Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:96ec04830c83ff2e5aa1d814591d2a282e76101e6b36435a5661b1de61877fe1","observation_id":"d5e26cde-d7d4-4e57-b848-aad23b684804","resolution":{"observed_at":"2026-08-01T08:41:07.759675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.843944Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.843944Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0cce9d5ce917c388bc1074c312bcb688f4378aa6b51e46ae7e97867774ce44cc","observation_id":"401a55df-dfc9-4711-bc1c-fbd406070f0f","resolution":{"observed_at":"2026-08-01T08:41:07.843944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:07.935698Z","title":"Ddt: Decoupled diffusion transformer, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:07.935698Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:723807a2c8f5d1234ef72f57c85cc26cab1099c1def58cf9d0514ecf58e0f6d4","observation_id":"d7427359-ecae-4bf6-99d6-a646461d3523","resolution":{"observed_at":"2026-08-01T08:41:07.935698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.057279Z","title":"Repa-e: Unlocking vae for end-to-end tuning with latent diffusion transformers, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.057279Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:995e0a72bb3f60338aea9f7bef38eda7120f7368dc79ce6ee26d7c604e0da0ed","observation_id":"626cea65-1f64-44c9-90d1-693247fb1fee","resolution":{"observed_at":"2026-08-01T08:41:08.057279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.151041Z","title":"Dinov2: Learning robust visual features without supervision, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.151041Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ed1d0a06585af98546349ba7f6462d9035f85a725a6d36d774c4a55caec1e338","observation_id":"b5652622-9374-4d94-9003-d7d9ee702aa5","resolution":{"observed_at":"2026-08-01T08:41:08.151041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-01T08:41:08.231552Z","title":"D4rl: Datasets for deep data-driven reinforcement learning.arXiv preprint arXiv:2004.07219, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.231552Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:17605b2132640facfa3d73597261049e7af682e46a9f4afbe6af4fea65671df3","observation_id":"4c53297d-a12e-443d-9cba-5e58da8f55f4","resolution":{"observed_at":"2026-08-01T08:41:08.231552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.352459Z","title":"Scaling up test-time compute with latent reasoning: A recurrent depth approach.Advances in Neural Information Processing Systems, 38:41340–41391, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.352459Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:12e3d9d724fce4026eb9a77bb13ea99dbba48ac828811e8db43cc4f00c5581b9","observation_id":"bc5dff03-7473-48ca-a698-8b513b172116","resolution":{"observed_at":"2026-08-01T08:41:08.352459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.435300Z","title":"Visualizing the loss landscape of neural nets.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.435300Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:4c61bb399657abc31c6c757e12e8e441df72ae9805cda461ff81c3558dcd8053","observation_id":"b7c881cb-edb4-46b4-ab36-f4c2b7922b19","resolution":{"observed_at":"2026-08-01T08:41:08.435300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.491914Z","title":"Better & faster large language models via multi-token prediction, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.491914Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:dc9c366da0bfc2b061eab11cdac7df36fc6c86a8a35a07ed6e8d540e1cc00c6c","observation_id":"5b641e22-5a56-44b2-bdfb-245361d310a9","resolution":{"observed_at":"2026-08-01T08:41:08.491914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.577688Z","title":"The free transformer, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.577688Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:33ca4796ed61d79d53739711734e6f4f5efc232a0ecbb179131548c33605305f","observation_id":"22f08360-23c1-412f-bb76-1a6dfd60b2de","resolution":{"observed_at":"2026-08-01T08:41:08.577688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02092","last_updated":"2025-07-02T19:17:29Z","snapshot_observed_at":"2026-08-08T04:36:50.019846Z","submitted_at":"2025-07-02T19:17:29Z","title":"Energy-Based Transformers are Scalable Learners and Thinkers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02092","snapshot_observed_at":"2026-08-01T08:41:08.641850Z","title":"Energy-based transformers are scalable learners and thinkers.arXiv preprint arXiv:2507.02092, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.641850Z"},"links":{"cited_paper":"/paper/2507.02092","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:e403abcf04c723d097130cf139926aea13cd31508f838a595bcb1265f7f82e20","observation_id":"450f36dc-7179-4144-a485-09f06cb68896","resolution":{"observed_at":"2026-08-01T08:41:08.641850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.703046Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.703046Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:42fba65fa18ac3c1e275b6bd6ddadb306b89eb42ebe4a83c893176eca0147821","observation_id":"9c90a561-f38a-4c5f-b04f-a77a6fe52321","resolution":{"observed_at":"2026-08-01T08:41:08.703046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.794388Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.794388Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:b291a205ef679905b6dd2966018a73df7378d271adcaed953b3a709a0385c7f9","observation_id":"d75beefd-9e2d-4b9f-a765-38c2d4d3b6ec","resolution":{"observed_at":"2026-08-01T08:41:08.794388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:08.874643Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:08.874643Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:84934ff7fca34326cdd7cf4fad449caadd460cc802c7513561f87cbe90c3a1a4","observation_id":"9c4ec1fd-cc49-4f8a-808f-da4a6df731c5","resolution":{"observed_at":"2026-08-01T08:41:08.874643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.019459Z","title":"Learning iterative reasoning through energy minimization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.019459Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:12368d60df07de5b62832d52934edc901a86ba2d0ebc77297e14eb2fc68f526c","observation_id":"dc6647c5-0f56-417d-b2f6-b6f755e8a4b9","resolution":{"observed_at":"2026-08-01T08:41:09.019459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06847","last_updated":"2019-06-10T20:36:10Z","snapshot_observed_at":"2026-07-31T21:58:34.677534Z","submitted_at":"2018-02-19T20:59:33Z","title":"Distribution Matching in Variational Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06847","snapshot_observed_at":"2026-08-01T08:41:09.098125Z","title":"Distribution matching in variational inference.arXiv preprint arXiv:1802.06847, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.098125Z"},"links":{"cited_paper":"/paper/1802.06847","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:897f056e993b876df401e8dda48f617895f19a5d3fa46328005677a7946f62d2","observation_id":"0a807b3e-0789-4952-9386-80f0493c7cdb","resolution":{"observed_at":"2026-08-01T08:41:09.098125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.181252Z","title":"Unified latents (ul): How to train your latents.arXiv preprint arXiv:2602.17270, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.181252Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:7a1152e06381146c524c20d489f1fe2cdca1ffde7a800c26ec086f40d1172c17","observation_id":"33482f5f-4d4c-4d4e-be1f-de56de4ac9ed","resolution":{"observed_at":"2026-08-01T08:41:09.181252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.236796Z","title":"KL-regularized reinforcement learning is designed to mode collapse.arXiv preprint arXiv:2510.20817, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.236796Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0431d853439355805c6af56148c9b62650d63e05bb46b47e9b6904a840894ad0","observation_id":"e9eecf3c-a226-48e6-830f-aabd0999d6db","resolution":{"observed_at":"2026-08-01T08:41:09.236796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10751","last_updated":"2025-08-14T15:34:47Z","snapshot_observed_at":"2026-08-07T12:11:52.874985Z","submitted_at":"2025-08-14T15:34:47Z","title":"Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10751","snapshot_observed_at":"2026-08-01T08:41:09.320896Z","title":"Pass@k training for adaptively balancing exploration and exploitation of large reasoning models.arXiv preprint arXiv:2508.10751, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.320896Z"},"links":{"cited_paper":"/paper/2508.10751","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:1a282a715b999cb5006223bfadd8f0832196bb5dbc771862a5104d1fa940987e","observation_id":"f3e1b247-a286-4779-8f1e-f44820c54e7c","resolution":{"observed_at":"2026-08-01T08:41:09.320896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.384405Z","title":"Inference-aware fine-tuning for best-of-n sampling in large language models.arXiv preprint arXiv:2412.15287, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.384405Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:66dd4e1132ea2ba6f5475fc3700e3df133b544758b2562977b101bed2365289e","observation_id":"6952a280-a2fc-40fd-8a28-d37681c5f779","resolution":{"observed_at":"2026-08-01T08:41:09.384405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03860","last_updated":"2022-12-12T18:52:13Z","snapshot_observed_at":"2026-07-06T14:28:02.142309Z","submitted_at":"2022-12-07T18:58:02Z","title":"Diffusion Art or Digital Forgery? Investigating Data Replication in Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03860","snapshot_observed_at":"2026-08-01T08:41:09.464477Z","title":"Diffusion art or digital forgery? investigating data replication in diffusion models.arXiv preprint arXiv:2212.03860,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.464477Z"},"links":{"cited_paper":"/paper/2212.03860","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:7a68e925d7fdd5de3f40ed0939052c7bbb9e911186f4596fdbeb6f8833e77847","observation_id":"87c1daa1-e2a1-4dd2-8668-cced382834ab","resolution":{"observed_at":"2026-08-01T08:41:09.464477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02557","last_updated":"2024-04-12T15:48:47Z","snapshot_observed_at":"2026-08-03T00:41:20.399858Z","submitted_at":"2023-10-04T03:30:32Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02557","snapshot_observed_at":"2026-08-01T08:41:09.550212Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations.arXiv preprint arXiv:2310.02557, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.550212Z"},"links":{"cited_paper":"/paper/2310.02557","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:7f121f2caf98efd01aaaf6aa62174ba6d09a5af6e85bafc39dc5a510d6f2c0e6","observation_id":"066bd68e-88e9-4b5b-98f8-7b0183d3f226","resolution":{"observed_at":"2026-08-01T08:41:09.550212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02664","last_updated":"2025-02-20T06:17:25Z","snapshot_observed_at":"2026-08-05T08:58:57.183527Z","submitted_at":"2023-10-04T09:04:20Z","title":"On Memorization in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02664","snapshot_observed_at":"2026-08-01T08:41:09.604919Z","title":"On memorization in diffusion models.arXiv preprint arXiv:2310.02664, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.604919Z"},"links":{"cited_paper":"/paper/2310.02664","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:988032d8fa47626469f08ab0aeffa2af4b6fa14bc5d3844fc989f6ddd6384b5f","observation_id":"14e0c764-3d15-4a43-89ee-fc2e38bca704","resolution":{"observed_at":"2026-08-01T08:41:09.604919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14772","last_updated":"2023-05-24T18:17:17Z","snapshot_observed_at":"2026-08-10T10:28:06.276247Z","submitted_at":"2023-04-28T11:33:08Z","title":"Multisample Flow Matching: Straightening Flows with Minibatch Couplings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14772","snapshot_observed_at":"2026-08-01T08:41:09.659189Z","title":"Multisample flow matching: Straightening flows with minibatch couplings.arXiv preprint arXiv:2304.14772, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.659189Z"},"links":{"cited_paper":"/paper/2304.14772","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:0f97fb75da0f6c59677cfcc5b6aceed1e622e27bd5fb51dcd857b41a824afc8d","observation_id":"d0519950-19f0-49cb-a875-1b674c41079a","resolution":{"observed_at":"2026-08-01T08:41:09.659189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.744659Z","title":"Imagenet large scale visual recognition challenge.International journal of computer vision, 115:211–252, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.744659Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:27fd7acf3839cbbb6c6d96aba8353596ae91c9dee7e9a5777ed5c41a21014115","observation_id":"b9709a42-97de-4310-8440-6015daa5d804","resolution":{"observed_at":"2026-08-01T08:41:09.744659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.798025Z","title":"Transformer flops","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.798025Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:70a6080249d5b8d681463a8708c3f861c4404a89c11a68888789bb928ebbff0c","observation_id":"55f47114-4246-4568-bcc0-385017bc6011","resolution":{"observed_at":"2026-08-01T08:41:09.798025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.886453Z","title":"Learning from reward-free offline data: A case for planning with latent dynamics models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.886453Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:9f9e2ef7d8cd6bcc4c7cb32cc6d287bc7b4d086140a1a0a9dc19bac59dfe63af","observation_id":"8a2704be-9987-4841-ac93-160b7e4130d6","resolution":{"observed_at":"2026-08-01T08:41:09.886453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:09.970200Z","title":"Back to basics: Let denoising generative models denoise","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:09.970200Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:68f4f32c6362277c40d08235721c976fe2f96ed7df16eafe15e0974cdc76bc8e","observation_id":"bf8122ea-001f-41e2-b139-9d0221d8eeab","resolution":{"observed_at":"2026-08-01T08:41:09.970200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.060011Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.060011Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:196fc74b469121817bd85360581abebb86a05d05bc94faea3ecf64a52d7e1c47","observation_id":"707e5643-8d0f-479e-9d43-6e613b00212a","resolution":{"observed_at":"2026-08-01T08:41:10.060011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.160611Z","title":"V-jepa 2: Self-supervised video models enable understanding, prediction and planning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.160611Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:2788f6b34ab46b19d8be73a2c6f448795a1b62ff43710823657b731c082cb3d2","observation_id":"a5daee6d-c7d4-42e4-bec8-96035f78f960","resolution":{"observed_at":"2026-08-01T08:41:10.160611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.256841Z","title":"What matters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.256841Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:8fcbe8b8e6e67e3be4e37fb55d5537105b995b4aacc99dc434e3a2ac46b9e21e","observation_id":"9774176a-5e4d-4cc6-b821-584e6601a3e6","resolution":{"observed_at":"2026-08-01T08:41:10.256841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-01T08:41:10.347628Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.347628Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ceaa19748d61c2172cdfa74be73b5495b3144a4af904201f1dba2de67a616c2d","observation_id":"328c7fd8-aae9-4ba8-a3ec-a86fdcb2c954","resolution":{"observed_at":"2026-08-01T08:41:10.347628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.441176Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.441176Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:e2de7422f4b694012a41fb4923b2ba8356c28553b3e28481eff0061aed2a738c","observation_id":"c71cfb82-eccd-4edc-b428-33f046716863","resolution":{"observed_at":"2026-08-01T08:41:10.441176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.556144Z","title":"Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.556144Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:7358c687093e9f58913030127125123eda05374ac58088ca000461bad79a2748","observation_id":"34dbf4aa-1c46-4642-8c37-f4cfaa697a58","resolution":{"observed_at":"2026-08-01T08:41:10.556144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.672015Z","title":"Density estimation using real nvp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.672015Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:121e6b825d9c3d8828b26688f44e458094423f07e2fba967d8be545c1cef2e05","observation_id":"fde36bd1-fa4e-4257-8ebb-b66457ed94e2","resolution":{"observed_at":"2026-08-01T08:41:10.672015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.785454Z","title":"Relaxing bijectivity constraints with continuously indexed normalising flows","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.785454Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:1b8e27e50bb1fd5ac1c8dd8c3aec7255c403f16aba0dcd1f83d5fd1ab641bcf2","observation_id":"37ab5b52-9979-4202-9da5-c9fb481e2bee","resolution":{"observed_at":"2026-08-01T08:41:10.785454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:10.897312Z","title":"Normalizing flows are capable generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:10.897312Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:69d69e16a96228b4a2bd26ea5ea7d3ebcd3b2d09ae4700b3cf5b08a44a2540f1","observation_id":"ffb0fc24-254a-4c70-9a08-ee8ac643e46b","resolution":{"observed_at":"2026-08-01T08:41:10.897312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:11.013527Z","title":"Starflow-v: End-to-end video generative modeling with normalizing flows.arXiv preprint arXiv:2511.20462, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:11.013527Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:a855b07ab6cda6c571fc539cf38fd4edf991a1f2be9c6aaf15652d66a8e11db2","observation_id":"38f5d9af-4037-4f49-8cf2-b1c8b6f97589","resolution":{"observed_at":"2026-08-01T08:41:11.013527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.01792","last_updated":"2021-01-05T21:29:31Z","snapshot_observed_at":"2026-07-06T10:30:17.535368Z","submitted_at":"2021-01-05T21:29:31Z","title":"Minibatch optimal transport distances; analysis and applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.01792","snapshot_observed_at":"2026-08-01T08:41:11.129938Z","title":"Minibatch optimal transport distances; analysis and applications.arXiv preprint arXiv:2101.01792, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:11.129938Z"},"links":{"cited_paper":"/paper/2101.01792","citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:89e49b87d9fbab83a5d34856e95f7c96cd1d5254cc21afd34a55be570f978ee5","observation_id":"6845c312-c272-45b3-9b9e-7cd93a752156","resolution":{"observed_at":"2026-08-01T08:41:11.129938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:11.284469Z","title":"Faster inference of flow-based generative models via improved data-noise coupling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:11.284469Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:ec80478cdc490247ff522ff3f25e45cb6df8e2c7fb4865b06c8857373a3ebb57","observation_id":"890c4287-2f71-4dba-a972-401de4b86830","resolution":{"observed_at":"2026-08-01T08:41:11.284469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:11.348169Z","title":"Beyond optimal transport: Model-aligned coupling for flow matching","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:11.348169Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:dcef060063692215bf59e6f4ce60c484491f07f23bc1f9647cde1457c6a0b198","observation_id":"ded3803e-0e14-4fd6-b1ac-bf1c3f7acc34","resolution":{"observed_at":"2026-08-01T08:41:11.348169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:41:11.486329Z","title":"Multiple choice learning: Learning to produce multiple structured outputs","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-01T08:41:11.486329Z"},"links":{"citing_paper":"/paper/2607.27372"},"observation_digest":"sha256:758dc021774ea6a6c1fedab3dcb2038b4c8b80c953ea62db867e0b510c60d74a","observation_id":"f93b5490-69f8-4ef3-9187-6375cfd3c579","resolution":{"observed_at":"2026-08-01T08:41:11.486329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27372","last_updated":"2026-07-29T18:25:17Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T11:48:16.614235Z","submitted_at":"2026-07-29T18:25:17Z","title":"Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":106},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 106 outbound references and 1 inbound Pith citation observation for arXiv:2607.27372."}