{"as_of":"2026-08-07T09:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c8afdb3779e0ac0288338e956f21b79562f3d909d390709d53c4eefb95ce926","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T15:14:36.946247Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.00371/citation-record","integrity":"/paper/2607.00371/integrity","json":"/paper/2607.00371/citation-record.json","paper":"/paper/2607.00371"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:6de114fec89d00ce880af867e3b385fee68d5631fd26a7c3cbd5f7df4c257496","observation_id":"0da90fe8-bcf8-4777-afab-071772494ce0","resolution":{"observed_at":"2026-07-02T15:17:07.203292Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2007.01127","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T15:17:07.165032Z","title":"arXiv preprint arXiv:2007.01127 (2020)","venue":null,"work_id":"4097c01c-28a2-4971-93ce-681a33afbf80","year":2007},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:eb3debecbad1522c76a9464f51d224a7ff609872cb70358f26a737f31406e3e1","observation_id":"cf666db8-3f63-463d-93d7-b3ea28e01c5f","resolution":{"observed_at":"2026-07-02T15:17:07.166537Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.148341Z","title":"In: Forty-second International Conference on Machine Learning (2025)","venue":null,"work_id":"f6ae74f1-ce98-44be-ba31-e67343e9ad7a","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:963d11d7a311cc95ad38c6d0716e0171bb3103e7c755f76fda713fbcd9206124","observation_id":"69a18589-4d52-48e3-ab0a-070c77acccc4","resolution":{"observed_at":"2026-07-05T23:51:35.150118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":"1809.11096","doi":"10.48550/arxiv.1809.11096","metadata_source":"pith","pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","venue":"cs.LG","work_id":"244e6f06-bad2-4f34-8186-ff370286427f","year":2018},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:22e02e5764f821bdacebb4e6d3f1c29880265705fe1b9cd21568c74124ec6bd6","observation_id":"0718b669-124c-4524-a213-43b491798500","resolution":{"observed_at":"2026-07-02T15:17:07.148258Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-02T12:08:12.712369+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T12:08:12.712369+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.151278Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"78d249ff-80ec-46e3-a90a-21201714c598","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:9b78ecbf31ca8be30c98a3fb90de1080121d60a9a77f8ac0a0c4fb22b80f68d8","observation_id":"aea3447b-b4e4-4ad5-b615-abc7ab612720","resolution":{"observed_at":"2026-07-05T23:51:35.153138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.140727Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"04b241f4-0590-4705-9b68-f33217ed0fa9","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:cd932044038355f58a31bf7dc631862be788f16ca468985742a7afb2d5d087ef","observation_id":"56736066-3fa9-442d-899f-6bb118c7803e","resolution":{"observed_at":"2026-07-05T23:51:35.142175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.145821Z","title":"In: International conference on machine learning","venue":null,"work_id":"bf0b26a0-a4af-428d-8001-a8c1b206e0a3","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:9ad5ab3c660c60070ceaff6dd77993aa5f00a2b552ee0e94cae45cc373918411","observation_id":"6fa18847-bb28-4598-aaf2-2edc3d4ce6f7","resolution":{"observed_at":"2026-07-05T23:51:35.147634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.106190Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Confer- ence","venue":null,"work_id":"a250d7ea-2412-4d8f-8cee-6ee70a77057b","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:7363f3f52648ac5056abb03b37f9034d1df18765a87652fddedb69a88a5d238f","observation_id":"f7661802-bbad-4931-aedb-17a05977ff67","resolution":{"observed_at":"2026-07-05T23:51:35.107478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.131746Z","title":"In: 2009 IEEE conference on computer vision and pattern recognition","venue":null,"work_id":"2115e640-5f8b-47e3-8ca2-be48a6f00927","year":2009},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:28b3bad37ee90f85734621f8e8ce483b1853629cdd4722bba3047c801f403cb6","observation_id":"c0e52666-3469-4f8b-b35f-0f7bf8ac2768","resolution":{"observed_at":"2026-07-05T23:51:35.132885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.136713Z","title":null,"venue":null,"work_id":"024918ef-b24c-47d1-bf8d-4335eb2f8d2e","year":2021},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:100b543c9dcab10c753015b8e9d6c5be748d55c08b9b650c3872c2228b06cd92","observation_id":"ce3f230f-17b3-4893-995e-221e078dfe1f","resolution":{"observed_at":"2026-07-05T23:51:35.138221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.109820Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"b8fdafa1-fd7a-405c-bb5b-6714e521bee9","year":2021},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:0a03460f82bd43fbbaf063e0f647a3157e93193d6414618311c0177092e200b5","observation_id":"e82bccbd-634f-4f1e-9c8b-2cd11a5970f4","resolution":{"observed_at":"2026-07-05T23:51:35.110970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.128453Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"eb29ee39-6576-492f-a8fc-d95e1844b8a0","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:c54b714174983a0887227c269d46f2c0e223edde18357ade0d7bb26f52c1e3be","observation_id":"2b8ff23a-cb0c-4ff4-8c91-dc7eb392aac1","resolution":{"observed_at":"2026-07-05T23:51:35.129612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.134289Z","title":"Journal of Machine Learning Research23(120), 1–39 (2022)","venue":null,"work_id":"b1237a9f-75e4-49b9-862f-284a520f079c","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:4abff7e1f8aea023ce929365e2fc38e7c4542c0ad14a5847ab343d685b7886f6","observation_id":"aa8dd81c-6d84-4bc7-8fd7-fff15a38c01a","resolution":{"observed_at":"2026-07-05T23:51:35.135698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.138873Z","title":null,"venue":null,"work_id":"10e1e469-5c1f-4188-84d2-7553e5714301","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:921b7be398d3685f1db1feff703eefbab10eadf6f3c631efe0df16a37d9568e1","observation_id":"ede901a1-5e0b-40cd-bf3a-0be8d4d97b8d","resolution":{"observed_at":"2026-07-05T23:51:35.140062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23367","last_updated":"2025-07-08T12:34:10Z","snapshot_observed_at":"2026-08-03T21:30:46.305041Z","submitted_at":"2025-03-30T08:51:19Z","title":"FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning","version":3},"cited_work":{"arxiv_id":"2503.23367","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23367","snapshot_observed_at":"2026-07-02T15:17:07.210283Z","title":"arXiv preprint arXiv:2503.23367 , year=","venue":null,"work_id":"76a6075d-6260-4867-9068-9bee284ad057","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2503.23367","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:98cf16eaaa2d1d9dc2e0085183138d43e82c5413dcff0340bedb3c2de227160e","observation_id":"cdcbb3fd-f2d2-4d0d-8c14-f7e544a7e75e","resolution":{"observed_at":"2026-07-02T15:17:07.211739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.143270Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"a19c71a4-b930-49a0-ab15-edac4d3999a8","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:e37625019ea55b106221773eb738686c7d26f9d913a133f24166871a42f3704c","observation_id":"ba29abff-50d8-482b-a90d-06a37371b571","resolution":{"observed_at":"2026-07-05T23:51:35.144976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.130168Z","title":null,"venue":null,"work_id":"ec17a8fd-aeb6-44a1-a247-80564f39bf41","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:b65adfc2d96f853b069d76be4c8846b4e8cc728317fd8886bbf0d9c9a202b80f","observation_id":"0d87f049-5fdf-491e-9830-97576817448f","resolution":{"observed_at":"2026-07-05T23:51:35.131238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.119292Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"abf9a518-4eeb-4d49-a7e7-151a64cfdfb7","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:a2b493fe29ad8fdc1f503ce62dbc63403e1aa933e4e2663141419a03797b2e36","observation_id":"8a6732a4-f581-42d7-961f-d958121ae9e9","resolution":{"observed_at":"2026-07-05T23:51:35.120461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14701","last_updated":"2020-11-06T04:16:36Z","snapshot_observed_at":"2026-07-06T10:09:17.078776Z","submitted_at":"2020-10-28T02:17:24Z","title":"Scaling Laws for Autoregressive Generative Modeling","version":2},"cited_work":{"arxiv_id":"2010.14701","doi":"10.48550/arxiv.2010.14701","metadata_source":"pith","pith_arxiv_id":"2010.14701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Autoregressive Generative Modeling","venue":"cs.LG","work_id":"1f180c21-02d6-4b11-9dfc-08d7f0d8fc81","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2010.14701","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:f49d61f7e009a9cb8083e73014a7d197946c5894fab36bec607f63c5684f956d","observation_id":"1007568e-fcfd-4700-b3f1-3dd3366efc5f","resolution":{"observed_at":"2026-07-02T15:17:07.200647Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:27:03.318797Z","title":"Advances in neural information processing systems33, 6840–6851 (2020)","venue":null,"work_id":"effc8173-611c-4e0c-8d0b-066e3ae07f56","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:cdfacf0132ce916aebf772020cd1f1991ddf7673c2b5eafa7b5c7bf9c27ce38c","observation_id":"10d17ca3-b6ea-4b24-aa9c-68fa180359ea","resolution":{"observed_at":"2026-07-05T23:51:35.133602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.241446Z","title":"Journal of Machine Learning Research23(47), 1–33 (2022)","venue":null,"work_id":"18e57d66-a4ca-4ad7-8524-abf638450a8f","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:d1bc23c4cfa38d21ee6c9b1a10f6fd613c05292b6aeb466ab0ae8abf8617be89","observation_id":"c6fb7c2b-4dea-4371-bed8-8064f1963e61","resolution":{"observed_at":"2026-07-05T23:51:35.116902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.110010Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"fbf56abd-693f-4bf7-8dcd-408caf9e0fa8","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:dd12dac192ccb9669175253365dcbfe20deaad0cd5a034a14ae72e113fd20947","observation_id":"9ae5a96a-a3db-49d4-889c-e50ef073c28c","resolution":{"observed_at":"2026-07-05T23:51:35.111654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10962","last_updated":"2025-06-12T17:57:44Z","snapshot_observed_at":"2026-08-07T04:10:38.074752Z","submitted_at":"2025-06-12T17:57:44Z","title":"SpectralAR: Spectral Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":"2506.10962","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10962","snapshot_observed_at":"2026-07-03T20:28:55.512424Z","title":"Spectralar: Spectral autore- gressive visual generation.arXiv preprint arXiv:2506.10962","venue":null,"work_id":"12bd1d16-c9e4-4072-8129-b139357d08c0","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2506.10962","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:53c375b24a97184fdce84df38beaa5de54c669a90b8d5ee15b246aa7adafb786","observation_id":"3cd88cba-d26b-432c-b42b-8cb220d1a028","resolution":{"observed_at":"2026-07-02T15:17:07.206646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.07076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T15:17:07.158756Z","title":"Nfig: Au- toregressive image generation with next-frequency predic- tion","venue":null,"work_id":"5806182f-b5ba-4464-bc1c-6840eb260526","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:9d1f8f0bdde69601af8f0632955a8e101fc19b8c264915c3b010a01fc896d7e9","observation_id":"d3db86ac-b3c8-4e45-a7b3-cac73e65b0a6","resolution":{"observed_at":"2026-07-02T15:17:07.160524Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T22:03:00.456480Z","title":"Neural computation3(1), 79–87 (1991)","venue":null,"work_id":"28d31c59-7911-4bbf-b16c-2194fb141d08","year":1991},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:7967c333a6a8524af70c8d5a86db31b64b8cda25309392d8cdb979447f63a9a9","observation_id":"ad394153-cb42-4a18-81e1-969d68f7ee22","resolution":{"observed_at":"2026-07-05T23:51:35.114733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07997","last_updated":"2025-07-14T09:33:58Z","snapshot_observed_at":"2026-08-06T18:25:28.975585Z","submitted_at":"2025-07-10T17:59:54Z","title":"MGVQ: Could VQ-VAE Beat VAE? A Generalizable Tokenizer with Multi-group Quantization","version":2},"cited_work":{"arxiv_id":"2507.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07997","snapshot_observed_at":"2026-07-02T15:17:07.216858Z","title":"arXiv preprint arXiv:2507.07997 (2025) 4, 7","venue":null,"work_id":"998b7447-d637-4bfa-a853-0f816138174f","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2507.07997","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:8ae8ee4c8a76a82a41e0ca6cabd65398f9481bd329b990d56a1f2d5d05e07729","observation_id":"6d0577c1-f2bb-47c1-bb07-b7dfcc55092e","resolution":{"observed_at":"2026-07-02T15:17:07.218280Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.20313","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:58:32.620285Z","title":"Flexvar: Flexible visual autoregressive modeling without residual prediction.arXiv preprint arXiv:2502.20313,","venue":null,"work_id":"afb3865d-322e-47cf-a15d-2ef661f7cd7d","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:e37060a2e94cc68756f1c09b548e80243ea5c270ecda908c01514b8c8fc7b659","observation_id":"5ae7bdde-ab16-4d8d-8f21-537151d3134c","resolution":{"observed_at":"2026-07-02T15:17:07.143257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:3487be8f7d1d9102b0b9ee6aa66568814f347ac70aee80c53f4330853626f2d9","observation_id":"f64a9024-9b81-4c66-a70c-9ad90887a5ed","resolution":{"observed_at":"2026-07-02T15:17:07.214080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.115284Z","title":null,"venue":null,"work_id":"d1857152-a235-4e87-9547-0e234d834694","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:09ae0fa31833e2e51286a0ed33114dc182b8379f37a6126840b834eafff3c1b7","observation_id":"949870f5-7041-400a-a349-b69b89502561","resolution":{"observed_at":"2026-07-05T23:51:35.116417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:2dc1e2835db3663d145b240a8c1296f17526bfb61c7de76a3d1f25031c4cbbf4","observation_id":"3895f568-1549-46d8-af91-6f092a09c558","resolution":{"observed_at":"2026-07-02T15:17:07.194810Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:dcfed98ba7aa73c6f926273dbab63f5cd5acc15e1eed03b8ca34a867ba6f578d","observation_id":"40cff08e-048b-4631-b0bb-3e340292154b","resolution":{"observed_at":"2026-07-02T15:17:07.223678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.117112Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"f19f50ca-7f75-4550-b704-e2e59557c060","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:b671d414d0dc331880753d8d75a24b78360596d63f510e6a6a8a76e0dd2cef70","observation_id":"d032bd21-56e8-457f-a405-737142c5b558","resolution":{"observed_at":"2026-07-05T23:51:35.118379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-07-06T09:33:58.857566Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":"2006.16668","doi":"10.48550/arxiv.2006.16668","metadata_source":"pith","pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","venue":"cs.CL","work_id":"52b3c9a6-2a27-45a7-ba2b-ebe4b5bb5a5f","year":2020},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:78dc730a2c1127b0ff8eb42c73d517ff82cc0485c4b352dace67184fd9afdfd5","observation_id":"600f315b-5472-474a-a8ee-c1576f6bd7b6","resolution":{"observed_at":"2026-07-02T15:17:07.154149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.121022Z","title":"CoRR (2023)","venue":null,"work_id":"efa9c5c5-a3fb-4bfa-b5fa-9934e3616133","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:5e3ed48a723dca30ec0d60d797eae1da1b488b95d0e9d60e011df32db9168734","observation_id":"ab741e70-0732-48aa-9da8-fe353087baaa","resolution":{"observed_at":"2026-07-05T23:51:35.122104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.130098Z","title":"Advances in Neural Information Processing Systems37, 56424–56445 (2024)","venue":null,"work_id":"7c0f6562-85ff-4114-af24-68b5d3a41ed0","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:65b0759196ff9db56691f1b625564a431cba457449c4397e83f2515e64edbfd2","observation_id":"991f799b-0381-4d0e-b730-f95f00e2a669","resolution":{"observed_at":"2026-07-05T23:51:35.131522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01756","last_updated":"2024-12-03T20:32:52Z","snapshot_observed_at":"2026-07-31T17:12:13.287514Z","submitted_at":"2024-10-02T17:06:39Z","title":"ImageFolder: Autoregressive Image Generation with Folded Tokens","version":3},"cited_work":{"arxiv_id":"2410.01756","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.01756","snapshot_observed_at":"2026-07-03T14:38:28.817961Z","title":"Imagefolder: Autoregres- sive image generation with folded tokens","venue":null,"work_id":"31c3d642-f3a7-4326-8674-523c08c24d7c","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2410.01756","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:87e3149f7335af2e341667d378028ebfce2cbf0175d1f6d066578235d0ea77ea","observation_id":"d8be1fea-6bcb-401a-bc7d-e3da85105ca0","resolution":{"observed_at":"2026-07-02T15:17:07.209220Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10511","last_updated":"2024-10-14T13:49:06Z","snapshot_observed_at":"2026-07-06T19:33:04.265295Z","submitted_at":"2024-10-14T13:49:06Z","title":"Customize Your Visual Autoregressive Recipe with Set Autoregressive Modeling","version":1},"cited_work":{"arxiv_id":"2410.10511","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10511","snapshot_observed_at":"2026-07-02T15:17:07.219396Z","title":"arXiv preprint arXiv:2410.10511 (2024)","venue":null,"work_id":"1e70889a-c980-46c9-a562-c465acf71bd1","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2410.10511","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:ef943254bfd25d88d9c6ddbfeb86e838bcb2b99c8ca0cdd1ffe348a058b1af86","observation_id":"8ae2911c-9309-4785-9cb9-92a70293b402","resolution":{"observed_at":"2026-07-02T15:17:07.220706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:b1eae14a2409af6985b4247c38e2596bb7d9435b47329666347d50f3b83911b1","observation_id":"37472be2-0fe0-4161-b0ac-8e34158157a9","resolution":{"observed_at":"2026-07-02T15:17:07.178639Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15321","last_updated":"2025-03-19T06:16:54Z","snapshot_observed_at":"2026-08-07T09:05:54.706407Z","submitted_at":"2024-12-19T18:59:36Z","title":"Next Patch Prediction for Autoregressive Visual Generation","version":3},"cited_work":{"arxiv_id":"2412.15321","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15321","snapshot_observed_at":"2026-07-02T15:17:07.173716Z","title":"arXiv preprint arXiv:2412.15321 (2024)","venue":null,"work_id":"b832524a-4d33-4391-ad52-79233a357771","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2412.15321","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:f3ffdd6cf3345658a967cc62b8ceba2385147edd7c8e84986ed53ec1cc8f144c","observation_id":"babc43c3-2653-46cd-b273-e9fa7cb8192a","resolution":{"observed_at":"2026-07-02T15:17:07.176042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.161355Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"5b341e7e-e501-40a2-a5c9-f508ecf3e7f8","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:63d8c93b87699f555fb3594cbeb2b18536241d5c4bbe3e2d25e8e343f6cba716","observation_id":"207feed4-39c0-4f03-8f33-5d1d1f5a90b2","resolution":{"observed_at":"2026-07-05T23:51:35.163300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T10:23:41.924825Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"334edbbb-a166-480a-88b7-6d7b05af358f","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:403809d109836939f0cf024bb826226bf20e8a1ab252520a2bc2f1404ad90d34","observation_id":"b18c095f-1f3c-4d31-b3af-118d0ebb93a1","resolution":{"observed_at":"2026-07-05T23:51:35.129432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-01T17:30:39.078379Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:947a1fe7d7a7fa09dca004438f90490df13b7414f4deaddeed2f27813e859ad2","observation_id":"d4632558-bf4f-466b-9ba3-2c122f0fc9f8","resolution":{"observed_at":"2026-07-02T15:17:07.226058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.106470Z","title":null,"venue":null,"work_id":"eadba980-9faa-43b2-9d40-db50b41784b6","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:990abd69e726c756ca773b088bec26e81ce84963e9ecb0651dab5aed6013b02b","observation_id":"ba8daa83-1d70-41b5-8af5-2736ca2bec97","resolution":{"observed_at":"2026-07-05T23:51:35.107626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.153976Z","title":null,"venue":null,"work_id":"f5998904-8789-4f94-a8d0-d9a71198f897","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:5c42b1a1dd435cee2540774837f10ba90112a65ac23214d191bd6ca45ce8b207","observation_id":"2b60d546-2409-4c87-b5e1-642e3a07df26","resolution":{"observed_at":"2026-07-05T23:51:35.155751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:d8a525d889ef207776973e41d0ae222d33738f98a43ca4e45c3d201533a73418","observation_id":"1adba682-468c-46ca-a909-4bb382608da8","resolution":{"observed_at":"2026-07-02T15:17:07.189198Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":"2406.06525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-07-10T11:37:03.266757Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","venue":"cs.CV","work_id":"41efe203-9377-4c63-b1d6-e499cd6e46f6","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:4d5a5fb92ea5c5190dfe9d1d504fcc992f18bc40561526b3599e27f59fa3fd6f","observation_id":"02cd7beb-b6b7-435b-91d7-f15ea82face3","resolution":{"observed_at":"2026-07-02T15:17:07.157550Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":"2405.09818","doi":"10.48550/arxiv.2405.09818","metadata_source":"pith","pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","venue":"cs.CL","work_id":"2661b9a6-25cc-41a1-8100-612d2b801289","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:24e18aacb59d7d0cbc75858bdb8a5994d4c98df8ec41cd9d2e213b2d8d725ca2","observation_id":"59f485e4-d309-4194-972f-f85e107e4f8c","resolution":{"observed_at":"2026-07-02T15:17:07.228956Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:30e1606a1e6b03a2708d53f94f991d763886cf7d049e42965fcc5fe2aefa54c9","observation_id":"aff798b5-a04d-4372-acd8-5d01ef02a84a","resolution":{"observed_at":"2026-07-02T15:17:07.163852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.156628Z","title":"Advances in neural information processing systems37, 84839–84865 (2024)","venue":null,"work_id":"9745c57f-7fcd-451e-b272-6cc941a489a7","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:d257d30249863263b15f5907663a2a5d706fff865d492e6326a11ebcbe1f58fb","observation_id":"1e349fc1-e838-4f7a-b2f3-461d385d7752","resolution":{"observed_at":"2026-07-05T23:51:35.158202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:b653e2bde51fa54302a5c6df88d783e643cecc387aedd4e9c7f6506f9aa5c3e0","observation_id":"a66bdd9a-1f26-441d-9db3-a18760906caf","resolution":{"observed_at":"2026-07-02T15:17:07.145745Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.090557Z","title":"In: International conference on machine learning","venue":null,"work_id":"6e9321b2-cc78-4d1a-b369-b351f039cb1b","year":2016},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:7c94008701fc21fee8677101ef6a1490a289de1dc09041f3bbd8e00b6049145f","observation_id":"72d3fdec-44ed-4048-8eae-d7922753960f","resolution":{"observed_at":"2026-07-05T23:51:35.091878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:06:35.419629Z","title":"Advances in neural information processing systems30(2017)","venue":null,"work_id":"64f7d517-e27e-4906-b3e5-929b508566cf","year":2017},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:200508178a84350b983cfa4c316648570e694a4345caa2af753cb3ae76beeda0","observation_id":"ed567059-fc87-40ae-bd19-19a99085298a","resolution":{"observed_at":"2026-07-05T23:51:35.136788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:998f62385e04d0bf568bc9aff8f7e008649a185ab4c610dac5dbad2fc31785f5","observation_id":"68620224-e4ee-4cd3-bb48-694d24c2ff89","resolution":{"observed_at":"2026-07-02T15:17:07.169836Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.094372Z","title":null,"venue":null,"work_id":"5d6ba19b-ae37-4b46-93cb-284e7e63c874","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:b6e4695e0cd1a2c9c1fbe05be757c554662672f4374abef368f5bb9870ee5538","observation_id":"16b77313-d12f-43f8-8501-e6fd875a1fb1","resolution":{"observed_at":"2026-07-05T23:51:35.095678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-04T16:36:02.143481Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":"2409.16211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-07-02T16:27:09.132431Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":"f358dd18-8673-4de8-bc21-126635a0ba2c","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:3148158ff01820184e551afd5b4c3082e4584488c5f5f104b59efe80c93f9a45","observation_id":"98d73f5a-6053-4847-af1b-be740fde94ce","resolution":{"observed_at":"2026-07-02T15:17:07.172588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":"2408.12528","doi":"10.48550/arxiv.2408.12528","metadata_source":"pith","pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","venue":"cs.CV","work_id":"1393dc24-a6b2-44e1-b5d7-7009d1fa4811","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:ff49ed493d7564a48116ac02f05deb0181ce3e9257cee1b24fe2eddfb3055319","observation_id":"782b57d7-bd75-4070-ad73-bf53461ea7df","resolution":{"observed_at":"2026-07-02T15:17:07.186167Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.088767Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"349409b4-b109-42e4-9567-e38717d9e388","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:dfb0e8a78d70322833bc38dcb57663b82ad87a84a747e8ad089f9cdc914c9ca5","observation_id":"90abbd2e-4ff1-4df9-bbd1-06862cc69da7","resolution":{"observed_at":"2026-07-05T23:51:35.089971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.086762Z","title":"generation: Taming optimization dilemma in latent diffusion models","venue":null,"work_id":"5cf352cf-363c-4c07-aaa6-5e6a9e429c72","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:8807a24ae1fdda81e07f33885c5b181c058831c7b846f5d195cfe6dbd42e68a1","observation_id":"d55a114d-1b63-4170-803f-ac8b1b032502","resolution":{"observed_at":"2026-07-05T23:51:35.088037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.05305","doi":"10.48550/arxiv.2503.05305","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2503.05305 (2025)","venue":"arXiv (Cornell University)","work_id":"01efde93-ebab-4b15-a924-43939812077b","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:e8151fd95c2819055b323d70d874867345c0f6647e800c04ea39ec233121d09a","observation_id":"18844e57-c060-4f55-9725-28722368d38c","resolution":{"observed_at":"2026-07-02T15:17:07.151588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.123013Z","title":"In:ProceedingsoftheIEEE/CVFInternationalConferenceonComputerVision.pp.18431– 18441 (2025)","venue":null,"work_id":"d7791ba3-a638-44dc-aebf-22716a83af92","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:8be8a7f3ea49da88a0f6dd2a78237c0363e07b3c780cffdefc96c98f215d645a","observation_id":"639484ea-1c7f-48ba-b963-690f72cd14b4","resolution":{"observed_at":"2026-07-05T23:51:35.126296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.158953Z","title":"Advances in Neural Information Processing Systems37, 128940–128966 (2024)","venue":null,"work_id":"1583fc0d-1fc7-46f0-8148-48fcd259c6e4","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:20d154a4ceb069dff7da2f04658e818d293e6d990ad13eb837de0b8d1587ea60","observation_id":"38dcf045-86cd-49ab-9968-62bdf04a5513","resolution":{"observed_at":"2026-07-05T23:51:35.160670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":"2410.06940","doi":"10.48550/arxiv.2410.06940","metadata_source":"pith","pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","venue":"cs.CV","work_id":"1aff8ef8-079b-4afe-9e6a-148e6fd08e6a","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:bd92edca7dcc82c11b70b33c00ef34a672caa810fd75379f5aa3e1e4189d17b7","observation_id":"5d0ad53c-1a40-4e25-b827-7db0fea834b3","resolution":{"observed_at":"2026-07-02T15:17:07.181092Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.12742","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T15:17:07.196074Z","title":"arXiv preprint arXiv:2505.12742 (2025) MEPA 19","venue":null,"work_id":"5e512e28-c27e-4890-9eb6-63a8cfc2ed8f","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:d9f44b2a9339836d497cbac28c0ca5cd2f1772856273bb4b41d62b1965e7e45f","observation_id":"c8a8d39e-8772-4fd9-bcc3-f21248a45d59","resolution":{"observed_at":"2026-07-02T15:17:07.197502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.111864Z","title":"Advances in Neural Information Processing Systems35, 7103–7114 (2022)","venue":null,"work_id":"c476d22b-38eb-4bf8-b6cf-13b7b57f3160","year":2022},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:f86769f2b3a2aa86bbefca8be7ae36d59e7412a32872b213ded7d4058cbc9100","observation_id":"47074686-6bab-4358-a2e6-8ceb559c8c0a","resolution":{"observed_at":"2026-07-05T23:51:35.113065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12327","last_updated":"2025-01-21T17:50:43Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:50:43Z","title":"VARGPT: Unified Understanding and Generation in a Visual Autoregressive Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2501.12327","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.12327","snapshot_observed_at":"2026-07-08T00:04:22.542063Z","title":"V ARGPT: unified understanding and generation in a visual autoregres- IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS 21 sive multimodal large language model","venue":"cs.CV","work_id":"89d960ca-7982-4470-8a93-5994cd42f120","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2501.12327","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:8edc37b30110df7641fb80f1956e3efb3d5984b79dd8ec9b388fa51ccf0263ef","observation_id":"e4e52c5d-0910-439e-b9d3-a27e11303402","resolution":{"observed_at":"2026-07-02T15:17:07.191767Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04260","last_updated":"2022-02-03T21:26:25Z","snapshot_observed_at":"2026-07-06T11:55:57.117755Z","submitted_at":"2021-10-08T17:15:47Z","title":"Taming Sparsely Activated Transformer with Stochastic Experts","version":3},"cited_work":{"arxiv_id":"2110.04260","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.04260","snapshot_observed_at":"2026-07-02T15:17:07.182288Z","title":"arXiv preprint arXiv:2110.04260 , year=","venue":null,"work_id":"f85ba524-6177-423a-aba7-288d0b57ac47","year":2021},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2110.04260","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:897f9567515d80b3edcfefd94e13c8d076324d285e71a0c9792c77f3e76bc69c","observation_id":"543a92b1-cf1d-4faf-8ffe-6e152c431736","resolution":{"observed_at":"2026-07-02T15:17:07.183793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":17,"parse_uncertain":0,"unresolved":7,"verified_exact":14,"verified_fuzzy":28},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2607.00371."}