{"as_of":"2026-08-07T22:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9835214885ea1905081936795371be655e55c2be8db56c8b0ad2b4b38512456","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:41:31.165907Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T00:56:18.867382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:07:55.884435Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2506.07280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-03T10:07:55.884435Z","title":"From generation to generalization: Emergent few-shot learning in video diffusion models","venue":null,"work_id":"3439d19e-44bb-4d6a-9260-36135e5cb358","year":2025},"citing_paper":{"arxiv_id":"2509.20328","last_updated":"2025-09-29T20:44:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-24T17:17:27Z","title":"Video models are zero-shot learners and reasoners","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T02:16:45.554252Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2509.20328"},"observation_digest":"sha256:9cc2f3a7c3c4bf452472c8c1fbed4e74508fdf028bf3f89057258a2b456f9f33","observation_id":"88ce5459-4164-4a44-985c-3275a995d336","resolution":{"observed_at":"2026-05-14T02:16:45.793856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2506.07280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-03T10:07:55.884435Z","title":"From generation to generalization: Emergent few-shot learning in video diffusion models","venue":null,"work_id":"3439d19e-44bb-4d6a-9260-36135e5cb358","year":2025},"citing_paper":{"arxiv_id":"2605.06487","last_updated":"2026-05-07T16:08:22Z","snapshot_observed_at":"2026-08-05T13:25:41.333282Z","submitted_at":"2026-05-07T16:08:22Z","title":"3D MRI Image Pretraining via Controllable 2D Slice Navigation Task","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T13:11:40.290900Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2605.06487"},"observation_digest":"sha256:dcbee4233ed1fd42e48025c2611222d5a0a7d29b6c15683f253ff3d1e6c8d344","observation_id":"7cf32b5c-478a-4a61-b240-98418763a06a","resolution":{"observed_at":"2026-05-11T18:56:07.772282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2506.07280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-03T10:07:55.884435Z","title":"From generation to generalization: Emergent few-shot learning in video diffusion models","venue":null,"work_id":"3439d19e-44bb-4d6a-9260-36135e5cb358","year":2025},"citing_paper":{"arxiv_id":"2606.12072","last_updated":"2026-06-10T13:40:19Z","snapshot_observed_at":"2026-08-02T21:32:50.432496Z","submitted_at":"2026-06-10T13:40:19Z","title":"World Model Self-Distillation: Training World Models to Solve General Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T10:16:35.511426Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2606.12072"},"observation_digest":"sha256:eff0602b8e6813f1c10f6ada6fb2c49b0ffba68eb19303929d4c72bfae7e6740","observation_id":"3e64fb90-010c-41ad-a446-94516e9c90d5","resolution":{"observed_at":"2026-07-03T10:07:55.886161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-13T00:56:18.867382Z","title":"arXiv preprint arXiv:2506.07280 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09024","last_updated":"2026-07-10T01:09:06Z","snapshot_observed_at":"2026-08-03T20:31:54.523048Z","submitted_at":"2026-07-10T01:09:06Z","title":"Video Generation Models are General-Purpose Vision Learners","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T00:56:18.867382Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2607.09024"},"observation_digest":"sha256:70eb6e24ecf44e75187d18802f05fd6c0ff64170d516a315be07771d5e30393c","observation_id":"46f2b52c-3de1-473c-9ffb-ab0dfdc56485","resolution":{"observed_at":"2026-07-13T00:56:18.867382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07280/citation-record","integrity":"/paper/2506.07280/integrity","json":"/paper/2506.07280/citation-record.json","paper":"/paper/2506.07280"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.07279","last_updated":"2025-03-25T03:36:21Z","snapshot_observed_at":"2026-08-05T02:24:21.044775Z","submitted_at":"2024-11-11T18:59:45Z","title":"The Surprising Effectiveness of Test-Time Training for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07279","snapshot_observed_at":"2026-08-07T05:41:30.938318Z","title":"The surprising effectiveness of test-time training for few-shot learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.938318Z"},"links":{"cited_paper":"/paper/2411.07279","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:501e7ee9e1dd0aa2d57179deeb809234d73125c2489a18af067d4ff6affbc682","observation_id":"0348a0c4-89a8-4461-b629-bd6a23b83746","resolution":{"observed_at":"2026-08-07T05:41:30.938318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:30.943273Z","title":"Sequential modeling enables scalable learning for large vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.943273Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:e5f7990937b98976356b2df101d7be6cfd675f9a7c42f0b6279b7a03efdcda58","observation_id":"6511dde1-026f-43da-a121-bdb3bbbd27a6","resolution":{"observed_at":"2026-08-07T05:41:30.943273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00647","last_updated":"2022-09-01T17:59:33Z","snapshot_observed_at":"2026-07-06T13:48:02.215133Z","submitted_at":"2022-09-01T17:59:33Z","title":"Visual Prompting via Image Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00647","snapshot_observed_at":"2026-08-07T05:41:30.946687Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.946687Z"},"links":{"cited_paper":"/paper/2209.00647","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:d71c11debb97f4209a10e76ffd17902112e296eded8060c21da411916ea7861a","observation_id":"f2952e48-e6eb-479a-92d9-58e4bf31d0f7","resolution":{"observed_at":"2026-08-07T05:41:30.946687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.873824Z","title":"How I got a record 53.6% on ARC-AGI-Pub using Sonnet 3.5.1","venue":null,"work_id":"819ba7f8-7531-4692-ae2c-9c7b9d785167","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.950556Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:a4648c8d25c2460048dca9c6387960d18d1fa3fac3738f47301f0f605c79702e","observation_id":"fb8220b0-4864-4f24-b987-69929aa5ffc1","resolution":{"observed_at":"2026-08-07T05:41:31.877379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T05:41:30.953970Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.CoRR, abs/2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.953970Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:8c007758e15333182ef1acc50cea6e146c612facfca2b9066d5bd86fa865eb27","observation_id":"a7ccd42a-13c9-4c17-b516-d26b57255dcc","resolution":{"observed_at":"2026-08-07T05:41:30.953970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-07T05:41:30.957711Z","title":"On the measure of intelligence.arXiv preprint arXiv:1911.01547, 2019","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.957711Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:feacee99891ee97046c858aa3c482b85eefd290d49d7fa957a6bb00377f8c3ee","observation_id":"e6a0b3b6-99d4-4692-af26-24af1f14a934","resolution":{"observed_at":"2026-08-07T05:41:30.957711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04604","last_updated":"2025-01-08T05:24:50Z","snapshot_observed_at":"2026-08-04T14:31:04.378756Z","submitted_at":"2024-12-05T20:40:28Z","title":"ARC Prize 2024: Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04604","snapshot_observed_at":"2026-08-07T05:41:30.961599Z","title":"Arc prize 2024: Technical report.arXiv preprint arXiv:2412.04604, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.961599Z"},"links":{"cited_paper":"/paper/2412.04604","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:16f0afc30a92c2028607f7886852b7a29cae5e84e49df1dd9b3c92b6a4805128","observation_id":"e221e75a-56e9-4563-9461-5552967a257e","resolution":{"observed_at":"2026-08-07T05:41:30.961599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05468","last_updated":"2025-04-07T19:58:25Z","snapshot_observed_at":"2026-08-07T16:07:48.235247Z","submitted_at":"2025-04-07T19:58:25Z","title":"Studying Image Diffusion Features for Zero-Shot Video Object Segmentation","version":1},"cited_work":{"arxiv_id":"2504.05468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.05468","snapshot_observed_at":"2026-08-07T05:41:31.442131Z","title":"Studying Image Diffusion Features for Zero-Shot Video Object Segmentation","venue":"cs.CV","work_id":"3c40e829-7bf4-4d77-b75b-e1443840f7bd","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.965067Z"},"links":{"cited_paper":"/paper/2504.05468","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:895c2265098a1fac27e8761d7aff81f22f584c79f706846d557f72e006a84fec","observation_id":"a12b027f-b994-496d-b99f-78c593889d8b","resolution":{"observed_at":"2026-08-07T05:41:31.446083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.863962Z","title":"A survey on in-context learning","venue":null,"work_id":"2af92452-ecf4-4094-a7ad-8737727a2bde","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.968855Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b3f848290b7247c30d4863c9ab7737232db0b2557c95dfa05b0daeba36b894fc","observation_id":"41106a4a-3377-444f-914b-f7487777f1f9","resolution":{"observed_at":"2026-08-07T05:41:31.867256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-07T05:41:30.972332Z","title":"Movie gen: A cast of media foundation models.CoRR, abs/2410.13720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.972332Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:19cbb4965e58a82c92db0d7b9ef2abc1fed4df5946047a1552e9241dd6d5e09c","observation_id":"a3fe0e59-0e33-44af-aae3-f965ae67eb2d","resolution":{"observed_at":"2026-08-07T05:41:30.972332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:41:30.975917Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.CoRR, abs/2501.12948, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.975917Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:cf04bdd2f09a256a1e81ed0f8d07fa0638e91a3a38b11eae3bebc51fab5603e8","observation_id":"04720d12-ca3c-42f6-995d-695c57328949","resolution":{"observed_at":"2026-08-07T05:41:30.975917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T05:41:30.979426Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.CoRR, abs/2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.979426Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:68665370c1cb17fa667b889ebc67c96cdbf3526e0695882c1cbb468089b75c7f","observation_id":"dd993c70-04d6-439f-a489-cedf0b72ca68","resolution":{"observed_at":"2026-08-07T05:41:30.979426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:41:30.982950Z","title":"Cosmos world foundation model platform for physical ai.CoRR, abs/2501.03575, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.982950Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:9d79c1fcaa345c9028ec52c0b6f7a0bab2e92db7f4e569239c1bce3b935b5eea","observation_id":"1194eee9-5f64-4a62-b271-043a3751e3ce","resolution":{"observed_at":"2026-08-07T05:41:30.982950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-04T09:09:48.463217Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02399","snapshot_observed_at":"2026-08-07T05:41:30.986777Z","title":"Phenaki: Variable length video generation from open domain textual description.CoRR, abs/2210.02399, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.986777Z"},"links":{"cited_paper":"/paper/2210.02399","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:f200c70bd7593966c84e87f004f08c8cbfbe5cfa9db939234d67371c74e469c2","observation_id":"0481c6eb-1835-421b-8778-291367bb911b","resolution":{"observed_at":"2026-08-07T05:41:30.986777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T05:41:30.990512Z","title":"Brown et al","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.990512Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:af6e33f9eb78d960390148bbb3acb990032aa6e6e2afe7782cf7d1fded2e754b","observation_id":"cff8b1f4-dd36-486e-afd6-a90a77f5da0b","resolution":{"observed_at":"2026-08-07T05:41:30.990512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-07T05:41:30.993883Z","title":"Ltx-video: Realtime video latent diffusion.CoRR, abs/2501.00103, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.993883Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:5cc53fadb4e71a6c0b832839f02c4feef56b1a0842b8d235cd621121b3544bc4","observation_id":"8fb64557-a41c-4537-9f74-e5d8777e0df9","resolution":{"observed_at":"2026-08-07T05:41:30.993883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T05:41:30.997415Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.997415Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:545b456542739d2e921f07c8797fec674eb2d2149a840fdbbdbd0541c7ecaad7","observation_id":"66ca8194-ef71-4773-bd79-63cb2d32e5ad","resolution":{"observed_at":"2026-08-07T05:41:30.997415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.854118Z","title":null,"venue":null,"work_id":"d53981db-d25a-4090-98cc-629c8c076a0f","year":1989},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.001301Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:ddad84da4895dc78bf2035fcc597cb26014d04eed0d9256c99069b5481b698d6","observation_id":"41ab125b-d277-4229-8703-468c4b842815","resolution":{"observed_at":"2026-08-07T05:41:31.857522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.004496Z","title":"The free-energy principle: a unified brain theory?Nature reviews neuroscience, 11(2):127–138, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.004496Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:7aa4b8d8ab45eaf68aa72173ad70110493c57cb6a36325524af7b0db1507967f","observation_id":"c66b55ef-4c3f-45f6-99b2-0ba148981f3a","resolution":{"observed_at":"2026-08-07T05:41:31.004496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.007829Z","title":"Instructdiffusion: A generalist modeling interface for vision tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.007829Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:89c09f6c9b3be63fac3502c021b634f84ea44aaec79b3f6351a94845e3bc18d6","observation_id":"67829754-744a-4d5b-9ea8-e744880cbd0e","resolution":{"observed_at":"2026-08-07T05:41:31.007829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15463","last_updated":"2022-05-30T23:20:33Z","snapshot_observed_at":"2026-07-31T16:40:04.719200Z","submitted_at":"2022-05-30T23:20:33Z","title":"Few-Shot Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15463","snapshot_observed_at":"2026-08-07T05:41:31.011153Z","title":"Few-shot diffusion models.CoRR, abs/2205.15463, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.011153Z"},"links":{"cited_paper":"/paper/2205.15463","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6799499136168a698e862613a04796d5a8e985b673f95826977da3d5785cd37a","observation_id":"9fe6de16-f95a-4d18-b878-08bc7cc51ae1","resolution":{"observed_at":"2026-08-07T05:41:31.011153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.731734Z","title":null,"venue":null,"work_id":"3aae1735-42e1-48e7-80e6-c922f22c4f7f","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.014756Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:bb85f0225bb7b3a42626d039f778ecfcaa4d69585cfc49106f6b84ac7ae8e683","observation_id":"a9968bef-1eca-470f-b0ac-684b9c07a69e","resolution":{"observed_at":"2026-08-07T05:41:31.734798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.721926Z","title":"The llama 3 herd of models.arXiv e-prints, pages arXiv–2407, 2024","venue":null,"work_id":"f5f4d483-db31-4ff9-9730-eb1869174829","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.017893Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:fe0788c545b86f6545b9df6a5aff9b856a3b507f70bab4ef81429142ff11c1e2","observation_id":"fac107e4-a1ec-4815-a42a-e723c5a92d76","resolution":{"observed_at":"2026-08-07T05:41:31.725623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.711025Z","title":"Gem: A generalizable ego-vision mul- timodal world model for fine-grained ego-motion, object dynamics, and scene composition control.CVPR, 2025","venue":null,"work_id":"97951e34-8f40-440a-a298-1adbb895fa69","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.021049Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:975f4c96935b66ed3dc424a3020848d04b01c40decd356b63234a2d8980af9d2","observation_id":"d20e1074-9e58-42ed-9d6b-bf2282e772a6","resolution":{"observed_at":"2026-08-07T05:41:31.715712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04320","last_updated":"2025-07-01T20:00:27Z","snapshot_observed_at":"2026-08-06T02:51:36.096592Z","submitted_at":"2025-02-06T18:59:00Z","title":"ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04320","snapshot_observed_at":"2026-08-07T05:41:31.024475Z","title":"Conceptattention: Diffusion transformers learn highly interpretable features.CoRR, abs/2502.04320, February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.024475Z"},"links":{"cited_paper":"/paper/2502.04320","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:00bb14086e6bdb259f0ecda74269df5dc57a26e79d9c6ad27523943361f65cd8","observation_id":"e5d4b584-b4d5-4ec3-9d37-32aeef6aa1bb","resolution":{"observed_at":"2026-08-07T05:41:31.024475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.028208Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.028208Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:4de6abb424c3389e96b865f5e411a383d44a9fb49015282e4142e96dce68c21a","observation_id":"24c97894-2354-4203-8680-26b925224050","resolution":{"observed_at":"2026-08-07T05:41:31.028208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T05:41:31.031550Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.CoRR, abs/2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.031550Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:8f9254bd192e4191381e157ede0498e48f5d9be6a6e455d9f3d5ec5ebea9b671","observation_id":"1b2a258c-a87d-46cf-a217-23cba86ef8d9","resolution":{"observed_at":"2026-08-07T05:41:31.031550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.035012Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.035012Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:53a4c00c55abe7270ce7938e5252906ae16ed970c0cd2ea5922409ee65e6d8da","observation_id":"871eb699-84b9-4723-b0f0-b38910bbac91","resolution":{"observed_at":"2026-08-07T05:41:31.035012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-07-06T15:58:08.777051Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-07T05:41:31.038292Z","title":"Lo- rahub: Efficient cross-task generalization via dynamic lora composition.arXiv preprint arXiv:2307.13269, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.038292Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6ff18190677c8d68fba9f611b7d5dbde1b23b3f68a24054df774192b6d7fc747","observation_id":"3b29580e-2e53-47c1-9b1b-a1f72d26afbe","resolution":{"observed_at":"2026-08-07T05:41:31.038292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.041881Z","title":"World and human action models towards gameplay ideation.Nature, 638(8051):656–663, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.041881Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:fd29be813b63b2504494b8624ded48fc5cbefdc05871da3558c80ecd0dfa9013","observation_id":"59ae6f48-dc4c-4fa6-8498-5b85dd3fb20f","resolution":{"observed_at":"2026-08-07T05:41:31.041881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.684805Z","title":"Flux.1-dev","venue":null,"work_id":"b8be83b4-31f0-4738-a075-6db0fab6b44c","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.045332Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:634c42a0437f801ecb2c1feabe7c335eae2d5a651fdffa964080f0386abb4234","observation_id":"2bac4585-920e-43ab-8355-c4b405e25684","resolution":{"observed_at":"2026-08-07T05:41:31.687864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-07T05:41:31.048650Z","title":"Belongie, Lubomir D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.048650Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:628f5ee6ac7e91cc63610ea3e4dc74a30254184545db0947542f736c2311b942","observation_id":"d6f6f6e8-80bc-4147-b11e-4ab67da20b9f","resolution":{"observed_at":"2026-08-07T05:41:31.048650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10406","last_updated":"2025-07-20T08:44:35Z","snapshot_observed_at":"2026-08-07T17:06:58.996059Z","submitted_at":"2025-03-13T14:31:52Z","title":"RealGeneral: Unifying Visual Generation via Temporal In-Context Learning with Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10406","snapshot_observed_at":"2026-08-07T05:41:31.052141Z","title":"Realgeneral: Unifying visual generation via temporal in-context learning with video models.arXiv preprint arXiv:2503.10406, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.052141Z"},"links":{"cited_paper":"/paper/2503.10406","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:c5b3d5d2edd8c908e8b20633ee25d0cf6c9ecd0425e913ee08a9c69e47f67777","observation_id":"68a26326-f4ad-4c45-8584-08b95c14948d","resolution":{"observed_at":"2026-08-07T05:41:31.052141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05638","last_updated":"2022-08-26T16:23:29Z","snapshot_observed_at":"2026-07-06T13:08:59.614061Z","submitted_at":"2022-05-11T17:10:41Z","title":"Few-Shot Parameter-Efficient Fine-Tuning is Better and Cheaper than In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05638","snapshot_observed_at":"2026-08-07T05:41:31.055832Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning.CoRR, abs/2205.05638, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.055832Z"},"links":{"cited_paper":"/paper/2205.05638","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b882d7522215aa3b374e283bdb7cb1aff8c1cb72a8c22ea8316ef5136cdd0ec9","observation_id":"441411b7-2850-41a3-b225-e8d301fcf21f","resolution":{"observed_at":"2026-08-07T05:41:31.055832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05552","last_updated":"2024-07-08T02:00:17Z","snapshot_observed_at":"2026-08-06T08:08:50.243612Z","submitted_at":"2024-07-08T02:00:17Z","title":"Ada-adapter:Fast Few-shot Style Personlization of Diffusion Model with Pre-trained Image Encoder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05552","snapshot_observed_at":"2026-08-07T05:41:31.059441Z","title":"Ada-adapter:fast few-shot style personlization of diffusion model with pre-trained image encoder.CoRR, abs/2407.05552, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.059441Z"},"links":{"cited_paper":"/paper/2407.05552","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:c8d0a08ef195ec828273f23f2fdd488c157acff07470cdbd380c425f9d168cb7","observation_id":"ae6c5fc6-e1bb-4699-b617-97775f7d40be","resolution":{"observed_at":"2026-08-07T05:41:31.059441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.675937Z","title":"Tiny imagenet","venue":null,"work_id":"2b2eeaa9-8688-42f5-99ca-c73245bae114","year":2017},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.063162Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:0e30c2122bd143d8fcb82e42e520c8a41054e0d0781e58a1b1bb9892dca04410","observation_id":"10d516c8-da65-4421-9223-93a00bb9a110","resolution":{"observed_at":"2026-08-07T05:41:31.678832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.666529Z","title":"The conceptarc benchmark: Evaluating understanding and generalization in the arc domain.Trans","venue":null,"work_id":"614b0763-53d5-42a8-ad0e-957bc2b8c70d","year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.066375Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:68d68516a29cad8c281eef7cc8da5ef0d71665840a8e88c03479c909f33b8214","observation_id":"35363675-3a16-4b09-a364-144e08557799","resolution":{"observed_at":"2026-08-07T05:41:31.669753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02271","last_updated":"2024-06-06T14:43:30Z","snapshot_observed_at":"2026-08-06T07:03:24.261003Z","submitted_at":"2024-03-04T17:58:09Z","title":"RIFF: Learning to Rephrase Inputs for Few-shot Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":"2403.02271","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.02271","snapshot_observed_at":"2026-08-07T05:41:31.277854Z","title":"RIFF: Learning to Rephrase Inputs for Few-shot Fine-tuning of Language Models","venue":"cs.CL","work_id":"8b6a4a25-8f1e-4050-b04b-2e0be1f8b58f","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.069534Z"},"links":{"cited_paper":"/paper/2403.02271","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6c6c4cf88c9a4606e3cb937b6ac6bac5acfe003b6f2aca4fd5f6f62b306e6750","observation_id":"10ebee83-ba69-4bb6-a8ba-e40e8134b31a","resolution":{"observed_at":"2026-08-07T05:41:31.283528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.657108Z","title":"Dia: A tts model capable of generating ultra-realistic dialogue in one pass","venue":null,"work_id":"c57ae469-d980-45b4-8f05-135f3e273c88","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.073307Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:9715f16bb70079d59b87b49be924258a77a3f03e80cbd01f650a4a0766675dcd","observation_id":"1e13f7f5-a7f7-4a11-9a83-b866ef615b19","resolution":{"observed_at":"2026-08-07T05:41:31.660405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.076515Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.076515Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:4ac87fce5af021393d25444ecfa17da203126b2d6dda75fc64ddb7af78c21038","observation_id":"eba69dc2-e832-47e7-9553-4903eeaa4aab","resolution":{"observed_at":"2026-08-07T05:41:31.076515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:41:31.079729Z","title":"GPT-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.079729Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:fe9a36c2130419286447504f952194a7947d563f1d5c5934d17bb921f7a95da3","observation_id":"874ce09a-6a34-4af1-bf17-492ccfe38d7f","resolution":{"observed_at":"2026-08-07T05:41:31.079729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.642003Z","title":"MIT Press, 2022","venue":null,"work_id":"50a4f976-14fc-4e1a-92da-1cdd36cae180","year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.083502Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:80ada410900719ffdcdcc2e6bebf7ff917202fb4f7ef6888cb15d61dd71b98d7","observation_id":"1def0015-5617-4265-8bb6-27536b490489","resolution":{"observed_at":"2026-08-07T05:41:31.645370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13025","last_updated":"2024-12-02T06:40:50Z","snapshot_observed_at":"2026-07-06T19:34:55.594468Z","submitted_at":"2024-10-16T20:33:06Z","title":"LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13025","snapshot_observed_at":"2026-08-07T05:41:31.086808Z","title":"Kakade, Eran Malach, and Samy Jelassi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.086808Z"},"links":{"cited_paper":"/paper/2410.13025","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:5f28bca25997eef9106ec012b1f3f81627fd74c22c940a98b3a795944290462e","observation_id":"ab90e0c9-277b-4b44-a0d1-1fa1584f069f","resolution":{"observed_at":"2026-08-07T05:41:31.086808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18072","last_updated":"2024-10-23T17:56:11Z","snapshot_observed_at":"2026-08-07T10:24:39.020859Z","submitted_at":"2024-10-23T17:56:11Z","title":"WorldSimBench: Towards Video Generation Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18072","snapshot_observed_at":"2026-08-07T05:41:31.090419Z","title":"Worldsimbench: Towards video generation models as world simulators.CoRR, abs/2410.18072, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.090419Z"},"links":{"cited_paper":"/paper/2410.18072","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:05b9a01e2eaa4c8667e55659b4b8b1aefe0350671c84156f502405a2576d6155","observation_id":"844d56ca-d5c6-4c49-807f-9fe6defb1c76","resolution":{"observed_at":"2026-08-07T05:41:31.090419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.094235Z","title":"Susskind","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.094235Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6af46c31abf7727ca9e13161492d682b80d0f6ad414c73037f2f7a5e90136f92","observation_id":"10fb846e-223d-4945-9c33-d234b2e427dc","resolution":{"observed_at":"2026-08-07T05:41:31.094235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.097645Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.097645Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:143bd231945b3c82c222e6515530273cbc7760c4e7b9da28b6a9cccfc580be9c","observation_id":"1e257c73-67aa-4e54-9935-035cf221317c","resolution":{"observed_at":"2026-08-07T05:41:31.097645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-07-06T13:45:31.237782Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-07T05:41:31.100838Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation.CoRR, abs/2208.12242, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.100838Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:62018e97bccb3abc31d832c0c48049238e097ad5ce3d3fcff968233a53fc23d8","observation_id":"445a628a-cb3c-466f-90fc-6bf6bc343497","resolution":{"observed_at":"2026-08-07T05:41:31.100838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.619994Z","title":"Crossing the uncanny valley of voice","venue":null,"work_id":"0c088ad2-d853-4fe1-b390-057857991eff","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.104480Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:d8994988543a156bd469080ddb4b9c588d2354f46238439f8b2c434309588831","observation_id":"79220935-2fe0-43e3-a193-84ebc349088c","resolution":{"observed_at":"2026-08-07T05:41:31.623588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.609678Z","title":"Emer- gent correspondence from image diffusion.Advances in Neural Information Processing Systems, 36:1363–1389, 2023","venue":null,"work_id":"191f31ec-2b3e-48c5-8d86-99e7a02b2078","year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.107617Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b4ab7bccd0666b7508aeb7cafaf1aefa9a84be548b9fe9a62e81c0e97b593b0b","observation_id":"9ddc00ca-4416-47b6-82f6-6db271f658a7","resolution":{"observed_at":"2026-08-07T05:41:31.613361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.599326Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"cfc7c015-6227-4867-ab54-b16538add9bc","year":2017},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.111170Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:8f7551885fb5281477478df86ec81a78d52f4d12889d4f7c7332ef518c8de2b7","observation_id":"36d57015-2b1e-45a3-83d4-0875288067e0","resolution":{"observed_at":"2026-08-07T05:41:31.602813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16947","last_updated":"2024-05-27T08:39:38Z","snapshot_observed_at":"2026-07-06T18:20:22.759333Z","submitted_at":"2024-05-27T08:39:38Z","title":"Zero-Shot Video Semantic Segmentation based on Pre-Trained Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16947","snapshot_observed_at":"2026-08-07T05:41:31.114364Z","title":"Zero-shot video semantic segmentation based on pre- trained diffusion models.CoRR, abs/2405.16947, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.114364Z"},"links":{"cited_paper":"/paper/2405.16947","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:1839a1c955c1d5105bbd987c3e60f54d02df8b45f22b9132d271bf4ac1a0f2cd","observation_id":"d12b698c-db14-4fdd-b8f8-85c6a519d4fa","resolution":{"observed_at":"2026-08-07T05:41:31.114364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.117747Z","title":"Images speak in images: A generalist painter for in-context visual learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.117747Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6ed7d5093ac4c09ac9f6aeed637bbedb30ae196140db98125a131856f86d2e50","observation_id":"b1bd5879-3624-402e-9b6e-c555a43c721b","resolution":{"observed_at":"2026-08-07T05:41:31.117747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.121040Z","title":"In-context learning unlocked for diffusion models.Advances in Neural Information Processing Systems, 36:8542–8562, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.121040Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:03f0b8512e23f38b89adcc44658a526bca93a2950054006c4f37c87139511d7f","observation_id":"6847a085-8b7c-41ca-bd7d-0fdd14ac06e4","resolution":{"observed_at":"2026-08-07T05:41:31.121040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T05:41:31.124450Z","title":"Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, and William Fedus","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.124450Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:ac2098b89026232a43b02525c5c6a966e7b22c807360fa81d01ad2c47cf16257","observation_id":"5de88ffb-3b23-4b47-9563-6a6cfedd9a05","resolution":{"observed_at":"2026-08-07T05:41:31.124450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-07-06T19:16:51.512681Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-07T05:41:31.127934Z","title":"Omnigen: Unified image generation.CoRR, abs/2409.11340, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.127934Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:7ed1b25b48f36a30682cc806dc0ae5e7f360f2b236bf1c58e9e72b437b5581e5","observation_id":"89f9a7d8-2fd4-4b3e-8aa0-27e1cefbc6ff","resolution":{"observed_at":"2026-08-07T05:41:31.127934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.578126Z","title":"What matters when repurposing diffusion models for general dense perception tasks?The Thirteenth International Conference on Learning Representations (ICLR), 2025","venue":null,"work_id":"8e7e742a-5ecd-431d-9eea-d65353a826be","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.131459Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:f6f791a392a111512d83febff39e1de29c3e87207e4e3b147f1ab18338534645","observation_id":"8d80d2ce-80af-4c52-aa80-66ba891ac7d1","resolution":{"observed_at":"2026-08-07T05:41:31.581683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17139","last_updated":"2024-02-27T02:05:29Z","snapshot_observed_at":"2026-08-04T02:50:42.922408Z","submitted_at":"2024-02-27T02:05:29Z","title":"Video as the New Language for Real-World Decision Making","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17139","snapshot_observed_at":"2026-08-07T05:41:31.134881Z","title":"Walker, Jack Parker-Holder, Yilun Du, Jake Bruce, André Barreto, Pieter Abbeel, and Dale Schuurmans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.134881Z"},"links":{"cited_paper":"/paper/2402.17139","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:4cc018abeeef3df08b4d3804e8118493ad4bb1ed6458dda5b3ac536081d0ea07","observation_id":"37625214-519f-46b9-9d50-251d091c359f","resolution":{"observed_at":"2026-08-07T05:41:31.134881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T05:41:31.138543Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.138543Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:28103b6d685f70217ab5f74e8d1c13950b45ea827a602b593bd890fc334a0a83","observation_id":"42e79d60-92ef-444e-8010-d438332c5a31","resolution":{"observed_at":"2026-08-07T05:41:31.138543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.141898Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.141898Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:1bbb1304b93cbf45220f449f5176113d0f88f9f7a8ec96b0413d62d7e89aaae7","observation_id":"2dbf55e9-d5ee-4c44-b893-d6ce772cfe9e","resolution":{"observed_at":"2026-08-07T05:41:31.141898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.561948Z","title":"Semantic understanding of scenes through the ade20k dataset.International Journal of Computer Vision, 127(3):302–321, 2019","venue":null,"work_id":"7fe312a2-0d0f-4246-8180-d34f0f318c04","year":2019},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.145142Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:309a777190048b67a4bf21f239ca1833cc6350d28b9879436f90bb7aea296d0d","observation_id":"d9336de3-c5b4-480b-8fd5-28403e13fd93","resolution":{"observed_at":"2026-08-07T05:41:31.565880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.550514Z","title":"This is impractical, as it requires 17 visually distinct colors","venue":null,"work_id":"b1be98c2-4b07-4c53-84e2-9770c5b1fa1e","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.148629Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:f619c0ae2355a1d7dc9078c7b59bd691f7930330bf8f6eded5de15e633478b5b","observation_id":"0a631846-db9f-4345-9780-d5127e95c136","resolution":{"observed_at":"2026-08-07T05:41:31.554990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.539408Z","title":"However, this increases inference costs by nearly a factor of 20, which is prohibitive for our setup where inference speed is already a bottleneck","venue":null,"work_id":"dbf2d4a3-0e66-4a41-9f2a-8c1cde75aafa","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.151920Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:c36e57daf71c668142f74268a545cd8d247f83d04ab1db307b158b03bf1bbbda","observation_id":"92fb84dc-0f4c-4d51-9733-6dd64eed3900","resolution":{"observed_at":"2026-08-07T05:41:31.543173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.529240Z","title":null,"venue":null,"work_id":"cb3dcb9e-d141-4b64-baea-cdb7b55171e5","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.155259Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:7889abcb0438864e4fb2f6f453fca20ac353358c09ff595c768702aec01b713c","observation_id":"055368f1-d590-45ee-9fcc-d150ade68e5e","resolution":{"observed_at":"2026-08-07T05:41:31.532560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.519441Z","title":null,"venue":null,"work_id":"618fad3a-40fb-47c3-b4aa-25ae82b4dff5","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.158561Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:480db15d8befb32718c6c90a3f476b6e4b5573aa7b728cb258d02bb675a456f2","observation_id":"7a1916ad-60c0-4feb-a264-55fd681c7d33","resolution":{"observed_at":"2026-08-07T05:41:31.522803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.509003Z","title":null,"venue":null,"work_id":"6b93b21c-4a2c-4eaa-b421-8983c033b6b7","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.161776Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:5e710eb90acaa1f4f1d4f5e64cc7be447261b884a6982de6541438c5cefc09fd","observation_id":"67d6b4cd-1777-4c38-a140-ff00ce3dce88","resolution":{"observed_at":"2026-08-07T05:41:31.512744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.498796Z","title":"segment animals","venue":null,"work_id":"c32ef45c-4fb5-4a85-9082-390a4d60d81b","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.165907Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:cb020af98aa8dff4784497e319efbf6060dde1ac5949fd3b923cb309c3db5460","observation_id":"deeb5fd9-6c0f-43ac-8ede-674ea125f838","resolution":{"observed_at":"2026-08-07T05:41:31.502352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 4 inbound Pith citation observations for arXiv:2506.07280."}