{"as_of":"2026-08-09T13:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a7e338b73def4008ab54155e28d7afa93dd2ae940e99e4f3c5d3ed7d5c74c94","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:11:50.078534Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:09:29.580056Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-08-06T23:11:50.078534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19408","last_updated":"2025-06-24T08:23:55Z","snapshot_observed_at":"2026-08-09T00:14:49.392424Z","submitted_at":"2025-06-24T08:23:55Z","title":"Is an object-centric representation beneficial for robotic manipulation ?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:50.078534Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2506.19408"},"observation_digest":"sha256:f30cd129d870ad3e22e3a9e2703e94e8a79aa828edba1f2203808f337ec42d00","observation_id":"5cec6f46-9634-477d-81a8-74278cc13a85","resolution":{"observed_at":"2026-08-06T23:11:50.078534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2507.04447","last_updated":"2025-08-26T08:23:50Z","snapshot_observed_at":"2026-08-05T16:56:52.400110Z","submitted_at":"2025-07-06T16:14:29Z","title":"DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T15:42:41.363422Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2507.04447"},"observation_digest":"sha256:834d1fbba1bab5a204c529952555d26f6c4abeb338c7620c02d84d9a972a50d8","observation_id":"a9cb98dc-1036-4994-8d70-8f919ae0bd3c","resolution":{"observed_at":"2026-05-16T15:42:41.660719Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-08-05T22:22:58.808101Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07144","last_updated":"2025-08-10T02:27:06Z","snapshot_observed_at":"2026-08-05T22:22:57.128439Z","submitted_at":"2025-08-10T02:27:06Z","title":"Dynamic Pattern Alignment Learning for Pretraining Lightweight Human-Centric Vision Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T22:22:58.808101Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2508.07144"},"observation_digest":"sha256:05a1a8bbebe243cd5ff6e139b89d505d8c737e569afbd6105ef1dc8fac34fc4f","observation_id":"26caf29b-1180-4d8a-aa97-7c020eed7bff","resolution":{"observed_at":"2026-08-05T22:22:58.808101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-08-04T17:26:19.552910Z","title":"Shang, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10952","last_updated":"2025-09-13T19:23:36Z","snapshot_observed_at":"2026-08-08T07:20:50.102524Z","submitted_at":"2025-09-13T19:23:36Z","title":"ImMimic: Cross-Domain Imitation from Human Videos via Mapping and Interpolation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T17:26:19.552910Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2509.10952"},"observation_digest":"sha256:ba1cea3511170a5a5b66cffaea4ae5c83dd1fc37f87143baaf9ca8330691756c","observation_id":"3c575d66-de10-419b-9a9a-87d97cf82a59","resolution":{"observed_at":"2026-08-04T17:26:19.552910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2511.19704","last_updated":"2026-04-10T00:50:03Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-24T21:15:01Z","title":"RADSeg: Unleashing Parameter and Compute Efficient Zero-Shot Open-Vocabulary Segmentation Using Agglomerative Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T05:23:11.261860Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2511.19704"},"observation_digest":"sha256:ac276067a24724616fc6637bfa02507912c85641a0383561f7f5f667884f011e","observation_id":"890b4ed2-661c-42f5-88be-4dcaf068aabd","resolution":{"observed_at":"2026-05-17T05:24:04.765662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2512.20157","last_updated":"2026-04-07T16:17:58Z","snapshot_observed_at":"2026-08-04T03:25:25.926025Z","submitted_at":"2025-12-23T08:37:11Z","title":"SigLino: Efficient Multi-Teacher Distillation for Agglomerative Vision Foundation Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T20:21:47.430865Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2512.20157"},"observation_digest":"sha256:988dc21e276e7c0d695cc82083da2bdc1d28627d291fef7135aef348bbd9578a","observation_id":"319d9c38-1d2e-40b0-b065-2741b47c2424","resolution":{"observed_at":"2026-05-16T20:23:23.731777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-08-03T07:04:44.923245Z","title":"Theia: Distilling diverse vision foundation models for robot learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.21416","last_updated":"2026-06-24T09:10:01Z","snapshot_observed_at":"2026-08-07T14:43:05.513047Z","submitted_at":"2026-01-29T08:55:53Z","title":"Spotlighting Task-Relevant Features: Object-Centric Representations for Better Generalization in Robotic Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T07:04:44.923245Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2601.21416"},"observation_digest":"sha256:008c8baf50e4cd10bcb4359393c75533089895f901392d55c123f82ca7c88492","observation_id":"72cff02c-9387-4abf-9791-edfbdb9ef77d","resolution":{"observed_at":"2026-08-03T07:04:44.923245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2603.15956","last_updated":"2026-04-20T19:05:45Z","snapshot_observed_at":"2026-07-06T22:49:19.323519Z","submitted_at":"2026-03-16T22:12:48Z","title":"ExpertGen: Scalable Sim-to-Real Expert Policy Learning from Imperfect Behavior Priors","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T09:37:02.168898Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2603.15956"},"observation_digest":"sha256:a97eabb3a17d61dedc9f899c7760150601878caac97ed5a85341f16fd1b21000","observation_id":"4923df3b-62c9-4fc4-8bfb-0c93c0e8c268","resolution":{"observed_at":"2026-05-15T09:39:55.177952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2604.22992","last_updated":"2026-04-24T20:16:15Z","snapshot_observed_at":"2026-07-06T23:09:19.041332Z","submitted_at":"2026-04-24T20:16:15Z","title":"Efficient Image Annotation via Semi-Supervised Object Segmentation with Label Propagation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:21.475036Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2604.22992"},"observation_digest":"sha256:b1d4cc90ad6c7bf1c4ab5d9a5921c2aee776a71c7162b75b12e19a50b49b64fd","observation_id":"181c552a-0578-4513-8992-5c66a83521f3","resolution":{"observed_at":"2026-05-11T19:16:07.173665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2605.12491","last_updated":"2026-05-12T17:59:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T17:59:26Z","title":"Elastic Attention Cores for Scalable Vision Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T06:02:40.158866Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2605.12491"},"observation_digest":"sha256:58fba47b31075800ae7fb754a05afbefe69815cfbcf0ff214eca060cd8993ab2","observation_id":"5129e6c7-3db3-46b5-a89c-b4c1535e013f","resolution":{"observed_at":"2026-05-13T06:07:22.613444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2605.16743","last_updated":"2026-05-16T01:50:18Z","snapshot_observed_at":"2026-07-06T23:27:52.850836Z","submitted_at":"2026-05-16T01:50:18Z","title":"LACE: Latent Visual Representation for Cross-Embodiment Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T21:38:33.937153Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2605.16743"},"observation_digest":"sha256:3dc5109878f0d6acc38015e918b3d071f59b0163b73305f1624fe29894ecd111","observation_id":"e36865a4-f893-4107-be7b-acd44ab738e4","resolution":{"observed_at":"2026-05-19T21:42:48.316408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2606.03444","last_updated":"2026-06-02T10:28:32Z","snapshot_observed_at":"2026-08-08T22:37:49.595533Z","submitted_at":"2026-06-02T10:28:32Z","title":"PRISM: Synergizing Vision Foundation Models via Self-organized Expert Specialization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:47:33.591670Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2606.03444"},"observation_digest":"sha256:0aa44a127959c9f7b93dca1442019e2a9d2beb66ceab30b5b31abbad6fa1f630","observation_id":"c1c81271-8e74-4de3-a5e8-286af5926ef0","resolution":{"observed_at":"2026-07-02T02:36:27.241421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2606.04046","last_updated":"2026-06-02T07:50:56Z","snapshot_observed_at":"2026-08-06T11:17:23.952215Z","submitted_at":"2026-06-02T07:50:56Z","title":"Dive into the Scene: Breaking the Perceptual Bottleneck in Vision-Language Decision Making via Focus Plan Generation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-28T10:28:41.952330Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2606.04046"},"observation_digest":"sha256:9c988abf0206234676be1828754930577f89fafa68ddd3e21fd0143df5946abc","observation_id":"f9a1dc47-02e1-47ac-a0b8-0e32d2a9388e","resolution":{"observed_at":"2026-07-02T02:56:29.281950Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2606.12499","last_updated":"2026-06-10T13:58:14Z","snapshot_observed_at":"2026-08-01T18:40:28.545062Z","submitted_at":"2026-06-10T13:58:14Z","title":"Action-Effect Memory Pretraining for Robot Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T09:22:17.435427Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2606.12499"},"observation_digest":"sha256:00e60c7f1c9602ffe5e5b77d195f11b7b1d7b5ce33df1b70da317122d2a84494","observation_id":"0b1cabc2-4a61-4189-a742-e4820622a1cd","resolution":{"observed_at":"2026-07-03T11:48:04.840744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":"2407.20179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-07-04T03:09:29.580056Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"ee430a90-3ded-47db-bdf1-bbc20527e97a","year":2024},"citing_paper":{"arxiv_id":"2606.20559","last_updated":"2026-06-18T17:59:45Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-06-18T17:59:45Z","title":"UNIEGO: Proxies as Mediators for Unified Egocentric Video Representation Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T18:25:13.494219Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2606.20559"},"observation_digest":"sha256:e8074c98b0d442df178ee6afad4d52b8abf70edfecfd4109517926f4a7f0eeea","observation_id":"ba4c843e-e302-4175-beb8-53ae8518e5cb","resolution":{"observed_at":"2026-07-04T03:09:29.582106Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20179","snapshot_observed_at":"2026-08-04T19:45:35.210298Z","title":"May, Maria Vittoria Minniti, Tarik Kelestemur, David Watkins, and Laura Herlant","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":231,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.210298Z"},"links":{"cited_paper":"/paper/2407.20179","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:e3c3c86b320c09e0580e34e7cf5e03d19a8e0819baf5aac81887192edc881097","observation_id":"f41f797f-ca3e-441a-9b29-09198ee0bab1","resolution":{"observed_at":"2026-08-04T19:45:35.210298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.20179/citation-record","integrity":"/paper/2407.20179/integrity","json":"/paper/2407.20179/citation-record.json","paper":"/paper/2407.20179"},"outbound":[],"paper":{"arxiv_id":"2407.20179","last_updated":"2024-10-10T17:27:46Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-05T08:02:41.235535Z","submitted_at":"2024-07-29T17:08:21Z","title":"Theia: Distilling Diverse Vision Foundation Models for Robot Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2407.20179."}