{"as_of":"2026-08-05T02:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a90539db22458ef31bf117f03e1250218cc6a7239bcf39327f251527c89f682","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T09:56:36.716680Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.04978/citation-record","integrity":"/paper/2510.04978/integrity","json":"/paper/2510.04978/citation-record.json","paper":"/paper/2510.04978"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World models","venue":null,"work_id":"18aab799-c9d7-4c04-b826-385e9acfb3c0","year":2018},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:4e87c4c4d249a2e1e5d926908161b760bbe5697546f6a626276d18e8a92616d1","observation_id":"2d7a450f-966d-4541-a73f-2c744782dcca","resolution":{"observed_at":"2026-05-18T10:02:33.009268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AI meets physics: a comprehensive survey","venue":null,"work_id":"3f166514-5139-4b4e-9020-89e58524c845","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:361c0a31ea8669f9c60ba65b5366d11ee072c891288385b449dff24eef1f3fcf","observation_id":"89f23755-c80e-40f4-b171-9db36c023590","resolution":{"observed_at":"2026-05-18T10:06:14.764377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Newtonian Scene Understanding: Unfolding the Dy- namics of Objects in Static Images","venue":null,"work_id":"5f7a4fb3-1544-47af-9fd9-421894e4cca9","year":2016},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:ce757da289cf98928c465cfc7963711435afd21ed2d4b8017f8cf8be72bec419","observation_id":"14f2b4dd-2e5c-4202-94a5-41f054861532","resolution":{"observed_at":"2026-05-18T10:02:33.133879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interaction Networks for Learning about Objects, Relations and Physics","venue":null,"work_id":"845e11c8-b204-400b-8af4-b6dd055693c7","year":2016},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:1b92af408ca84feb350debd686d958fd943f3bb845a5bd81d5b3e21866c1a781","observation_id":"8edefe4c-a278-4130-ab65-3a2a543f58da","resolution":{"observed_at":"2026-05-18T10:02:33.060287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19099","doi":"10.48550/arxiv.2505.19099","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SeePhys: Does Seeing Help Thinking? – Benchmarking Vision-Based Physics Reasoning","venue":"ArXiv.org","work_id":"7b4f01c1-77a7-4272-95dc-651e586fbafa","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:19d6406d3125f42e388c164a94a3ece399f4bfc6a5057f0f8758ec068a0eb5a7","observation_id":"e547076c-9fd7-4ea2-ba40-69bf5116bc5c","resolution":{"observed_at":"2026-05-18T10:01:14.095701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I-PHYRE: Interactive Physical Reasoning","venue":null,"work_id":"40f441a6-73fe-4f1d-bab1-5b2f2abd743b","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:f9e27d35d950ab5728afe0f7d331d87a7ff99045cc7b37492d00375829636089","observation_id":"c0db6433-2d47-4e47-9a42-0ed1f66954db","resolution":{"observed_at":"2026-05-18T10:06:14.674002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PhyBlock: A Progressive Benchmark for Physical Understanding and Planning via 3D Block Assembly","venue":null,"work_id":"e771b92d-39f9-413a-a670-dd346f2ed5da","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c199561bd8a8018b4563920d8abdb616da7c42f41b401fc909b3fda10ec786d1","observation_id":"8e999ea8-854e-4ac1-9c37-ca5dd2f340ec","resolution":{"observed_at":"2026-05-18T10:06:14.702239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08027","last_updated":"2026-04-23T21:02:30Z","snapshot_observed_at":"2026-07-30T08:49:18.908938Z","submitted_at":"2024-11-12T18:56:58Z","title":"LLMPhy: Parameter-Identifiable Physical Reasoning Combining Large Language Models and Physics Engines","version":3},"cited_work":{"arxiv_id":"2411.08027","doi":"10.48550/arxiv.2411.08027","metadata_source":"pith","pith_arxiv_id":"2411.08027","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"LLMPhy: Parameter-Identifiable Physical Reasoning Combining Large Language Models and Physics Engines","venue":"cs.LG","work_id":"0c14a600-1adb-4c1e-915e-1f7f5605d4b0","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2411.08027","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:561484e05720bf1c2795460af681166d5de96355f7c489d9df49173a8b3da153","observation_id":"d31a071c-af04-4746-aa63-f0a8d9e5b1db","resolution":{"observed_at":"2026-05-18T10:01:14.275840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ComPhy: Compositional Physical Reasoning of Objects and Events from Videos","venue":null,"work_id":"d2a61552-9f2a-4e05-a594-b16dc7afa747","year":2022},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:d0e0f2243d348c153353ab0c5c3233a45be11ec40840043ab77888f7c4a16893","observation_id":"f32535b6-1a5e-4124-bc3c-936b9065a4b4","resolution":{"observed_at":"2026-05-18T10:06:14.696163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semi-supervised classifica- tion with graph convolutional networks","venue":null,"work_id":"add0b1e4-ad65-4041-8807-d99ac2096ade","year":2017},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:90c0b150676db2e1beb65b687aeff4601f3977ab5b9eb34202d7e02a8ccce066","observation_id":"9053140a-eae1-4366-916e-de3d78dedf42","resolution":{"observed_at":"2026-05-18T10:06:14.667673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph Attention Networks","venue":null,"work_id":"7f0f8ffc-999e-47c3-95ff-85d844efeaad","year":2018},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:e93d24ec557f9d553b8de6c92003c4feefd675ce4f15a8e9890006b460f00b3a","observation_id":"56d0e3dd-ce25-4341-88d0-cc3a68508f10","resolution":{"observed_at":"2026-05-18T10:06:14.756227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inductive Representation Learning on Large Graphs","venue":null,"work_id":"aa087376-59a4-4df2-8dd2-de874bfaff19","year":2017},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:98941d37054f008ef55a3099bbfafbdeb9ae34bc447b277d10a55494ea85ba57","observation_id":"4f70b610-d81f-41e0-8160-8a956a4dcc59","resolution":{"observed_at":"2026-05-18T10:06:14.858754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual In- teraction Networks: Learning a Physics Simulator from Video","venue":null,"work_id":"f8c709f3-5ffc-408f-a194-58573e8eff30","year":2017},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:e59fa3878d66ae475859f2c17b59816b00324785cfb8117677b6a091828b9bad","observation_id":"f3b966f9-02f7-4a47-9524-f9f478c9dc2a","resolution":{"observed_at":"2026-05-18T10:06:14.791607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Com- positional Object-Based Approach to Learning Physical Dynamics","venue":null,"work_id":"1d33cd3f-f435-47f4-8d8a-640e8f44331f","year":2017},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:b0ea720fb9c4289201ca9b9d7b34f7ac9620e012e0cf5a45e46dc6e705dc7ebf","observation_id":"1e4305b6-6d6a-48c7-a6bb-09a9c94b5ac3","resolution":{"observed_at":"2026-05-18T10:06:14.735215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motion- Craft: Physics-Based Zero-Shot Video Generation","venue":null,"work_id":"74ffa523-a42b-4ba0-b9c4-b93afac988c0","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:2f2d6ff402abac1b554ebfea35b4c91f3b092bc30724504599cb85c66dd08b45","observation_id":"583c3eed-bd6d-4438-814b-536a4f0d6d9e","resolution":{"observed_at":"2026-05-18T10:06:14.728557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23656","last_updated":"2025-05-29T17:06:44Z","snapshot_observed_at":"2026-07-06T21:33:02.686798Z","submitted_at":"2025-05-29T17:06:44Z","title":"VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models","version":1},"cited_work":{"arxiv_id":"2505.23656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23656","snapshot_observed_at":"2026-07-04T16:59:58.033217Z","title":"arXiv preprint arXiv:2505.23656 (2025)","venue":null,"work_id":"d810b0fc-7ae5-44e9-bd6e-bf39477b57a2","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2505.23656","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:f7a1578c0a201ca15150ee84ae7c45e5eb8bee2dada4fe1add20d23455d6ab6a","observation_id":"b39a40a2-396c-4989-9eeb-1d6698f25ca4","resolution":{"observed_at":"2026-05-18T10:01:13.996334Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How Do Transformers Model Physics? Investigating the Simple Harmonic Oscillator","venue":null,"work_id":"18ab3768-ef4d-4df0-88da-74f4922dc0e5","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c0b6ed9ad3b128d27610a5f8a1f6bd98d137077f27a8a3ff6e7ec7c715c65122","observation_id":"9584e967-52e5-4bbb-aca4-8ff8d85e4dec","resolution":{"observed_at":"2026-05-18T10:06:14.813442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Physics-guided Multimodal Transformer Path to Weather and Climate Sciences","venue":null,"work_id":"be1a02bc-6761-4d58-a2a9-3cd133d34326","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:7ba7afa7ac27730e1e785f7ac5b5ac5479c9f96716cf1cfdcfda703ccd09e36b","observation_id":"7e53a4e1-8d0b-45d5-86fb-9dcda5803c66","resolution":{"observed_at":"2026-05-18T10:02:33.195480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solving fluid flow problems using semi-supervised symbolic regression on sparse data","venue":null,"work_id":"02cb8807-1139-4969-95be-2d73ee8f8452","year":2019},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:b098f42b5b2041d97203d5878b66121da5e42bafc917dcc1327b271dfec42523","observation_id":"328ec611-0b61-4fcb-be2f-74b0d7a7470f","resolution":{"observed_at":"2026-05-18T10:02:33.167499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05331","last_updated":"2025-06-05T17:59:02Z","snapshot_observed_at":"2026-07-06T21:37:28.044836Z","submitted_at":"2025-06-05T17:59:02Z","title":"MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2506.05331","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.05331","snapshot_observed_at":"2026-07-10T01:46:40.974962Z","title":"MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of- Thought Reasoning","venue":"cs.CV","work_id":"ae2c8c54-232b-4ff7-8f07-d23ab761b067","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2506.05331","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:ceb52e6e8ea6c5e6192d05beeb539a769ed3b95dba4af4e9ecabebed31b31969","observation_id":"80a4c7eb-cf27-4fc6-842f-10123cbdbcbf","resolution":{"observed_at":"2026-05-18T10:01:14.138712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AlphaDrive: Un- leashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","venue":null,"work_id":"8dd771de-f2f8-4fd4-bc27-dd783d4881c7","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:acb4ddaa88dd4b98289279cc9bb1a96e5a39efaa3a26654e42929a4bb6aba018","observation_id":"b7ece359-ecc3-4a16-8d07-1f2bb7de348b","resolution":{"observed_at":"2026-05-18T10:02:33.131695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.01944","last_updated":"2026-04-17T07:58:14Z","snapshot_observed_at":"2026-08-02T21:42:58.758339Z","submitted_at":"2025-09-02T04:32:24Z","title":"AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2509.01944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.01944","snapshot_observed_at":"2026-07-04T10:09:44.942798Z","title":"AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving","venue":"cs.RO","work_id":"d3efd563-354c-4bcd-8604-60cb723de5b2","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2509.01944","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:43d972efae653a55a095b3a06837a363c82dba62f915b3535069bed723834b95","observation_id":"b61adc3f-6509-4b75-9666-c8ae5d84f02f","resolution":{"observed_at":"2026-05-18T10:01:14.037454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-04T16:07:24.699834Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"cited_work":{"arxiv_id":"2509.16679","doi":"10.48550/arxiv.2509.16679","metadata_source":"pith","pith_arxiv_id":"2509.16679","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement learning meets large language models: A survey of advancements and applications across the LLM lifecycle","venue":"cs.CL","work_id":"f4d2b80d-8fa3-41ad-a490-eab600e35f2f","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2509.16679","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:71b7dc958b9f33e46b56ee5dbef77ffb802c1959eb855abbe939d29d005e76ed","observation_id":"39461bab-9f44-4b56-9a4f-484a762757cb","resolution":{"observed_at":"2026-05-18T10:01:13.986090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Causal Modeling of Dynamical Systems","venue":null,"work_id":"9d877154-885b-420a-9185-1bc4eb0972e4","year":2018},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:90342cd93e2b4ad37824ef3da503b9636019030d32a763f4c7b062d1bd634610","observation_id":"0ff8d442-f356-4ec4-a514-9284cd3015eb","resolution":{"observed_at":"2026-05-18T10:02:33.095571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using Causal Threads to Explain Changes in a Dynamic System","venue":null,"work_id":"79141010-357b-4f5e-8a41-b312a9ac005f","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:f2366a098aa3e182f69eff83c214bab204f9ec222136e7ceb802ee35b4213d5d","observation_id":"3c5e77b3-a861-4371-a823-0edd3c310633","resolution":{"observed_at":"2026-05-18T10:02:33.057867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PhysORD: a neuro-symbolic approach for physics-infused motion prediction in off- road driving","venue":null,"work_id":"5cae75b6-30fb-40da-8feb-5dfab248c659","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:b6d621e5d30187c08ba2fc4a388c1ee974f4d9a0befec2f2a35b0677654c8508","observation_id":"e0dfee4a-c7c2-4ab1-9f69-2384ccd833bb","resolution":{"observed_at":"2026-05-18T10:02:33.029308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Functional optimiza- tion of fluidic devices with differentiable stokes flow","venue":null,"work_id":"e1711b23-586a-415d-976f-f72a40b77d45","year":2020},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:6c8013d075ab44a5ef4f7ba9d7ca1da096f857c6e6d24d7584873ffdb16ca6e0","observation_id":"77c9f1b2-e279-4faa-9985-8b65d3e86f20","resolution":{"observed_at":"2026-05-18T10:06:14.658791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable Differen- tiable Physics for Learning and Control","venue":null,"work_id":"cbb45769-d199-4192-ac5c-ebf8bfe470bd","year":2020},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:592e291c6b9bf1ebb4013cc6db096a2f8ca9e3e23c6fcc329cf2844e0993a142","observation_id":"8d093074-516d-43d4-931c-ccf6481ceca4","resolution":{"observed_at":"2026-05-18T10:06:14.785133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:cef94c944d65f6c2eb739eb9936dacdaa0d053e02005e8bbc7a7271551e0673b","observation_id":"02173e24-f841-468e-9d54-a42c59d31b41","resolution":{"observed_at":"2026-05-18T10:01:14.021861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual Instruction Tuning","venue":null,"work_id":"ce619948-106a-49b7-a2cd-7c9e4eb75f2f","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:71ae8c43e9f322c33130a4fab1f49242bc8e0275029910c7081573c58ee3f5ac","observation_id":"5d6c67ca-69d2-46d5-8916-7d04b97cd483","resolution":{"observed_at":"2026-05-18T10:06:14.649693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenAI o1 System Card","venue":null,"work_id":"e16308d7-c0a6-45cc-ab8e-14580ccbe299","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:75da7f997abeae55c43191f475c795044f028458d6dd7fa4b9a2d8dd27f10c58","observation_id":"798ee910-28c9-48d4-9c08-28095b1a8a8a","resolution":{"observed_at":"2026-05-18T10:06:14.852865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:001d07a778367b17aedda5cf9816623c51eb6db67918edcba417ddff60e219cc","observation_id":"2a49b34e-3b81-47b3-8ed5-3cde989980b1","resolution":{"observed_at":"2026-05-18T10:01:14.148609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude 3.7 Sonnet System Card","venue":null,"work_id":"71be1948-f116-41fb-83b6-2435c8c7ba30","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c9158edd340431e853f34e72792ab3f786472c65829cc611b62d0efed0513c92","observation_id":"cc17a433-7720-4169-83d1-50947f773277","resolution":{"observed_at":"2026-05-18T10:06:14.692747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini 2.5 Pro Model Card","venue":null,"work_id":"744f1a0f-9b37-446e-8931-ccf390b57605","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:bea7eb37b2b9fb8c7512595b0582c0bccdcfe8512c7f8a53a34029f5344523ae","observation_id":"b18ad726-2faa-4e4f-bbc4-e4394f69da9d","resolution":{"observed_at":"2026-05-18T10:06:14.834014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06079","last_updated":"2025-09-07T14:47:32Z","snapshot_observed_at":"2026-07-06T22:25:17.448585Z","submitted_at":"2025-09-07T14:47:32Z","title":"Multimodal Reasoning for Science: Technical Report and 1st Place Solution to the ICML 2025 SeePhys Challenge","version":1},"cited_work":{"arxiv_id":"2509.06079","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06079","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal reasoning for science: Technical report and 1st place solution to the icml 2025 seep- hys challenge","venue":null,"work_id":"858c9e84-e819-45fd-8b5c-c94107e55620","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2509.06079","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c36b4948adc62bbf47f3d570c75063617c5860da63fba84168f227207be61c1e","observation_id":"9ffb08e6-992e-44d3-af04-b23efce7750f","resolution":{"observed_at":"2026-05-18T10:01:14.301965Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","venue":null,"work_id":"db11a93c-bb20-4d6e-bdc4-143b4a29da84","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c6b9dd5bed2786182ad47cf977b72fb6efd9442b4998eedf40e9418bc82c1510","observation_id":"6af3a576-afca-4a36-80a9-84178064bc37","resolution":{"observed_at":"2026-05-18T10:06:14.716218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DriveDreamer: Towards Real-world-driven World Models for Au- tonomous Driving","venue":null,"work_id":"5ee86f3f-2e0a-49f6-8b66-2183c5864a17","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:3054ce24b12579781d71ae75007a4bf5e0963b0b978dc1bef328b4caf6b3bba5","observation_id":"4c71f47e-c6a0-42ba-9289-88bfa48e65e8","resolution":{"observed_at":"2026-05-18T10:06:14.779105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:52df4763dfe30f598743345e2b74751deb359bac203a829d8511d2330c1cf4ce","observation_id":"59b7c329-31c4-47a3-8681-91ffdefbd5bc","resolution":{"observed_at":"2026-05-18T10:01:14.175215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pi0: A vision- language-action flow model for general robot control","venue":null,"work_id":"3f320593-d043-4541-b545-bdf95293b774","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:8f388253a5d70210fd12d4b1ee79a805e904e42456b12e187d1ea9543fa03a01","observation_id":"31213636-5fa8-4c33-bcd7-e0575357f04b","resolution":{"observed_at":"2026-05-18T10:06:14.662672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on multimodal large language models","venue":null,"work_id":"ed527094-d39a-4e6f-9487-0feb537de956","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:19ebf6df29474b15f45c124b58f014b880742f3259481a089d6f4105780ef439","observation_id":"e511a6eb-06a9-4942-b5ac-d727621173ef","resolution":{"observed_at":"2026-05-18T10:06:14.828279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large lan- guage models predict human sensory judgments across six modalities","venue":null,"work_id":"8c10c4f6-535d-448c-a740-c11997295aa7","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:59fffb2a163fee6b500b8ac0f8e70b0dde0a5a48cc26bb6a9952f6dcb213bbaf","observation_id":"8aaa74c1-d3e0-4b19-bd7c-d31c46158d30","resolution":{"observed_at":"2026-05-18T10:06:14.773471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.19294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T10:04:35.938832Z","title":"Object detection with mul- timodal large vision-language models: An in-depth re- view","venue":null,"work_id":"36ed20d4-7f89-4ff5-8b32-6bb93ef5ac4d","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:5e4b9a736b270b4bf8cd0c40289b0ceb57ffffc02f8b864f87701805511bdfff","observation_id":"c7da20b3-cda5-4f50-bc28-c2b3a40c7de6","resolution":{"observed_at":"2026-05-18T10:01:14.286181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16836","last_updated":"2024-02-26T18:57:52Z","snapshot_observed_at":"2026-08-04T06:34:15.798812Z","submitted_at":"2024-02-26T18:57:52Z","title":"PhyGrasp: Generalizing Robotic Grasping with Physics-informed Large Multimodal Models","version":1},"cited_work":{"arxiv_id":"2402.16836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16836","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Phygrasp: Gener- alizing robotic grasping with physics-informed large multimodal models","venue":null,"work_id":"d8796ea3-ac65-4bf3-b2e4-763783c5f9ed","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2402.16836","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:27239d192b61eff5f38c2d191db62e96b3469f0d3eeb763853079f57f2ba7b48","observation_id":"7da923b3-d86b-43b9-8894-1b94dde46fbf","resolution":{"observed_at":"2026-05-18T10:01:14.164228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.10273","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Probing perceptual con- stancy in large vision language models","venue":null,"work_id":"e4a85c4f-23e4-45b0-8c91-0ddca48c2651","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:e53102fdd648d5ffc45cef7d6bc358515a25f555df903d627ff98db38ba000dc","observation_id":"366703ec-d7e4-4f41-9943-b79c48a108b9","resolution":{"observed_at":"2026-05-18T10:01:14.169445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:09:55.122244Z","title":"From perception to cognition: A survey of vision-language interactive rea- soning in multimodal large language models","venue":null,"work_id":"22f0e273-0072-409a-8fae-d36d7bee642a","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:75e3808bfe969b805e1e78f84d7d6fc9b1708635a082ed90564945a90ef785f4","observation_id":"bd5b8597-4f22-40f7-a554-ca76e69d0afa","resolution":{"observed_at":"2026-05-18T10:01:14.189725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"cited_work":{"arxiv_id":"2502.17419","doi":"10.48550/arxiv.2502.17419","metadata_source":"pith","pith_arxiv_id":"2502.17419","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","venue":"cs.AI","work_id":"67495af7-38a4-40b1-bd10-fd9d939c7abd","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2502.17419","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:3277fc4c0b78a61beeadb53a7cdb2dade81b7ca6ef01741e78f54bc3ef9fb763","observation_id":"4e09290a-1dae-4baa-9c1a-921416035dec","resolution":{"observed_at":"2026-05-18T10:01:14.032479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04141","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The artificial intelligence cognitive examination: A survey on the evolution of multimodal evaluation from recognition to reasoning","venue":null,"work_id":"b2bbc073-7a48-41cc-99d1-8e59ebced3a1","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:51bdfaa02d6d243b80e6c99db6cf1d15f2600d1aaeefdc36a836e43ca00605ca","observation_id":"198c7c07-5427-463f-b81e-b35069e942db","resolution":{"observed_at":"2026-05-18T10:01:14.291249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06481","last_updated":"2022-04-28T02:47:47Z","snapshot_observed_at":"2026-07-06T12:37:21.762051Z","submitted_at":"2022-02-14T04:44:44Z","title":"A Survey on Machine Learning Approaches for Modelling Intuitive Physics","version":3},"cited_work":{"arxiv_id":"2202.06481","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.06481","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on machine learning approaches for modelling intuitive physics","venue":null,"work_id":"b8638e16-e17c-4b0c-9fb4-0a23305d08eb","year":2022},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2202.06481","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:67c843e4236a991bdb193ad7ee3bebc0d68ef6630b3fc7ae6ba0d1d50fdc5044","observation_id":"b2feaa87-586a-4f26-b123-3a86f551bed0","resolution":{"observed_at":"2026-05-18T10:01:14.007481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10403","last_updated":"2023-05-26T17:59:33Z","snapshot_observed_at":"2026-07-06T14:33:03.656499Z","submitted_at":"2022-12-20T16:29:03Z","title":"Towards Reasoning in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":"2212.10403","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.10403","snapshot_observed_at":"2026-07-02T19:27:18.690866Z","title":"Towards Reasoning in Large Language Models: A Survey","venue":"cs.CL","work_id":"d920638f-5831-406f-9ceb-41c99337b692","year":2022},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2212.10403","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:bdc3e810dbf76f1dba6d610897bf579bf8620b7fc3da78caaef1127a2d0620ab","observation_id":"1f4abf85-31e7-4750-975d-afb41a9639cf","resolution":{"observed_at":"2026-05-18T13:22:30.236738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10087","last_updated":"2025-07-14T09:13:07Z","snapshot_observed_at":"2026-07-06T21:56:44.923310Z","submitted_at":"2025-07-14T09:13:07Z","title":"Foundation Model Driven Robotics: A Comprehensive Review","version":1},"cited_work":{"arxiv_id":"2507.10087","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.10087","snapshot_observed_at":"2026-06-30T13:24:40.290925Z","title":"Foundation model driven robotics: A comprehensive review","venue":null,"work_id":"cc848863-f4d6-47df-88f4-06fd256a71a4","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2507.10087","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:566ce3328f9a6626cee4c1689d9ffe8a810cafa921f55e12b6dd1dd90fdf1518","observation_id":"60850933-dfc1-4d6a-938c-47311466340a","resolution":{"observed_at":"2026-05-18T10:01:14.105503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large physics models: towards a collaborative approach with large language models and foundation models","venue":null,"work_id":"a8a4c5cf-3cd3-47e2-bf55-7a47456eac4c","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:630092872f6c6cd6bfa07b6a2d7358514e622516c89a5573fefbb6b5ae1ae555","observation_id":"d4c8694b-d649-453c-8936-a3d6348e1f44","resolution":{"observed_at":"2026-05-18T10:06:14.801272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding world or predicting future? a comprehensive survey of world models","venue":null,"work_id":"82bae79e-5b27-433f-a67a-c105ce5d0496","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:07bf87e1fb98f8e61d8677691122d8e3fcd0157823d27695721a7e016c416b09","observation_id":"e7e0e12a-5840-4520-9749-9adcb59fb9f9","resolution":{"observed_at":"2026-05-18T10:06:14.622287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10928","last_updated":"2025-04-19T14:52:08Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T03:19:47Z","title":"Generative Physical AI in Vision: A Survey","version":2},"cited_work":{"arxiv_id":"2501.10928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10928","snapshot_observed_at":"2026-07-04T13:19:51.110536Z","title":"Generative physical AI in vision: A survey","venue":null,"work_id":"34f60193-442f-42cd-9108-74cfa8af09e6","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2501.10928","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:00b2a9b1230eb86e8f468067eb82686da59fa2aedef8607c5c2f2e100b297375","observation_id":"4df93d73-3902-4173-94d3-453eb9d932cb","resolution":{"observed_at":"2026-05-18T10:01:13.955950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2405.03520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:08:43.481619Z","title":"Is sora a world simulator? A comprehensive survey on general world models and beyond","venue":null,"work_id":"f526770c-7d5c-4195-8ce8-7b910df8004b","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:821db711dddc9ec9307d79c2f330f86381b9b2665b4ededab386126e4bb4254d","observation_id":"c6548bbc-e5c9-4be7-85fb-043f2a382f6f","resolution":{"observed_at":"2026-05-18T10:01:14.046676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-02T02:18:00.133799Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"cited_work":{"arxiv_id":"2509.07996","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07996","snapshot_observed_at":"2026-07-21T03:22:29.733321Z","title":"3d and 4d world modeling: A survey","venue":null,"work_id":"0197d8fe-e11f-40f4-9254-87e63d981bf9","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2509.07996","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:a18f15790aaee66a7421d457c3fa1b4e28ef3ed07afc7c6f6c05688be1bebcb2","observation_id":"3adc67a7-e343-457b-a920-adc0bb9a72e5","resolution":{"observed_at":"2026-07-21T03:22:29.733321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ma- chine learning for data-driven discovery in solid earth geoscience","venue":null,"work_id":"d08c2e47-e95b-4bd9-b825-db82d2a4f05f","year":2019},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:3aa3bdae872301270d5c3b99d3e2e5b6f17ce23fa4995147cebc34b4d0068e17","observation_id":"3efdfbad-3c17-4484-8341-bc78a969f627","resolution":{"observed_at":"2026-05-18T10:06:14.644031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20134","last_updated":"2025-06-25T05:05:09Z","snapshot_observed_at":"2026-07-06T21:47:15.902527Z","submitted_at":"2025-06-25T05:05:09Z","title":"From 2D to 3D Cognition: A Brief Survey of General World Models","version":1},"cited_work":{"arxiv_id":"2506.20134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20134","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From 2d to 3d cognition: A brief survey of general world models","venue":null,"work_id":"4ec5b75a-d58c-4c9c-b997-b02cabd24107","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2506.20134","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:5737190a954161e5a0280be053341f258f3712c3ce6c35d0163c26ddb09efe0f","observation_id":"1155bdb1-b27e-452d-b8d3-b69a58739547","resolution":{"observed_at":"2026-05-18T10:01:14.270943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13833","last_updated":"2025-06-16T04:59:42Z","snapshot_observed_at":"2026-07-06T21:43:08.398464Z","submitted_at":"2025-06-16T04:59:42Z","title":"A Survey on World Models Grounded in Acoustic Physical Information","version":1},"cited_work":{"arxiv_id":"2506.13833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13833","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on world mod- els grounded in acoustic physical information","venue":null,"work_id":"1b9e9fc0-8172-4bab-bfc6-8d385faacc91","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2506.13833","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:6ec5799cedda77c7372c3c022a9f91756093a48fae0b48d183fbf0955d1c828f","observation_id":"55bef481-ded4-48c6-b3c7-ad28c5e8dd6f","resolution":{"observed_at":"2026-05-18T10:01:14.234612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00118","last_updated":"2024-06-27T15:36:43Z","snapshot_observed_at":"2026-07-06T18:38:42.333605Z","submitted_at":"2024-06-27T15:36:43Z","title":"From Efficient Multimodal Models to World Models: A Survey","version":1},"cited_work":{"arxiv_id":"2407.00118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.00118","snapshot_observed_at":"2026-06-30T15:34:48.314435Z","title":"From efficient multi- modal models to world models: A survey","venue":null,"work_id":"e0b16cc0-6ba1-498b-891c-fcb5ab9f5b8b","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2407.00118","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:adea2278ab9ab30b52fd453f9e3560bec0c1c4d7b4ed824bc10fa2db719e9614","observation_id":"caa0f455-795f-4e29-878e-dce737303bac","resolution":{"observed_at":"2026-05-18T10:01:14.281015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06886","last_updated":"2025-08-25T02:20:09Z","snapshot_observed_at":"2026-07-06T18:43:43.463452Z","submitted_at":"2024-07-09T14:14:47Z","title":"Aligning Cyber Space with Physical World: A Comprehensive Survey on Embodied AI","version":8},"cited_work":{"arxiv_id":"2407.06886","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06886","snapshot_observed_at":"2026-07-04T13:49:52.051359Z","title":"Aligning cyber space with physical world: A comprehensive survey on embodied ai","venue":null,"work_id":"6546762e-7a35-47a7-8489-4ef27dc923a6","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2407.06886","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:e212bf65c419f9c67c5e5c62354ba160ab1b27e7fe4b3bfebb9bf7155584ee80","observation_id":"e264edb2-24db-4cb0-837f-9f5ffe6bdbd6","resolution":{"observed_at":"2026-05-18T10:01:14.051660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shapellm: Universal 3d object understanding for embodied interaction","venue":null,"work_id":"8220ef33-867e-45a5-98dc-0043e1c2d68d","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:d942184a97df0a8b2a59cb54ba215a84cae44367b2b9884f5a67dedb18ff72a4","observation_id":"b0bf5690-f5f3-4805-af04-e63a675ad7cb","resolution":{"observed_at":"2026-05-18T10:02:32.847923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foundation models for au- tonomous driving perception: A survey through core capabilities","venue":null,"work_id":"b0c9524c-4fd0-4da5-8372-56bd9df7e74f","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:78c3b6673987501c659833df95cdb4ef34d1a5fafcc0026f473299e8094007c7","observation_id":"a06fe336-df85-4c8e-b1ba-755306c28891","resolution":{"observed_at":"2026-05-18T10:06:14.619437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.20021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T14:51:10.093493Z","title":"Embodied ai: From llms to world models","venue":null,"work_id":"cb3331c6-3d13-45e8-bd30-3e3dce4d0f3c","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:b1a6163f31bcae525c7a36985bef3d2ee00c557fa082838829caceac22ecb740","observation_id":"bed37388-69d9-4b64-b127-4d16aa12227b","resolution":{"observed_at":"2026-05-18T10:01:13.991354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00917","last_updated":"2025-09-03T01:44:58Z","snapshot_observed_at":"2026-07-06T21:50:35.488353Z","submitted_at":"2025-07-01T16:23:00Z","title":"A Survey: Learning Embodied Intelligence from Physical Simulators and World Models","version":3},"cited_work":{"arxiv_id":"2507.00917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.00917","snapshot_observed_at":"2026-07-08T13:14:53.255674Z","title":"A survey: Learning embodied intelligence from physical simulators and world models","venue":"cs.RO","work_id":"5811fe6a-47c9-417e-9cd7-dbd39f7ddd64","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2507.00917","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:65f3708b656ef2c3ce8f7339a2ec1889626a719169867b703c383c73ef654e6c","observation_id":"4ade6fc4-4ee5-4d0a-9052-c014f71b5246","resolution":{"observed_at":"2026-05-18T10:01:14.085437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on large lan- guage model based autonomous agents","venue":null,"work_id":"db861f84-793d-4436-bf5b-9db834081431","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:46fdf40263acd39209185678ae7de6d1c2585275fc2fa81624cb8bfbee9b97bf","observation_id":"53a7246a-da70-4b65-ae0c-623a5424b474","resolution":{"observed_at":"2026-05-18T10:06:14.719335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10399","last_updated":"2025-08-14T06:56:16Z","snapshot_observed_at":"2026-08-03T10:17:49.216289Z","submitted_at":"2025-08-14T06:56:16Z","title":"Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning","version":1},"cited_work":{"arxiv_id":"2508.10399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.10399","snapshot_observed_at":"2026-07-04T16:39:57.252941Z","title":"Large model empow- ered embodied ai: A survey on decision-making and embodied learning","venue":null,"work_id":"317b640c-f192-48b1-b805-097f5f47a917","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2508.10399","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:d4b6b1039b3a3f3b3150dbd4c9b948deacfaf68f8a586a0a99fe6f10e641ab33","observation_id":"ca393783-45e5-468a-abac-45c8711c57ac","resolution":{"observed_at":"2026-05-18T10:01:14.117071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of embodied learning for object-centric robotic manipulation","venue":null,"work_id":"d1824bf7-9127-43f8-8554-f74f14dbc991","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:6d19a221e238caa89ca76324e142ec1c8f4ba5b625e38a50e3d5666e201d118c","observation_id":"8a28e10e-52b4-4d17-b8d1-ed6b6fd210c6","resolution":{"observed_at":"2026-05-18T10:02:33.238326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14235","last_updated":"2025-05-20T11:42:26Z","snapshot_observed_at":"2026-07-06T21:26:59.423358Z","submitted_at":"2025-05-20T11:42:26Z","title":"Toward Embodied AGI: A Review of Embodied AI and the Road Ahead","version":1},"cited_work":{"arxiv_id":"2505.14235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14235","snapshot_observed_at":"2026-07-03T11:58:05.927093Z","title":"Toward embodied agi: A re- view of embodied ai and the road ahead","venue":null,"work_id":"9ee8a3e9-8cbf-465a-85c4-0e75566a4acf","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2505.14235","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:e0925c2ceabfbae155710ce8e33ca9a1007d00a6655773f861857ddff0442d1e","observation_id":"ba7a432a-419c-4c7f-b003-22f63d192754","resolution":{"observed_at":"2026-05-18T10:01:14.230938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of embodied ai: From simulators to research tasks","venue":null,"work_id":"83d959d2-84c6-4f59-9cef-43887a219272","year":2022},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:1057ba8ba7b9189e1cbd713d8f3edb12978a85f71772c7f880723b9df4f6a5ad","observation_id":"435b1f82-d953-4a88-9c4b-a30bc62aae72","resolution":{"observed_at":"2026-05-18T10:02:33.223506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02385","last_updated":"2024-02-04T07:55:01Z","snapshot_observed_at":"2026-08-04T15:45:08.679135Z","submitted_at":"2024-02-04T07:55:01Z","title":"A Survey on Robotics with Foundation Models: toward Embodied AI","version":1},"cited_work":{"arxiv_id":"2402.02385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02385","snapshot_observed_at":"2026-07-03T11:58:05.959787Z","title":"A survey on robotics with foundation models: toward embodied ai","venue":null,"work_id":"6ae9f09f-8664-4f8e-835f-07d5a9665e6c","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2402.02385","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:9f4bdcb03afb83765f1fdd7beb5fcffe9cec6d012463622a148e1abe1cca12e0","observation_id":"1d9cc51d-2aca-4c30-b563-d3fc26688908","resolution":{"observed_at":"2026-05-18T10:01:14.242862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on deep reinforcement learning algorithms for robotic manipulation","venue":null,"work_id":"5b855a6e-1fa1-4c4d-aa05-ae7160841592","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c5913c74a728cf811fbe00e4c73293677acf4b392864109ebceb0d6429c3fede","observation_id":"3b4ea012-b18a-4b2f-b69a-73530e6a0e95","resolution":{"observed_at":"2026-05-18T10:02:33.192858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GPT-4V(ision) system card","venue":null,"work_id":"6c39b0da-bd69-47f1-b749-92ab4fcfde6d","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:155bb603d72505d0908f56ebdd0a185780b2d0d566e63cfa095aa35131cac76b","observation_id":"d93eddd7-8b55-4359-92fc-3371de2ac1c6","resolution":{"observed_at":"2026-05-18T10:02:33.181312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mask R-CNN","venue":null,"work_id":"4d856c00-36fc-489c-bd37-4e67744159f4","year":2017},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:3de3afb2dce8ec7fa3f1c31981ca327381b6078b9f1746fd3a54dcd7497738e0","observation_id":"beaff97f-a568-4c80-8937-411fc06bc773","resolution":{"observed_at":"2026-05-18T10:02:33.165260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding DINO: Mar- rying DINO with Grounded Pre-Training for Open-Set Object Detection","venue":null,"work_id":"67844924-3f34-4cee-8e54-3251df252a8e","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:5dfd357d7db39aa6e149760dfbc2c52fefa2085ee7cfd61fc8306bde602e08d3","observation_id":"1028e44f-a3f1-4c33-ac37-770fffe1c178","resolution":{"observed_at":"2026-05-18T10:02:33.149388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2509.17765","doi":"10.48550/arxiv.2509.17765","metadata_source":"pith","pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-Omni Technical Report","venue":"cs.CL","work_id":"ae43e594-8bab-4471-b6af-92a300f6a048","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:fe0186386dfab33bb87cb31166809527c5afc471b4d374b0bb9cd7f3374231f6","observation_id":"74440f51-f432-44b4-8375-e4a46320e8de","resolution":{"observed_at":"2026-05-18T10:01:14.200411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inter-object discriminative graph modeling for indoor scene recognition","venue":null,"work_id":"092fab26-d9c5-4047-a963-f26051319275","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:d25cc6c47747881022a2b3dcb3e24a763c15fa7660d76276de50d24a41c79d22","observation_id":"6afdb684-39a9-45a9-bf04-4916b89b799b","resolution":{"observed_at":"2026-05-18T10:02:33.128880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18012","last_updated":"2025-05-19T18:23:14Z","snapshot_observed_at":"2026-07-06T18:37:04.753504Z","submitted_at":"2024-06-26T01:54:10Z","title":"View-Invariant Pixelwise Anomaly Detection in Multi-object Scenes with Adaptive View Synthesis","version":3},"cited_work":{"arxiv_id":"2406.18012","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.18012","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"View-Invariant Pixelwise Anomaly Detection in Multi-object Scenes with Adap- tive View Synthesis","venue":null,"work_id":"910462d7-d43f-48ef-9295-e0f4a3b8fddf","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2406.18012","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:60bf5c73d650e718073f88281c6e95eac6d723d1751266a192f584df1d8bcce2","observation_id":"f8206cc7-a626-4790-be57-863c8df83143","resolution":{"observed_at":"2026-05-18T10:01:14.238878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cognition Guided Video Anomaly Detection Framework for Surveillance Services","venue":null,"work_id":"593cab40-8743-4010-9055-764c1e65a5c8","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:42ba5d27f0c9c16ec2540f7fa2486c054b480fb261a034c693eb62bf063e453b","observation_id":"5fb681d9-b7c5-4bb9-b6c3-c7ec2ed1c65d","resolution":{"observed_at":"2026-05-18T10:02:33.112688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An expert ensemble for detecting anomalous scenes, interactions, and behaviors in autonomous driving","venue":null,"work_id":"76926377-6d10-4eea-abd8-3399549e5e96","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:ddb5b78826a3780c28552b969446c207d6f5dfc8dc292bc62a2d20b7e56204bf","observation_id":"22383a86-1f78-48bd-9480-efe070885e8e","resolution":{"observed_at":"2026-05-18T10:02:33.093144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":null,"work_id":"e25a355e-0d2f-443a-8ac1-ad1698a4f108","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:fb36f00f5dba0809a4cfd9fe451e2344b8478bb90a9696d83dc0c3e8b6778d42","observation_id":"faf3b95e-bdf6-454d-9e63-c326ecee568e","resolution":{"observed_at":"2026-05-18T10:02:33.076975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roboflow100- VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models","venue":null,"work_id":"85ea10c7-da9f-42e6-a0e5-655f50c78082","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:97190acfdd94458c134760a0b140e9e31640c3112d1fe24e7042adc88b4a8c3a","observation_id":"1c900b7b-b87e-4930-bb50-09f8d1167ded","resolution":{"observed_at":"2026-05-18T10:02:33.055275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23330","last_updated":"2025-03-30T06:13:13Z","snapshot_observed_at":"2026-08-03T14:12:32.314495Z","submitted_at":"2025-03-30T06:13:13Z","title":"EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing","version":1},"cited_work":{"arxiv_id":"2503.23330","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23330","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"EagleVision: Object- level Attribute Multimodal LLM for Remote Sensing","venue":null,"work_id":"fae56606-5921-4b01-ab7b-047892fe5cc7","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2503.23330","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:4d11ebb0f4fb41553280a36a84b7008c5bde9ffd7272f1dd93ba318a1ba85a1f","observation_id":"0d15a84d-069a-4f64-8e60-3678aedbe17b","resolution":{"observed_at":"2026-05-18T10:01:14.260861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ROD-MLLM: Towards More Reliable Object Detection in Multimodal Large Language Models","venue":null,"work_id":"2a50a971-2986-4973-828e-545452110925","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:370fbfb31197fe392f05eaff60885ae97cf7b3ebe9eb218c3b30e0a5ed1f9d65","observation_id":"4568d635-f05e-40f9-9305-ad2b451c5de1","resolution":{"observed_at":"2026-05-18T10:02:33.037545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17012","last_updated":"2026-04-13T12:33:41Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:03Z","title":"SpatialScore: Towards Comprehensive Evaluation for Spatial Intelligence","version":3},"cited_work":{"arxiv_id":"2505.17012","doi":"10.48550/arxiv.2505.17012","metadata_source":"pith","pith_arxiv_id":"2505.17012","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SpatialScore: Towards Comprehensive Evaluation for Spatial Intelligence","venue":"cs.CV","work_id":"7fe32ac0-2fff-4a5e-958f-28092c0ee055","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2505.17012","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:46c4ff82236ee5f7fd011bb017b0ddbe5fb8b41e47fa80e7b3cef91c96197893","observation_id":"684be2f3-7c2a-4b4c-adf1-9217102938aa","resolution":{"observed_at":"2026-05-18T10:01:14.153756Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open3DVQA: A Benchmark for Comprehensive Spatial Reasoning with Multimodal Large Language Model in Open Space","venue":null,"work_id":"fd72bdc9-43d9-4a66-a395-00af619b5f11","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:adafe231f1325c14d3976265288e8ce77774c8c5036213d646ac4a36f6d481bf","observation_id":"047b79f0-7217-4fbb-8f14-e195a10f33ce","resolution":{"observed_at":"2026-05-18T10:02:33.026643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23764","last_updated":"2026-05-23T03:42:56Z","snapshot_observed_at":"2026-07-06T21:33:07.415628Z","submitted_at":"2025-05-29T17:59:52Z","title":"MMSI-Bench: A Benchmark for Multi-Image Spatial Intelligence","version":3},"cited_work":{"arxiv_id":"2505.23764","doi":"10.48550/arxiv.2505.23764","metadata_source":"pith","pith_arxiv_id":"2505.23764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mmsi-bench: A benchmark for multi-image spatial intelligence","venue":"cs.CV","work_id":"3c86b01a-2b7e-4a70-94c5-92bf4d05ad52","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/2505.23764","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:bc95577900f80f2a1e069767191a045dc47191bc859ce81d6382dbcff692b30a","observation_id":"05023239-0e6d-47ab-acbf-661b28dadc69","resolution":{"observed_at":"2026-05-26T02:02:26.295966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatial-mllm: Boosting mllm capabilities in visual-based spatial intelligence","venue":null,"work_id":"3069d839-27f5-434b-bb1a-12bc5e9b2bb8","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:5f2e220bb8d4e805b26c167e6673dc5a875ba356726e67a5ae209461cc5febd3","observation_id":"604cf685-a24b-45f6-9aea-b812c0b97a82","resolution":{"observed_at":"2026-05-18T10:02:33.017722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-SpatialMLLM: Multi-Frame Spatial Understanding with Multi-Modal Large Language Models","venue":null,"work_id":"68e83e29-2025-4d18-97ab-2fd5a29649a1","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:3ed5d11cee55a95743a74c3001286834b94e10d71a2fe15d9b128f97020bbef1","observation_id":"bd75beba-7dd1-4556-8c34-63775b0c71f1","resolution":{"observed_at":"2026-05-18T10:02:32.719699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft COCO: Common Objects in Context","venue":null,"work_id":"f813d9aa-7e12-46c3-b64a-7e8068778b30","year":2014},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c3d098c5f96700526ee293c35de57a85074c7a94a186c54a6023eed0024f83a7","observation_id":"730f1860-4e02-417f-83dc-3a8733aea893","resolution":{"observed_at":"2026-05-18T10:02:32.741234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ImageNet: A Large- Scale Hierarchical Image Database","venue":null,"work_id":"d083c39f-9864-4926-b9f6-50d7c12b7fe1","year":2009},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:92c7e2f440873ccaf5f63575bda232a32ec695ae7f44b3aa0548842161fec435","observation_id":"419a956a-2023-4f06-a6bd-eec9bffeb4e2","resolution":{"observed_at":"2026-05-18T10:06:14.677236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contrastive Learning of Image Representations Guided by Spatial Relations","venue":null,"work_id":"1e52d5dc-1620-4c4d-9227-1474e8fb4063","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:4b4ea4c37733dd00b6e56a321a5cfdb40fb70120a572e12bbd9c1fdba9b76941","observation_id":"8f2a14ae-cdf6-41f5-8a97-10f36359e9f4","resolution":{"observed_at":"2026-05-18T10:02:32.708805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SpaGAN: A spatially- aware generative adversarial network for building gen- eralization in image maps","venue":null,"work_id":"17168b53-20f5-406d-99b5-ac63eec1db1a","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:f9d1dd003eb0833b19546dc5d24171a02250027c8fd0357e01980891798a3c16","observation_id":"7f40832b-336e-40d8-9e2a-658f1e87295d","resolution":{"observed_at":"2026-05-18T10:02:32.727329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Show and Tell: Visually Explainable Deep Neural Nets via Spatially-Aware Con- cept Bottleneck Models","venue":null,"work_id":"4e0793b1-a8fb-49a2-9056-ea205b96cb31","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:22aff5f9ca25710c15634a22d43f2faff6dadcc9262d016ac424d25b8d5e1701","observation_id":"51053cce-fa6d-451a-9d28-f36ad9c71955","resolution":{"observed_at":"2026-05-18T10:02:32.688946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatially-aware transformer for embodied agents","venue":null,"work_id":"5d212975-84b6-424e-bf59-4d46d2fced44","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:641ae91bd1109388344b0785f29cff171610a0d21a7b290826d2ce30646acb6c","observation_id":"06e1296a-8bc3-4bf2-9196-bb90bb297f71","resolution":{"observed_at":"2026-05-18T10:02:32.679865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review on multi-view learning","venue":null,"work_id":"8bdaff85-d2e2-4459-9cde-320e909726d5","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:fe0e0e5e987110145377d0aa7602cf99f19ae7d12f5f095364b0e5b649551089","observation_id":"9ea673a1-885e-42b6-bada-36f15019aee2","resolution":{"observed_at":"2026-05-18T10:06:14.647041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.21500","doi":"10.48550/arxiv.2505.21500","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Viewspatial-bench: Evaluating multi-perspective spatial localization in vision-language models.ArXiv, abs/2505.21500","venue":"ArXiv.org","work_id":"4e64344e-47c6-4d04-a5a4-c05266da7d8c","year":2025},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:be6e36716e58ba70dc1648e56236fe3cb09222c5ed96bbfb897565e5fbc82824","observation_id":"0605d727-421a-49eb-95b5-fc482b2cfa80","resolution":{"observed_at":"2026-05-18T10:01:14.122369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Comprehensive multi- view representation learning","venue":null,"work_id":"8b16e470-a03d-4d69-820e-cbaf98b64348","year":2023},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:d16ec45c746a50d4f2737d29071da616fbf34f879b79268fbfcc39372252b635","observation_id":"4f375059-9815-4f0d-bead-375bc6ac8e24","resolution":{"observed_at":"2026-05-18T10:06:14.781982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A multi-view graph contrastive learning framework for deciphering spa- tially resolved transcriptomics data","venue":null,"work_id":"f1398aba-c69a-4bdb-aef4-d25437b7f9df","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:ef00a9ac65760cb34bc9ed116370ad4f1957b333d13fee2e5c05f7bf97899362","observation_id":"d1d142fd-72d3-4449-84a4-f2ce713e267f","resolution":{"observed_at":"2026-05-18T10:02:32.672827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intrinsic Image Diffusion for Indoor Single-view Material Estimation","venue":null,"work_id":"d9c8e816-9e84-4d2a-918b-aa9f207c516e","year":2024},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:de18248b1f01b58ccea1274272b14f93569f01dd1f36cd14d89a86c593c33c10","observation_id":"ac130e68-474a-41b0-aa73-62261d9d6781","resolution":{"observed_at":"2026-05-18T10:02:32.694874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Materials In Paintings (MIP): An interdisciplinary dataset for per- ception, art history, and computer vision","venue":null,"work_id":"00e8444e-baef-40d4-a830-c0e14727474f","year":2021},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:c8dff43b42857c22adca0ab240cd419f096efee52c99a631f86a31fa7213efd0","observation_id":"af73fec2-19f3-4f63-a107-f74ab7818719","resolution":{"observed_at":"2026-05-18T10:02:32.662979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","latest_version":5,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-03T00:20:05.639737Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":36,"verified_fuzzy":63},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2510.04978."}