{"as_of":"2026-08-07T19:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be77c8e6d1a0bbf47c07346dce50be450eaa8e6de3863a92b6bfa4c1b5601776","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:25:25.203281Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T06:44:02.323020Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":"2307.16368","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Antgpt: Can large language models help long-term action anticipation from videos?","venue":null,"work_id":"2a3c977f-6c34-4a88-b771-d1538801462b","year":2023},"citing_paper":{"arxiv_id":"2309.17257","last_updated":"2026-04-12T21:40:57Z","snapshot_observed_at":"2026-07-06T16:25:29.858870Z","submitted_at":"2023-09-29T14:07:56Z","title":"A Survey on Deep Learning Techniques for Action Anticipation","version":2},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-05-24T06:41:15.508744Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2309.17257"},"observation_digest":"sha256:8ce3c2ff8a589674f52460d8af96547290c9a48f33aa5fa39235e019f148f2ce","observation_id":"f0d5cc08-ec18-477d-bbef-2494555b90aa","resolution":{"observed_at":"2026-05-24T06:44:02.327383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":"2307.16368","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Antgpt: Can large language models help long-term action anticipation from videos?","venue":null,"work_id":"2a3c977f-6c34-4a88-b771-d1538801462b","year":2023},"citing_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-05-15T17:18:52.996467Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2503.12605"},"observation_digest":"sha256:1a5d6d7c2df2e86838897763902036730f271280d56e644147a5b60b063d1a39","observation_id":"6fdadc9b-f3b4-4b23-8600-317703d6c819","resolution":{"observed_at":"2026-05-15T17:18:53.123569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-08-07T11:25:25.203281Z","title":"Antgpt: Can large language models help long- term action anticipation from videos?arXiv preprint arXiv:2307.16368, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02550","last_updated":"2025-06-11T11:16:41Z","snapshot_observed_at":"2026-08-07T11:19:30.337511Z","submitted_at":"2025-06-03T07:36:52Z","title":"Technical Report for Ego4D Long-Term Action Anticipation Challenge 2025","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:25:25.203281Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2506.02550"},"observation_digest":"sha256:32600c4b1e4b376d414f36a69ce51316c5d60479f508714ab88f1f50711e0f84","observation_id":"66d0d2c6-928c-4748-b48b-ea4d7f0ec090","resolution":{"observed_at":"2026-08-07T11:25:25.203281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-08-06T15:44:49.029086Z","title":"Antgpt: Can large language models help long- term action anticipation from videos? arXiv preprint arXiv:2307.16368, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15130","last_updated":"2025-07-20T21:39:05Z","snapshot_observed_at":"2026-08-07T14:58:31.551182Z","submitted_at":"2025-07-20T21:39:05Z","title":"Enhancing Visual Planning with Auxiliary Tasks and Multi-token Prediction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:44:49.029086Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2507.15130"},"observation_digest":"sha256:636e7019b6034a8ab112d7fe2fb8b632edce5380c71d00ac12f22d44ce3be5ba","observation_id":"70571645-9ad2-4347-bea0-571aa42e7e8b","resolution":{"observed_at":"2026-08-06T15:44:49.029086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":"2307.16368","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Antgpt: Can large language models help long-term action anticipation from videos?","venue":null,"work_id":"2a3c977f-6c34-4a88-b771-d1538801462b","year":2023},"citing_paper":{"arxiv_id":"2508.09547","last_updated":"2026-04-29T01:36:59Z","snapshot_observed_at":"2026-07-06T22:12:12.166886Z","submitted_at":"2025-08-13T07:05:17Z","title":"GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T23:02:14.913189Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2508.09547"},"observation_digest":"sha256:c0ec215b1bf5e8a79ad4df07a78deab40a13609375e5c41c3acc3a552d7a804c","observation_id":"3393aec5-dd79-45f2-be85-34fc78200252","resolution":{"observed_at":"2026-05-18T23:02:52.623233Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-08-05T20:28:56.974763Z","title":"Zhao et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-07T18:23:08.889281Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":153,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:56.974763Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:bb4eaa1799806e623b24f1dde546e7073568504aed4599ad906dee0b3fe1ed6c","observation_id":"cf9cafc5-b8b6-4910-b895-3f3e9fb4fc6d","resolution":{"observed_at":"2026-08-05T20:28:56.974763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":"2307.16368","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Antgpt: Can large language models help long-term action anticipation from videos?","venue":null,"work_id":"2a3c977f-6c34-4a88-b771-d1538801462b","year":2023},"citing_paper":{"arxiv_id":"2604.10397","last_updated":"2026-04-12T01:07:43Z","snapshot_observed_at":"2026-07-06T22:59:01.129724Z","submitted_at":"2026-04-12T01:07:43Z","title":"Rethinking Video Human-Object Interaction: Set Prediction over Time for Unified Detection and Anticipation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T16:28:03.321675Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2604.10397"},"observation_digest":"sha256:ed2d9bbbd423a17c1410b3debee5eb0f204b604c1b10a33f8ce0d52e3c67bcfd","observation_id":"fcadcb62-3bcf-4ffa-ba82-33ec3fd0861e","resolution":{"observed_at":"2026-05-11T08:50:58.493713Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16368","snapshot_observed_at":"2026-07-31T23:52:11.799661Z","title":"arXiv preprint arXiv:2307.16368 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23333","last_updated":"2026-07-25T19:11:15Z","snapshot_observed_at":"2026-08-03T00:37:21.399146Z","submitted_at":"2026-07-25T19:11:15Z","title":"Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex","version":1},"reference_index":245,"source":"arxiv_source","source_observed_at":"2026-07-31T23:52:11.799661Z"},"links":{"cited_paper":"/paper/2307.16368","citing_paper":"/paper/2607.23333"},"observation_digest":"sha256:65942acdb81b6ea766a2f28df34bcc9aec28e1c4fdca95a4f91bfef89e5b5df2","observation_id":"85e51dad-40a6-489e-9561-88c4bb65e5d0","resolution":{"observed_at":"2026-07-31T23:52:11.799661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2307.16368/citation-record","integrity":"/paper/2307.16368/integrity","json":"/paper/2307.16368/citation-record.json","paper":"/paper/2307.16368"},"outbound":[],"paper":{"arxiv_id":"2307.16368","last_updated":"2024-04-01T01:33:53Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T16:00:25.707740Z","submitted_at":"2023-07-31T02:14:19Z","title":"AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2307.16368."}