{"as_of":"2026-08-08T13:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bceedf6d14f2df4839f1cdf616043c62009add3149869613434db662e6f26fa9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:54:39.297648Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":19,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":"2306.08640","doi":"10.48550/arxiv.2306.08640","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2306.08640 , urldate =","venue":"arXiv (Cornell University)","work_id":"1d3a2a03-699a-4b6b-9328-995bed95e1ae","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":215,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:2997407bfae1f3111aeba97340b882824c20266c207f595ff5dc9db5f5ae7bde","observation_id":"a9024f22-02c9-48a3-b888-5300bd4bc195","resolution":{"observed_at":"2026-05-19T20:32:45.585587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":"2306.08640","doi":"10.48550/arxiv.2306.08640","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2306.08640 , urldate =","venue":"arXiv (Cornell University)","work_id":"1d3a2a03-699a-4b6b-9328-995bed95e1ae","year":2023},"citing_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-12T15:46:03.247029Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2311.12983"},"observation_digest":"sha256:9a15401e251f6768e0b4801454d16482af366e12e681c34948f32eba297bdb6a","observation_id":"a6e45509-0941-454d-ac5c-631f8a955b11","resolution":{"observed_at":"2026-05-12T15:46:03.553745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-08T04:54:39.297648Z","title":"Assistgpt: A general multi-modal assistant that can plan, execute, inspect, and learn.arXiv preprint arXiv:2306.08640,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08524","last_updated":"2025-02-12T16:00:11Z","snapshot_observed_at":"2026-08-08T04:44:23.355074Z","submitted_at":"2025-02-12T16:00:11Z","title":"LLM Pretraining with Continuous Concepts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:39.297648Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2502.08524"},"observation_digest":"sha256:1f46a218713df200341f17af4d4debea923508f131f16fa30b8a53aafac3e201","observation_id":"ca7a76e4-8a62-44d9-87d0-cce56ebf2776","resolution":{"observed_at":"2026-08-08T04:54:39.297648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-07T13:21:28.195332Z","title":"Assistgpt: A general multi-modal assis- tant that can plan, execute, inspect, and learn,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22006","last_updated":"2025-05-28T06:12:51Z","snapshot_observed_at":"2026-08-07T18:32:47.377801Z","submitted_at":"2025-05-28T06:12:51Z","title":"Efficiently Enhancing General Agents With Hierarchical-categorical Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:28.195332Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2505.22006"},"observation_digest":"sha256:87b66123ea8494fc602f879364c645af44cd6b478eef8b23ed503b9f76a5a840","observation_id":"c2cf7928-cc31-438f-aaec-99f8b02fdae1","resolution":{"observed_at":"2026-08-07T13:21:28.195332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-07T00:48:15.228785Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-07T11:53:13.790399Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:15.228785Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:7ce040e7c1d29841a0a243614d368745135ee085411ee8c7f8e0d7cb4af701a4","observation_id":"23008a92-f8cb-432f-9d07-6c2380e67901","resolution":{"observed_at":"2026-08-07T00:48:15.228785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-06T12:18:33.353518Z","title":"Assistgpt: A gen- eral multi-modal assistant that can plan, execute, inspect, and learn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21924","last_updated":"2025-07-29T15:39:14Z","snapshot_observed_at":"2026-08-07T11:15:49.597365Z","submitted_at":"2025-07-29T15:39:14Z","title":"MMAT-1M: A Large Reasoning Dataset for Multimodal Agent Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:18:33.353518Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2507.21924"},"observation_digest":"sha256:c53cb6da9393002050ee77d215eab2baaff65bc012c32bafce8daceb184e92ff","observation_id":"b764f13b-cc2a-4907-983f-74e1c22f8fe0","resolution":{"observed_at":"2026-08-06T12:18:33.353518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-05T20:29:08.748686Z","title":"Gao et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-07T18:23:08.889281Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":257,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:08.748686Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:54ae8d15ee8bf29c62116091777ada6b748608f1cf3792f3a2c6edfd1731c915","observation_id":"557233e6-9416-4d5a-9aef-2d416a4e74d1","resolution":{"observed_at":"2026-08-05T20:29:08.748686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":"2306.08640","doi":"10.48550/arxiv.2306.08640","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2306.08640 , urldate =","venue":"arXiv (Cornell University)","work_id":"1d3a2a03-699a-4b6b-9328-995bed95e1ae","year":2023},"citing_paper":{"arxiv_id":"2605.31513","last_updated":"2026-07-26T14:50:39Z","snapshot_observed_at":"2026-08-02T12:47:34.909925Z","submitted_at":"2026-05-29T16:31:25Z","title":"Personalize Your Large Vision-language Models With In-context Prompt Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T22:59:55.055737Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2605.31513"},"observation_digest":"sha256:667e9eca8b16e339ebb1a0eb5aa6dd55de006de03c69708801a2405d200ed693","observation_id":"9060281b-6a1c-497d-b266-cc875f44cdbc","resolution":{"observed_at":"2026-06-28T23:02:46.289378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-02T12:47:37.161446Z","title":"arXiv preprint arXiv:2306.08640 (2023) 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.31513","last_updated":"2026-07-26T14:50:39Z","snapshot_observed_at":"2026-08-02T12:47:34.909925Z","submitted_at":"2026-05-29T16:31:25Z","title":"Personalize Your Large Vision-language Models With In-context Prompt Tuning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T12:47:37.161446Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2605.31513"},"observation_digest":"sha256:1b462f266cab939ef642c42e3d214fa5b87eceaf8ce5f7083126abfca7fc72d6","observation_id":"34492b33-da7b-44a1-a518-10a89893e27e","resolution":{"observed_at":"2026-08-02T12:47:37.161446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-07-14T12:26:27.446079Z","title":"Assistgpt: A general multi-modal assistant that can plan, execute, inspect, and learn, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10350","last_updated":"2026-07-17T17:27:03Z","snapshot_observed_at":"2026-08-02T07:21:21.791047Z","submitted_at":"2026-07-11T15:24:43Z","title":"ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T12:26:27.446079Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2607.10350"},"observation_digest":"sha256:a1f975db5803c4a248400a923b03532a3104bdcb15a5d0d9435e0378a69a6fe3","observation_id":"7276714c-5ba5-46ec-a6af-df1308717086","resolution":{"observed_at":"2026-07-14T12:26:27.446079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-02T07:21:26.048698Z","title":"Assistgpt: A general multi-modal assistant that can plan, execute, inspect, and learn, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10350","last_updated":"2026-07-17T17:27:03Z","snapshot_observed_at":"2026-08-02T07:21:21.791047Z","submitted_at":"2026-07-11T15:24:43Z","title":"ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T07:21:26.048698Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2607.10350"},"observation_digest":"sha256:29e17ad2bc8f519acaa719f1c479fabfca9af9d8672c4fcf0f8e0ec762ec30c9","observation_id":"af798b63-03f9-4cef-a0c4-137ebb2aa477","resolution":{"observed_at":"2026-08-02T07:21:26.048698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08640","snapshot_observed_at":"2026-08-01T22:43:53.721865Z","title":"Assistgpt: A general multi-modal assistant that can plan, execute, inspect, and learn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15657","last_updated":"2026-07-17T06:05:17Z","snapshot_observed_at":"2026-08-08T02:14:12.766320Z","submitted_at":"2026-07-17T06:05:17Z","title":"Do Agents Dream of False Memories? Black-box Visual Attacks on Long-term Memory in Multimodal AI Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T22:43:53.721865Z"},"links":{"cited_paper":"/paper/2306.08640","citing_paper":"/paper/2607.15657"},"observation_digest":"sha256:9b46f9c7b4f805bb6350b379e9fb90047d5a2099785d9230e6b8746d7f4f6e9a","observation_id":"ee8420b1-643f-44e0-bd54-4f48be49a65d","resolution":{"observed_at":"2026-08-01T22:43:53.721865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.08640/citation-record","integrity":"/paper/2306.08640/integrity","json":"/paper/2306.08640/citation-record.json","paper":"/paper/2306.08640"},"outbound":[],"paper":{"arxiv_id":"2306.08640","last_updated":"2023-06-28T05:00:35Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:42:37.055739Z","submitted_at":"2023-06-14T17:12:56Z","title":"AssistGPT: A General Multi-modal Assistant that can Plan, Execute, Inspect, and Learn"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2306.08640."}