{"as_of":"2026-08-17T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa9be3c16d1cd6ef7b2000b95d7304e34b68cc9301f34e35ed3f6b5e722b9443","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:21:34.060079Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13026/citation-record","integrity":"/paper/2608.13026/integrity","json":"/paper/2608.13026/citation-record.json","paper":"/paper/2608.13026"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.453641Z","title":"2026 , eprint=","venue":null,"work_id":"f39938be-4dc3-41fc-8816-f081305412e6","year":2026},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.676420Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:4bcfee8d380602ba95fdddebc4120f79f5d65f869c12d3ea18a0623fa8cc59ef","observation_id":"869da127-0603-4a4c-ab34-7203f8d9e544","resolution":{"observed_at":"2026-08-15T18:21:35.458290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.435640Z","title":"2025 , eprint=","venue":null,"work_id":"5f91c990-c88b-4cb7-8c57-a51d4a55b619","year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.694079Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:5ce55ae9567ba5cad7fb44819056c2aa599cb9eea1f683c3d1b5a326433e9d31","observation_id":"a65ec208-8e12-4bb8-b13e-7542844a638f","resolution":{"observed_at":"2026-08-15T18:21:35.442159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.412382Z","title":"2025 , eprint=","venue":null,"work_id":"3aa884af-202b-4ac3-a33c-e9347ca7fc8a","year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.708722Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:1d656d5491ff18d236c0e110595cf6787fdf9db220450a1eebea86aa0ad2888e","observation_id":"edf3e6e3-82cb-4d7f-8356-2fbacf0a710c","resolution":{"observed_at":"2026-08-15T18:21:35.418731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.717518Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.717518Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:a8b3e49f85e5cda73c3bf502520586b9d83645f85a56eb47dfa252ab23218fa2","observation_id":"3a46a949-f91e-4bc1-b018-29db7b10cf98","resolution":{"observed_at":"2026-08-15T18:21:33.717518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.732528Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.732528Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:bc45605e71872e8d3e5c54ed4d1d1ed5f9a26c0ea9e2126e029a59e5ec50e34e","observation_id":"9d75a46c-61e7-41d8-af41-bbd2cc248713","resolution":{"observed_at":"2026-08-15T18:21:33.732528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.748196Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.748196Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:45c2e30fa42ff50ad9e8dfe1bd128d970796f290d9dc30c6618863915e3c642f","observation_id":"8c46405b-e01b-4803-a7fb-eff70999bb0b","resolution":{"observed_at":"2026-08-15T18:21:33.748196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.310807Z","title":"2024 , eprint=","venue":null,"work_id":"5ba3f488-14b7-4dbe-a24b-ac2b96ed21e5","year":2024},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.758361Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:169584db4dbc8cad59ad6e3dc203bae49f88ec67a202aeb7689371cb05b7cc5b","observation_id":"8b708809-6225-4c7f-8ff2-b9e994a6bd60","resolution":{"observed_at":"2026-08-15T18:21:35.318982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.770823Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.770823Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:c2a0f9048b93111babf2cb62dd02a9c6c253b2984d351b9916e6c170178fdd95","observation_id":"682b361c-f657-4973-8262-36bfb41fcbbf","resolution":{"observed_at":"2026-08-15T18:21:33.770823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.783172Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.783172Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:ab7155dacbcd468c443dde08b930c73de5465bc2bded61b8533c21529168da39","observation_id":"a5f7eb8f-9713-4f83-b856-48b733bc1ed5","resolution":{"observed_at":"2026-08-15T18:21:33.783172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.796752Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.796752Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:a72529b90cb7f94594f981b736a4a0f3d7ec4bbe3a9aaf01bd8a0ed735588acd","observation_id":"1d69bc32-d0ce-410f-bea8-2561a50cf2eb","resolution":{"observed_at":"2026-08-15T18:21:33.796752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.802821Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.802821Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:3fb75257bc238f344b83d389f944db17a29412216943abe439145d8d2b96c4b9","observation_id":"f7669d75-4a38-44d6-b00f-fa8d48395e8c","resolution":{"observed_at":"2026-08-15T18:21:33.802821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.812967Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.812967Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:e0055e5e1e60505ccee495f4144e232cdc7787052479755b8e2ff8b359753197","observation_id":"afb8e98f-fbc7-4cd6-bd49-cc06cdef7786","resolution":{"observed_at":"2026-08-15T18:21:33.812967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.139002Z","title":"2026 , eprint=","venue":null,"work_id":"fc132b75-6094-465d-904a-b5f72893169f","year":2026},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.826957Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:af36c0c5034ee9c799115e9ed054fe6f2ec17055a5e6eee9dd965c813dbf0d73","observation_id":"ad7425d2-83b8-4f67-86a0-1c4309d05b77","resolution":{"observed_at":"2026-08-15T18:21:35.147811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-15T18:21:33.843856Z","title":"arXiv preprint arXiv:2406.09246 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.843856Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:7d7a42fe443658c7d3f458ede117a3d78b7306828466c0cc8a24d10fa9c4ef54","observation_id":"434ab39b-75c8-4f47-98cf-9971e41f8b79","resolution":{"observed_at":"2026-08-15T18:21:33.843856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-16T20:05:19.058376Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-08-15T18:21:33.850650Z","title":"arXiv preprint arXiv:2505.07395 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.850650Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:5b58ac35360b8df9d33f02af0451ed6ac167d5efc9e686771f4952f1fa251239","observation_id":"899c45df-f990-45da-8988-4ce91fb96a9d","resolution":{"observed_at":"2026-08-15T18:21:33.850650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-15T18:21:33.858488Z","title":"arXiv preprint arXiv:2509.09674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.858488Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:fe821811823adf83cfd575c3a1d7bbc3904d383f7e27a69e35f6f6549071dafd","observation_id":"ddecd92c-4332-4e6e-96a4-82b697484ac0","resolution":{"observed_at":"2026-08-15T18:21:33.858488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.867217Z","title":"arXiv preprint arXiv:2511.09515 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.867217Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:61b3460fbf41b3abbbbb43cba4499663f50212fa1584b105d60eac0d0f82a967","observation_id":"7ab6a76f-501a-484c-9f1f-5cd8834cc9ca","resolution":{"observed_at":"2026-08-15T18:21:33.867217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.877681Z","title":"arXiv preprint arXiv:2510.00406 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.877681Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:a1b22cc60363aa012a3f85f1139a6aab45b3def08fd63570a3e265daa7559bfb","observation_id":"ab3ebb63-bbb8-4840-8d38-a33ff3daeb17","resolution":{"observed_at":"2026-08-15T18:21:33.877681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.889487Z","title":"arXiv preprint arXiv:2511.00091 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.889487Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:d790419fb32bf2c6de4e917b83118b031ae000f2446c396fb7cbdbcadc8c506e","observation_id":"ff355e59-c5f4-4dee-a610-8c75c9d1ce71","resolution":{"observed_at":"2026-08-15T18:21:33.889487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.00037","last_updated":"2026-07-27T06:20:18Z","snapshot_observed_at":"2026-08-09T19:56:29.076727Z","submitted_at":"2025-09-26T14:42:23Z","title":"RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.00037","snapshot_observed_at":"2026-08-15T18:21:33.899884Z","title":"arXiv preprint arXiv:2510.00037 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.899884Z"},"links":{"cited_paper":"/paper/2510.00037","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:a9901b5367fc4fbbde04f9189f42d8d6478e15d948e241631f7b14dd8fd8b7cf","observation_id":"463ffd35-cc7a-4d8a-9694-0c890eb33c4d","resolution":{"observed_at":"2026-08-15T18:21:33.899884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-08-15T14:40:29.317550Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-08-15T18:21:33.909439Z","title":"arXiv preprint arXiv:2505.17016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.909439Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:608f60b18910d1aabfddbfa641e8fe897ff1ea2cf5bfa2b0d211ce0981796991","observation_id":"f9f1cae7-c5cd-4a06-ab10-9b978c160cc7","resolution":{"observed_at":"2026-08-15T18:21:33.909439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.927727Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.927727Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:3176fce7288d835e8951629907a22249e584baeae451b3b83f8a4ed72491cd63","observation_id":"7c113e5e-74d7-4871-9a54-1e942ab25433","resolution":{"observed_at":"2026-08-15T18:21:33.927727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.069485Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"75f59436-1353-42d7-8ece-6d920b3eca95","year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.947351Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:54aeec75a3cb4207446f28cb660aa0f53588446a6027e470faf4ec3d39feb194","observation_id":"a3b986ed-abf6-4da0-bb13-9bb623b6c8ef","resolution":{"observed_at":"2026-08-15T18:21:35.079596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14108","last_updated":"2022-06-28T18:39:18Z","snapshot_observed_at":"2026-08-16T18:04:33.227548Z","submitted_at":"2020-09-29T15:48:02Z","title":"Align-RUDDER: Learning From Few Demonstrations by Reward Redistribution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14108","snapshot_observed_at":"2026-08-15T18:21:33.953684Z","title":"arXiv preprint arXiv:2009.14108 , year=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.953684Z"},"links":{"cited_paper":"/paper/2009.14108","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:2218d89ccb0fcf83e2bade1b5155457276ba64622bf858cb9707e12fd3fbd72d","observation_id":"d60282f9-1343-48c8-9ff0-4e97a6bd045a","resolution":{"observed_at":"2026-08-15T18:21:33.953684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.040695Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"746d9f91-e88b-49cb-aa2f-bbd920fb01a9","year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.964464Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:af0c6e4f3b15cd1e3f358e7adaded57130206582500de738e011cfe33aa8ff30","observation_id":"cad20952-1a16-4d52-b11c-c675fbc8d1ff","resolution":{"observed_at":"2026-08-15T18:21:35.053161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01876","last_updated":"2025-06-17T17:54:41Z","snapshot_observed_at":"2026-08-16T17:36:30.508913Z","submitted_at":"2025-02-03T23:08:42Z","title":"Reinforcement Learning with Segment Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01876","snapshot_observed_at":"2026-08-15T18:21:33.975739Z","title":"arXiv preprint arXiv:2502.01876 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.975739Z"},"links":{"cited_paper":"/paper/2502.01876","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:01f9a6f3c5337c63822c1f468be70abb98c0e652693991ba20354ddf260aa1ec","observation_id":"e5a35949-7b26-4bf3-b165-64b8ebb71333","resolution":{"observed_at":"2026-08-15T18:21:33.975739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.989588Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.989588Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:98a57c41307ae7ba53d1bd34b9693640a0aea5be765ba361cf9de66befff4e13","observation_id":"79542b24-c7f5-4ec2-b3f4-de899a5c6fe8","resolution":{"observed_at":"2026-08-15T18:21:33.989588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25358","last_updated":"2026-04-27T02:56:51Z","snapshot_observed_at":"2026-08-14T22:38:01.270858Z","submitted_at":"2025-09-29T18:07:54Z","title":"SARM: Stage-Aware Reward Modeling for Long Horizon Robot Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25358","snapshot_observed_at":"2026-08-15T18:21:34.003593Z","title":"arXiv preprint arXiv:2509.25358 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.003593Z"},"links":{"cited_paper":"/paper/2509.25358","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:37092a6cfb2753e3f9e8af9945c61ecc6d8e12b039054b2c4ebbb30b0a887197","observation_id":"0395fe38-777a-41f1-8c98-d990af966289","resolution":{"observed_at":"2026-08-15T18:21:34.003593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.966254Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"0dc0a15d-d341-49d3-9434-8527b1a709fe","year":2018},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.015049Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:f960017ea9c38c88ab319e492f4d3610679ee9a548fa93a674f8f4bdbddfbf05","observation_id":"189c229c-13e8-4f0b-a5f7-f05ecb87fa2e","resolution":{"observed_at":"2026-08-15T18:21:34.971063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.923108Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"cf365eaa-0d8a-4684-8244-24831cb5b0bf","year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.023324Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:8f582dc1885c42b442358448462566492ade500a845c9cf036bb6e815aa7bbb9","observation_id":"6b6b3e3d-3f48-404e-9d3f-d6cb41d27881","resolution":{"observed_at":"2026-08-15T18:21:34.930931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.884025Z","title":"Conference on Robot learning , pages=","venue":null,"work_id":"2936439b-897e-4536-bbba-8c733af76cfe","year":2020},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.029391Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:9687111acd54079789a222240f0ff1f8254b2499c35a64fa2b1e3c0316490137","observation_id":"05e21ac1-ce4c-4a78-a8e7-e3e48570d794","resolution":{"observed_at":"2026-08-15T18:21:34.891557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.842643Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":"820fb84f-3d10-4a24-b32d-b44c27ffcd0b","year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.040918Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:363a6c738bd7b634b943b08438ff2f8fc4e2bab5ade62952f21c6aa250da44a0","observation_id":"86dd38a3-2008-47c8-ac77-b67ebdc99271","resolution":{"observed_at":"2026-08-15T18:21:34.855099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.806903Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":"52402711-cbf6-4e02-bd3e-ca6d95af2118","year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.048526Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:07836e22dd73bb59e751c257154a34a19b861aacdd78dcf245e9fc355b8a7e0e","observation_id":"1b351643-2240-4a64-a884-054ec0cd7cd7","resolution":{"observed_at":"2026-08-15T18:21:34.816203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.772482Z","title":"8th Annual Conference on Robot Learning , year=","venue":null,"work_id":"d76a580f-9585-416a-88c0-a66cc66d546e","year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.060079Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:0a234d725593ac66ad2d18b2dd3310b73cdb4ef2b49dd2bf5811364d03821d6f","observation_id":"b4367387-7bd3-45b6-988d-1b16a760ed11","resolution":{"observed_at":"2026-08-15T18:21:34.780841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T23:11:29.101862Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.13026."}