{"as_of":"2026-08-19T21:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:961a3d0754c15b56038a643f2341b50234062922f7d7a502a630a791bbfc1ae0","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:32:43.014855Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T10:27:47.896922Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:17:48.457499Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2411.19133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19133","snapshot_observed_at":"2026-07-03T09:17:48.457499Z","title":"arXiv preprint arXiv:2411.19133 , year=","venue":null,"work_id":"9b7ae132-c1ff-4949-a2b5-129b10fe2923","year":null},"citing_paper":{"arxiv_id":"2606.12200","last_updated":"2026-06-10T15:19:41Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T15:19:41Z","title":"Implicit Neural Representations of Individual Behavior","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-06-27T10:27:47.896922Z"},"links":{"cited_paper":"/paper/2411.19133","citing_paper":"/paper/2606.12200"},"observation_digest":"sha256:6aa50b10716def38cffbaf3cd445a38cf15b574ba0d1416a1e6980b539f0fdc8","observation_id":"bd2cd6d0-f26f-4f9f-9ac7-4b34a288f68c","resolution":{"observed_at":"2026-07-03T09:17:48.458924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.19133/citation-record","integrity":"/paper/2411.19133/integrity","json":"/paper/2411.19133/citation-record.json","paper":"/paper/2411.19133"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.122049Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":"56f22c74-7aa5-48c7-909c-307c1f64779c","year":2017},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.979030Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:81df493b285fef6669e4bea0f960a5facd2e888c0449513d33a61436657acfc3","observation_id":"8ae020c8-0da9-4b92-95d3-75981e0ca466","resolution":{"observed_at":"2026-08-12T10:32:43.125447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00614","last_updated":"2020-08-03T02:24:20Z","snapshot_observed_at":"2026-08-14T10:46:21.688261Z","submitted_at":"2020-08-03T02:24:20Z","title":"Dynamics Generalization via Information Bottleneck in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00614","snapshot_observed_at":"2026-08-12T10:32:42.982760Z","title":"Dynamics generalization via information bottleneck in deep reinforcement learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.982760Z"},"links":{"cited_paper":"/paper/2008.00614","citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:c552436340b600c1c299fd9bbc98cf6898e2a8fea8e84b326d105c83672a6f3b","observation_id":"9c38f693-fa4e-4413-8156-efedb6702e1e","resolution":{"observed_at":"2026-08-12T10:32:42.982760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.113931Z","title":"Efficient off-policy meta-reinforcement learning via probabilistic context variables","venue":null,"work_id":"4cf99c73-9b33-4e81-9eb4-22515e55a7ee","year":2019},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.986495Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:f841a9df905e6a47d04ef4f1e93041dc287ca5f776f7a82337652d91d4c8e6f2","observation_id":"1cfc7c31-c056-474e-9669-9bfdf5b40c57","resolution":{"observed_at":"2026-08-12T10:32:43.117090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.104582Z","title":"Varibad: A very good method for Bayes-adaptive deep RL via meta-learning","venue":null,"work_id":"ef2bd37f-a7b0-4213-9bee-2cd5ecb397e9","year":2020},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.989911Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:48ef39bcf5714059c700dd5c476b6dd547a14ae12dda8f964febba2afd577e7f","observation_id":"d40bdaa7-5b52-4981-8085-4003c875eea6","resolution":{"observed_at":"2026-08-12T10:32:43.107766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.094974Z","title":"Fleet control using coregionalized gaussian process policy iteration","venue":null,"work_id":"5c00ab38-1c74-4aa4-9d56-d4f583f40bab","year":2020},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.993656Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:985300dce47ffe434c99789cb76a4090ea10c757c7e701048b7d008308924a43","observation_id":"d6203dc7-5c87-4ad9-a9c1-856db9515ebc","resolution":{"observed_at":"2026-08-12T10:32:43.098381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.085970Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"352a8966-8c32-4f77-bf3e-cc675f745f41","year":2018},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.998594Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:089103a70b86aea9d784ef32979b04dc065452844cdcd5ee09b249475549054b","observation_id":"fb883e69-68db-4271-bcaf-336c89079b3b","resolution":{"observed_at":"2026-08-12T10:32:43.089608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.077689Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":"f923390d-dd67-4d85-aadb-252955d90f67","year":2019},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.001946Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:c4c57b765d297a182d6f5a621181f848b07f2ac436db6b9b438b0a2eefad7ba9","observation_id":"0f0ceb85-24e5-4086-9652-68ef87acb824","resolution":{"observed_at":"2026-08-12T10:32:43.080690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01708","last_updated":"2019-10-03T20:15:55Z","snapshot_observed_at":"2026-08-14T05:35:42.838302Z","submitted_at":"2019-10-03T20:15:55Z","title":"Benchmarking Batch Deep Reinforcement Learning Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01708","snapshot_observed_at":"2026-08-12T10:32:43.004752Z","title":"Bench- marking batch deep reinforcement learning algorithms","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.004752Z"},"links":{"cited_paper":"/paper/1910.01708","citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:d1b934307de7ce329847032b092db42d846ead43f967954ca9c9a93c2d0f483b","observation_id":"402a4b1c-c5b2-4101-9cfa-b4172a00738e","resolution":{"observed_at":"2026-08-12T10:32:43.004752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.067968Z","title":"User-interactive offline reinforce- ment learning","venue":null,"work_id":"c773db0c-b063-40a2-9b7b-a233b7a4d492","year":2023},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.008091Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:e6febc0baa6d7a73c2374f9549aeb01ad6d94859f518839277926b799d2135b4","observation_id":"5f80ecd9-9e3e-4e22-ae19-d027fba3ea47","resolution":{"observed_at":"2026-08-12T10:32:43.071323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.059278Z","title":"Neuronlike adaptive ele- ments that can solve difficult learning control problems","venue":null,"work_id":"48fe8815-b16d-4131-8e91-1e55af7746eb","year":1983},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.011448Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:629d2100be7bc888da63642168eaa92ccc352db849f707985c6e873d875ba469","observation_id":"a36dd1b1-3c0d-4c3c-8201-180206775318","resolution":{"observed_at":"2026-08-12T10:32:43.062863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.047772Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":"b1771d7d-66b4-4669-862f-91b33d35a536","year":2015},"citing_paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.014855Z"},"links":{"citing_paper":"/paper/2411.19133"},"observation_digest":"sha256:9f2b724f8e75fd6a2d6af84ebb5624653dbe708d9c65ca9e5119c70ebc7adb35","observation_id":"9d18b34f-6a39-412a-bf83-8899e6fe6add","resolution":{"observed_at":"2026-08-12T10:32:43.053254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.19133","last_updated":"2025-01-26T22:16:57Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T16:28:34.956083Z","submitted_at":"2024-11-28T13:34:15Z","title":"TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 1 inbound Pith citation observation for arXiv:2411.19133."}