{"as_of":"2026-08-08T07:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e0bc440670b0d8c349c4cac3ea57790c736565528de0c0fa0ab626eefa4caae","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T17:19:02.982053Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T10:27:47.896922Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:17:48.486940Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"cited_work":{"arxiv_id":"2603.27044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.27044","snapshot_observed_at":"2026-07-07T03:18:14.563422Z","title":"arXiv preprint arXiv:2603.27044 , year=","venue":null,"work_id":"17539d64-168f-4804-b4c9-bb2d4649a48d","year":null},"citing_paper":{"arxiv_id":"2606.12200","last_updated":"2026-06-10T15:19:41Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T15:19:41Z","title":"Implicit Neural Representations of Individual Behavior","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-06-27T10:27:47.896922Z"},"links":{"cited_paper":"/paper/2603.27044","citing_paper":"/paper/2606.12200"},"observation_digest":"sha256:c5cbb567b8262eacff6efa4245fe033d7ccbaa6f84e9bf1c6a9568f062ba9578","observation_id":"068c1dd5-793c-4edf-aa67-363193e9e106","resolution":{"observed_at":"2026-07-07T03:18:14.563422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.27044/citation-record","integrity":"/paper/2603.27044/integrity","json":"/paper/2603.27044/citation-record.json","paper":"/paper/2603.27044"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.10299","last_updated":"2018-07-26T18:05:45Z","snapshot_observed_at":"2026-07-06T06:52:34.374453Z","submitted_at":"2018-07-26T18:05:45Z","title":"Variational Option Discovery Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.10299","snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Variational option discovery algorithms.arXiv preprint arXiv:1807.10299,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"cited_paper":"/paper/1807.10299","citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:e9557332e8485f2bd6dc5de1c3226853b92083d280be7ec2d6f2c004e284c6a8","observation_id":"c6f2957b-b364-48a5-898e-e78144beab08","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Learning policy representations for steerable behavior synthesis.arXiv preprint arXiv:2601.22350,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:61ee27da141662d95cdcd6eabfbbbda49ccd9dec514739a6568cc68ca4999c20","observation_id":"0330c2a1-e371-4af3-bd20-6cb4fb262cb0","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i10.17091","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mirco Mutti, Stefano Del Col, and Marcello Restelli","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"22a9f6f1-5af1-4279-aa2b-172e2019f4b9","year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:58a234cca8b475c37085ddf0238a224d98584e203b35502a9083386f99730437","observation_id":"f812df9f-ea7e-4330-9a72-71f35508d3b0","resolution":{"observed_at":"2026-07-13T17:19:46.580425Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12892","last_updated":"2022-09-26T17:59:58Z","snapshot_observed_at":"2026-08-08T07:16:34.088459Z","submitted_at":"2022-09-26T17:59:58Z","title":"Learning to Learn with Generative Models of Neural Network Checkpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.12892","snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Learning to learn with generative models of neural network checkpoints.arXiv preprint arXiv:2209.12892,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"cited_paper":"/paper/2209.12892","citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:3c87de35a716460221a47992851d82c571c26dffb7d46b81642ded6358982f56","observation_id":"ca27d3bb-591e-47ae-bfde-499053712d75","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:3905f213a19fa8aa43ab7b17f83e34395d550f61a785c9891d3cf7198fc01698","observation_id":"92533859-3fc2-4755-b603-cfdd1cd6c4ad","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9620.2020","doi":"10.1109/ddcls49620.2020.9275169","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"11 Supplementary Materials The following content was not necessarily subject to peer review","venue":"2020 IEEE 9th Data Driven Control and Learning Systems Conference (DDCLS)","work_id":"3866e6a3-94ea-40e4-975b-d6ce3c930c5e","year":2020},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:f94de190c1645a2c078db63f9d1e0144c2f71a2ab56da80159a5c9c80eb8e4ee","observation_id":"88fa4cd6-1d89-48e4-b752-77dd7d5ad0b9","resolution":{"observed_at":"2026-07-13T17:19:46.588097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"In supervised learning, hyper-representations(Schürholt et al., 2021; 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:035b9d89804f0807b89471c28abd8a9d6661eb49098c7d025087456b37e6002d","observation_id":"f2d34d48-87ea-4a6b-8c80-e8a6f2c7a393","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"To circumvent this, recent works in supervised learning supplement standard parameter reconstruction losses with behavioral output matching (Meynent et al., 2025)","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:3fab0de706e83f2bab1922c2c8da6925d72d0a19bb4c13cd8019c1068f654f8c","observation_id":"ac37e8c2-3056-48c6-bdf2-8a9e20dda9d0","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Similar architectures have been applied in Quality Diversity to improve the sample efficiency of diversity-based search (Rakicevic et al.,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:78b0a7b16ee9ada2d52f329c3263e6f7a5ed90fdcfbcf1d6ab9e4e433d9a8cf6","observation_id":"1d6f86ff-f04d-42fa-9052-1d4c3b63b889","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Notably, these methods rely onparameter-reconstruction losses, which fundamentally restrict their compression ratios (e.g., up to 19 : 1 in Hegde et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:a33556ec7769991064818657748228c3cf7992bb26c3cb5b48147441b7aaf327","observation_id":"39f8e67d-daa9-4265-8785-bacdee8dd9df","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:2f3b48410aa5e09b939e60dbb493af7513ee466c16d279a548a3fba2ace22b9d","observation_id":"ecaca591-6f3c-4726-ba4c-ce03679ce71d","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Our contribution scales these concepts from single-expert matching to population-level alignment by developing a mixture-occupancy matching objective","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:c4f5ab05f55a2503822389d96d504f8c3c784311d54c4379077de02d7fa4f7c8","observation_id":"8018d7ca-3319-4b25-9668-26cebbd90ce7","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:7a8374e1d764104acaefac73ea9aee149d12194a4b0575c2568f7ae66463df1b","observation_id":"a323aede-a36a-4f31-ac88-5b01ff0ced6a","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Proof.By the definition of the mixture, m(x) =w ipi(x)+P j̸=i wjpj(x)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:0234c1d44585b8b26e69527ccf31eae9882a5736353edf620f21315bda1f6f4f","observation_id":"3fac1c43-d117-4862-b2a8-714a13a148db","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Reacher (RC).RC features a two-jointed robotic arm moving in a 2D plane","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:9ae69215b0a6ae688c34d9b0ba830a81113c0fd44ec7875887a748a3cdd7b86b","observation_id":"36a663ca-7f4d-488a-842d-7dced679c0e9","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-13T17:18:10.908640Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 1 inbound Pith citation observation for arXiv:2603.27044."}