{"as_of":"2026-08-08T16:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca5fcee5ba3ff0ef79f61df243d4609c69d60639e9a1956ed6ae31ebb663cc38","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.01663/citation-record","integrity":"/paper/2605.01663/integrity","json":"/paper/2605.01663/citation-record.json","paper":"/paper/2605.01663"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.15603","last_updated":"2026-05-15T04:30:30Z","snapshot_observed_at":"2026-08-02T15:38:22.659174Z","submitted_at":"2026-05-15T04:30:30Z","title":"Offline Reinforcement Learning with Universal Horizon Models","version":1},"cited_work":{"arxiv_id":"2605.15603","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15603","snapshot_observed_at":"2026-07-01T00:45:11.862828Z","title":"Offline Reinforcement Learning with Universal Horizon Models","venue":"cs.LG","work_id":"8a50da06-08de-4889-83d4-2262e2a747b0","year":2026},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"cited_paper":"/paper/2605.15603","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:3263c54941feebb34a9e826ee481f9006a4d5c856001cd33f98bd9731227c2c1","observation_id":"06592195-f886-47aa-9f9d-aa729670e0ec","resolution":{"observed_at":"2026-07-01T00:45:11.864147Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.833552Z","title":"Engel, Y ., Mannor, S., and Meir, R","venue":null,"work_id":"dff0fa1f-0412-4921-96a3-56682a152c9e","year":null},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:479d8c7e814acba77656cf02922e720e3917d26d6115ed7ec94351db09571458","observation_id":"46f30a7e-6ae1-47f7-a45d-6df236bff319","resolution":{"observed_at":"2026-07-07T08:13:30.834562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2351.110237","doi":"10.1145/1102351.1102377","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1145/1102351.1102377","venue":null,"work_id":"96bfdb61-99b0-4e2d-a4bd-b85a71fb0724","year":2005},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:7592604ab25f3221a01a0f6e7c1e002dc15ffba07e0fff5cb3bf1c778f709552","observation_id":"0650a644-d299-4352-8cf1-3798e06b25ca","resolution":{"observed_at":"2026-07-01T00:45:11.406384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2004.07219","doi":"10.48550/arxiv.2004.07219","metadata_source":"pith","pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","venue":"cs.LG","work_id":"47082e4e-a4a5-418b-bf4f-4667355065fc","year":2020},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:b831eae1fb1169bca519fe82c4847614a44714fd1340ee657feccb3405dc4cfc","observation_id":"7fdfa13b-b218-4768-b952-242a14399073","resolution":{"observed_at":"2026-07-01T00:45:11.861707Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10573","last_updated":"2023-05-19T18:31:04Z","snapshot_observed_at":"2026-07-06T15:18:07.416392Z","submitted_at":"2023-04-20T18:04:09Z","title":"IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies","version":2},"cited_work":{"arxiv_id":"2304.10573","doi":"10.1007/978-3-658-09994-7","metadata_source":"pith","pith_arxiv_id":"2304.10573","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies","venue":"cs.LG","work_id":"913326e6-9ea4-4974-b2d7-ff53984b387f","year":2023},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"cited_paper":"/paper/2304.10573","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:bd964714eb7eb43759a23d14eb7229c519098c5935f612a945699030d1b7a2e8","observation_id":"b817a577-db02-4820-96c6-d17b24ff56f8","resolution":{"observed_at":"2026-07-01T00:45:11.856744Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20609","last_updated":"2026-05-20T01:54:18Z","snapshot_observed_at":"2026-07-06T23:31:08.671011Z","submitted_at":"2026-05-20T01:54:18Z","title":"Compositional Transduction with Latent Analogies for Offline Goal-Conditioned Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2605.20609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20609","snapshot_observed_at":"2026-07-01T00:45:11.858070Z","title":"Compositional Transduction with Latent Analogies for Offline Goal-Conditioned Reinforcement Learning","venue":"cs.LG","work_id":"c5e1250e-47d8-4462-8f41-2eee845604ff","year":2026},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"cited_paper":"/paper/2605.20609","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:73f3bbb817e88b330fc5ec0c1b4f577593f230fae11ea97334fd105d8a69abf3","observation_id":"f8c24e63-fa9f-4c11-a987-a079e5d245f6","resolution":{"observed_at":"2026-07-01T00:45:11.859295Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.835074Z","title":"Kostrikov, I., Nair, A., and Levine, S","venue":null,"work_id":"f5785e3c-80f7-4a69-829f-942ea25a0cb6","year":2022},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:aea4372aed41a767590640ac6dea28f110ebeb7e4d46781dcfab1024c33c584e","observation_id":"c699f7bc-d823-4e95-9f11-996bd42ae390","resolution":{"observed_at":"2026-07-07T08:13:30.836113Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":"2005.01643","doi":"10.1613/jair.1.17526","metadata_source":"pith","pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","venue":"cs.LG","work_id":"597b6f46-d60f-451f-8f34-7d32876a9014","year":2020},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:5f7779d635dac843340570ef3b065138da83abb2440f205b56865a2782e134c4","observation_id":"8870bb17-d89e-4d6d-8ab0-8a1db1903b7d","resolution":{"observed_at":"2026-07-01T00:45:11.403899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1911031","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nguimatsia Tiofack, F., Le Hellard, T., Schramm, F., Perrin- Gilbert, N., and Carpentier, J","venue":"Econometrica","work_id":"7490475a-60ae-4f11-a374-16d5b8a5520f","year":2026},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:af4969ab2ab4cf3ea28ef3d590e05ed3bb6ae057ed4660ac3574202a4ac37134","observation_id":"13f7a8d5-8de7-4e34-bf00-b48941cc9659","resolution":{"observed_at":"2026-07-01T00:45:11.408358Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1910.00177","doi":"10.48550/arxiv.1910.00177","metadata_source":"pith","pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","venue":"cs.LG","work_id":"ab561983-ab59-4f04-a11e-a467ddde4848","year":2019},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:34f543022c27319378c2b5819c9216027fb133a49cd51cedf5912a53d87cc4bb","observation_id":"b03f38db-1a2f-4d7e-a7f7-5f1aba189b51","resolution":{"observed_at":"2026-07-01T00:45:11.854355Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.836663Z","title":"Srikant, R","venue":null,"work_id":"a2648b20-a116-46af-9e45-a58f60c03e6d","year":2019},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:995e74ddf8cd9a3b3167383126b8f36c30493e6fcb77f5abc65cd2463e1dd9f3","observation_id":"87231a91-efab-4702-a5d1-c858239dfe4a","resolution":{"observed_at":"2026-07-07T08:13:30.837883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.827161Z","title":"Venkatraman, S., Khaitan, S., Akella, R","venue":null,"work_id":"00850462-2678-4edd-a905-64da20d9b3a4","year":2024},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:c9272cec35c3cdf36ca32237f07e14236acbe5a0dcc65781c42c7c72b430b3b7","observation_id":"33c5469a-74d7-454f-aa19-d8aca2b0eb94","resolution":{"observed_at":"2026-07-07T08:13:30.828325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-07-06T08:39:58.361914Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1911.11361","doi":"10.1609/aaai.v40i31.39885","metadata_source":"pith","pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Behavior Regularized Offline Reinforcement Learning","venue":"cs.LG","work_id":"95ad303d-9555-46ad-9a95-3bbea22ed9fb","year":2019},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:3190516ee8b9b79bce8d5915d408549cf5788a9439e36f6005b16eb753c6f72c","observation_id":"8f3af840-3e14-47c8-becb-804337b8e558","resolution":{"observed_at":"2026-07-01T00:45:11.401553Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.828884Z","title":null,"venue":null,"work_id":"a91f3d95-8e56-4f17-8768-bc69a3159a13","year":null},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:4c0512aca5f5288d96b57761bcd7fa11a5ab662d4cf194e0b365f29b4a096ee7","observation_id":"88b1737f-5b0a-4d65-a271-04ac47710991","resolution":{"observed_at":"2026-07-07T08:13:30.829916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.825391Z","title":"Elements of a σ-algebra are calledmeasurable setsorevents","venue":null,"work_id":"ea92e4b5-a06a-4f70-90d4-5c6b0227051e","year":2009},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:314dc61b7c064dead67574f5abb97f6553c5471bc1f2a9e04241b83aeffb6685","observation_id":"4b4afea7-4f81-4996-840a-89195b24e8a1","resolution":{"observed_at":"2026-07-07T08:13:30.826630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.830449Z","title":null,"venue":null,"work_id":"a3cdea48-ed92-49e8-b322-ee7ec90dba68","year":null},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:2c84375596c828efa19b2ac097289b599802f4c0151d11639d160907618fc99a","observation_id":"e3baff4b-e64d-40b7-979c-f517f2e85763","resolution":{"observed_at":"2026-07-07T08:13:30.831451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.823482Z","title":"The Adroit tasks require learning complex skills such as spinning a pen, opening a door, relocating a ball, and using a hammer to hit a button","venue":null,"work_id":"bd690d61-c8f0-42ee-a511-d81547eec078","year":null},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:1427de622a2548deaf0de5c8707cc6d28cb636efe0128b308ada7ee298a446a7","observation_id":"7fd3493d-bf7a-4ee8-9230-dfe54b6f53d2","resolution":{"observed_at":"2026-07-07T08:13:30.824737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.821983Z","title":null,"venue":null,"work_id":"ca16343b-802a-47d1-bf0b-ea82e5b7fc1c","year":null},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:211c40ef6e14bc4f4d25e8c400ff984130fa2ba4fe02ab01f43415039c70fee1","observation_id":"b1235a75-fecf-4497-bbd5-b9d0121f89fa","resolution":{"observed_at":"2026-07-07T08:13:30.822985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:13:30.831996Z","title":null,"venue":null,"work_id":"b7e5f250-5357-45e5-a9a7-434c8bf2b783","year":2018},"citing_paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T00:43:24.171887Z"},"links":{"citing_paper":"/paper/2605.01663"},"observation_digest":"sha256:f3292a108f89b8a3d0eeb09a9e638ec43543fd2e58d73b0ca5d05e6ce10dd952","observation_id":"bd8ec583-f733-49bc-b032-b0fd35405e7e","resolution":{"observed_at":"2026-07-07T08:13:30.833038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.01663","last_updated":"2026-05-28T02:21:27Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T01:32:11Z","title":"Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":1,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":4,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2605.01663."}