{"as_of":"2026-08-07T22:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:876169341762668bdb5bc25344bff3f3fc9712ccdc7475ff2932199772edec03","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:05:00.601759Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06628/citation-record","integrity":"/paper/2507.06628/integrity","json":"/paper/2507.06628/citation-record.json","paper":"/paper/2507.06628"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.028580Z","title":"Dynamic programming","venue":null,"work_id":"d1a842b8-7d0e-46fa-b6be-3c7bcbce6601","year":1966},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.484950Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:43558a5710d89258a2a63b427620c4540163e3ffe78bbd17fe0bd311ed26a549","observation_id":"cfaeab78-d518-4a4f-bf72-54d28ae57db8","resolution":{"observed_at":"2026-08-06T19:05:01.031275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.020233Z","title":"End-to-end object detection with transformers","venue":null,"work_id":"e3cf8135-8bca-4590-8f9f-9f34f140cec0","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.604101Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:5dc960fa2eba40ab1970f0a575a3d1d57fefb03df5e00e197fa2104baf664c57","observation_id":"3108c96f-b45b-4a89-8017-626e891d2198","resolution":{"observed_at":"2026-08-06T19:05:01.023241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.012441Z","title":"Multitask learning","venue":null,"work_id":"1eda6f9f-2e53-4bc4-a292-59034fd8ff60","year":1997},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.756670Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:ac0284bd6b386d3adaf6faa5f040d23ca1290f54ebd95ba183765a90b1b88087","observation_id":"4cacba45-312d-4730-9151-a08ffefb0fcb","resolution":{"observed_at":"2026-08-06T19:05:01.015436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.004702Z","title":"Offline reinforcement learning via high-fidelity generative behavior modeling","venue":null,"work_id":"e715ddf5-4592-4343-ae8c-23cc381152b1","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.923754Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:abfb8047af036aa3a8f915c3475a13f3ffa06788eded0f7c49b264946da4e637","observation_id":"6f06411e-3478-4cac-8b4b-9ee20a2b8b39","resolution":{"observed_at":"2026-08-06T19:05:01.007475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.997014Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":"093ab360-4cef-4ebe-a1f3-601a86e18f70","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.090250Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:0877f5d14ff5981996c2f15c2053d9a05d488906aa8c704327ac547357765a9c","observation_id":"caf5ea7e-964e-4513-ad25-1004af798c8b","resolution":{"observed_at":"2026-08-06T19:05:00.999814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.988445Z","title":"Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks","venue":null,"work_id":"9d82ab7d-2e3f-4301-910e-13ed196fcba4","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.206029Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:7d6301f31ca78628b51881d3a0fa55e2d24c5b2239dc33754aa885b372ba28d5","observation_id":"ef50f3ef-2fa6-47cf-92b8-68b951d24f90","resolution":{"observed_at":"2026-08-06T19:05:00.991781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.980567Z","title":"Sharing knowledge in multi-task deep reinforcement learning","venue":null,"work_id":"1fabc153-6d97-497d-82d5-53dc3a5b2fb9","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.269243Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:27110780012d2bfa29bda44102061524269a4bf993a6ccc6a9b705f092fa3459","observation_id":"0bf9025a-bb2c-4008-96ee-efada1c4990c","resolution":{"observed_at":"2026-08-06T19:05:00.983491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.972740Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"6f06c62a-212f-46e9-9b51-2f3c12044445","year":2019},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.282621Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:c21b5a876eb2cc023dfdca99456a1a1bdcf5925d49a4e2b6bc24962904503804","observation_id":"8455d468-03fe-4e51-8281-a347ad8341e3","resolution":{"observed_at":"2026-08-06T19:05:00.975727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08742","last_updated":"2023-05-13T00:05:05Z","snapshot_observed_at":"2026-07-31T13:18:08.106331Z","submitted_at":"2023-04-18T05:42:53Z","title":"Behavior Retrieval: Few-Shot Imitation Learning by Querying Unlabeled Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08742","snapshot_observed_at":"2026-08-06T19:04:59.452357Z","title":"Behavior retrieval: Few-shot imitation learning by querying unlabeled datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.452357Z"},"links":{"cited_paper":"/paper/2304.08742","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:08c44a155d854887d15e7b78b41a89b7b4a047b25abbb042fdb986c6836a0b43","observation_id":"a11048d2-ea06-46a6-b930-8b517f2be48d","resolution":{"observed_at":"2026-08-06T19:04:59.452357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.964243Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":"5135d1d3-1310-4d9a-9c5a-8b947f6ad594","year":2019},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.616642Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:f33f96825304fe2ba16195c3ee1acd098991692758fe660c07143cfa9e10be74","observation_id":"ef7c42e5-753f-48f7-bf61-0e4b5aafdcb7","resolution":{"observed_at":"2026-08-06T19:05:00.967674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.956256Z","title":"Offline rl policies should be trained to be adaptive","venue":null,"work_id":"dac3605f-f316-4374-88a4-ee9c0bfed26e","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.826724Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:287a733bade64b23f9aa8ebcc2d22809985be9958d9ad1746e886d677ce2a052","observation_id":"35515b93-cadf-401f-9912-76a2f3bacc22","resolution":{"observed_at":"2026-08-06T19:05:00.959102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.948867Z","title":"D., Avoli, M., and Pineau, J","venue":null,"work_id":"42c081dc-1770-450f-98ef-d17aa59f19a4","year":2008},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.989067Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:59014ed941937c635b648f8d64f24fae92fb06eb8c2fd21b900597fc71a6a1e7","observation_id":"8f851b1f-d856-47da-a5ec-327ab4287abd","resolution":{"observed_at":"2026-08-06T19:05:00.951518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.941098Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"b20ae3df-a4ee-4ab5-ac13-4b51a096e4b7","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.155527Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:9db343457fece308d1e09439b96495cbef6d9f8902010014caafb539eb5da30d","observation_id":"89db53cb-39ce-4f18-b8dc-4faf31672579","resolution":{"observed_at":"2026-08-06T19:05:00.943896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.933428Z","title":"Hierarchical few-shot imitation with skill transition models","venue":null,"work_id":"f7c309ec-e0e0-4c32-be0b-cd382160e281","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.319849Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:aa04c56afeda11590187c7411ca792904f88b850924cc40344ba5c131d0a9d13","observation_id":"b3a8283a-25c9-4df2-89d2-788391eca7ea","resolution":{"observed_at":"2026-08-06T19:05:00.936154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.925367Z","title":"Diffusion model is an effective planner and data synthesizer for multi-task reinforcement learning","venue":null,"work_id":"4ffa20c1-e1f9-440a-9ffa-c52fa2ba6c81","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.479888Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:212765e7962e10f5edf831601841e1688c4a13a5dc7ad635091db9278f174df5","observation_id":"863863cb-71ad-4cda-bae4-869407494c3b","resolution":{"observed_at":"2026-08-06T19:05:00.928615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.917725Z","title":"Efficient multi-task reinforcement learning with cross-task policy guidance","venue":null,"work_id":"39f28721-01bc-4bba-ac4e-19a191100d1d","year":2024},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.512782Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:20794ace419d6623446e0d5f8c9494d5328aeda5d1f7f1cfdd1b687625731d33","observation_id":"7940986a-1ebb-406d-a02b-d1e7362b8ba4","resolution":{"observed_at":"2026-08-06T19:05:00.920412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.909641Z","title":"Not all tasks are equally difficult: Multi-task deep reinforcement learning with dynamic depth routing","venue":null,"work_id":"fd397703-1b98-4732-8b7c-389f7635e80f","year":2024},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.515347Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:d1925d0e29684542e7c2c014909ec77d8e5aca2af093778eb9bdc104a0a18f45","observation_id":"c589436b-236f-4120-8d0b-ffa811e60a5a","resolution":{"observed_at":"2026-08-06T19:05:00.912575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.901940Z","title":"Harmodt: Harmony multi-task decision transformer for offline reinforcement learning","venue":null,"work_id":"a9b31f47-3acb-405c-8042-0ace34bb88b2","year":2024},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.518935Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:a426f76aa389318cfaa2b96943fa62a7547253a8d48cd0bf4869c327747b8927","observation_id":"26029a1f-d0e5-4e0e-8d81-4124633f8e14","resolution":{"observed_at":"2026-08-06T19:05:00.904815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.894218Z","title":"B., and Levine, S","venue":null,"work_id":"efe8324c-14d3-4826-b330-a6830b14ad13","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.521469Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:5a84e7c18fbbc0cdb77e51c2fd9d1fade7d7e5012a56b1903e4cb6aa9715f885","observation_id":"8c6f6859-26e7-4982-97b3-590a264cab8c","resolution":{"observed_at":"2026-08-06T19:05:00.896811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.886018Z","title":"Scalable deep reinforcement learning for vision-based robotic manipulation","venue":null,"work_id":"e227348c-cb07-4150-b404-25e7a53af41e","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.525516Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:1cdd38fb3cbbd6d5e35bec97f209fec23735b1fe61026c507fcdc00e186663d2","observation_id":"5b73fb77-30c9-4af3-bfcc-eabe7f6b4e47","resolution":{"observed_at":"2026-08-06T19:05:00.888967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08212","last_updated":"2021-04-27T20:06:33Z","snapshot_observed_at":"2026-08-06T07:54:11.485065Z","submitted_at":"2021-04-16T16:38:02Z","title":"MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08212","snapshot_observed_at":"2026-08-06T19:05:00.528075Z","title":"Mt-opt: Continuous multi-task robotic reinforcement learning at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.528075Z"},"links":{"cited_paper":"/paper/2104.08212","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:047027b45b62712871e1ccebee3ab53181d7342bc8be06550355d3295f6f38ad","observation_id":"27752620-cd0d-4863-8994-9340d420234b","resolution":{"observed_at":"2026-08-06T19:05:00.528075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11235","last_updated":"2020-11-23T06:37:08Z","snapshot_observed_at":"2026-08-07T15:44:48.506500Z","submitted_at":"2020-11-23T06:37:08Z","title":"An Empirical Study of Representation Learning for Reinforcement Learning in Healthcare","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11235","snapshot_observed_at":"2026-08-06T19:05:00.531117Z","title":"W., Zhang, H., Subramanian, J., Fatemi, M., and Ghassemi, M","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.531117Z"},"links":{"cited_paper":"/paper/2011.11235","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b41cc04adb64df0f5ce3d9cd69cd123d14e40f4bf83b646a7e7a9c88ef6356e5","observation_id":"d874b1d1-ced1-4f1c-99b2-0387aec47ed7","resolution":{"observed_at":"2026-08-06T19:05:00.531117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.877874Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":"3ab12491-ddcb-46d2-b99a-e0c6768ab1c8","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.534193Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:1307920460ee1b6cc539c61c0c5970804dc4afacd14019996f6a9a79279728bd","observation_id":"ffeccdd7-f3d3-4216-8b15-fe7f7fb7a8a0","resolution":{"observed_at":"2026-08-06T19:05:00.880872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.869179Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":"ee878adb-157e-4dc4-84b8-76f5bb70766e","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.536815Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:5aee1d7fe98e27a985d726f5764d0fc384abf3ab07f926d10466c5289a70b1e0","observation_id":"57de8e44-6c70-49f4-9637-32aaa1bf1fad","resolution":{"observed_at":"2026-08-06T19:05:00.872702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.860154Z","title":"S., Lee, L., Freeman, D., Guadarrama, S., Fischer, I., Xu, W., Jang, E., Michalewski, H., et al","venue":null,"work_id":"7e742253-ae89-4309-abcf-7aa944e68581","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.539435Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:e5ac8e907de8be9782eca3a63d625c35c3ccce098503910a9dfe18a46e60901d","observation_id":"8a9e6aa8-0f5b-40d9-b51e-e7776d867d37","resolution":{"observed_at":"2026-08-06T19:05:00.863344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.851550Z","title":"End-to-end training of deep visuomotor policies","venue":null,"work_id":"201ca0ba-e212-43a8-a455-7c850926e883","year":2016},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.542071Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:2060371585493bff40977093f3c8737fbd50fc109bbc79b4f08b8566a79d6c8b","observation_id":"82366685-18bf-421f-bf27-346fc7462428","resolution":{"observed_at":"2026-08-06T19:05:00.854390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T19:05:00.544604Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.544604Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:434da90da23127940b57135592b3ac27b79bfc3ccc1550ce80ef206ac3ef64d3","observation_id":"628683bb-a700-4caf-80f3-210f50267964","resolution":{"observed_at":"2026-08-06T19:05:00.544604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.843275Z","title":"P., Hunt, J","venue":null,"work_id":"13818dd1-061c-4f18-8974-63022bf37d05","year":2016},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.547449Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:c63be0a50ca932a1c9c57d8025a95e485504e17b412b7ebb6c914ca91e742f5d","observation_id":"1f26d98f-a7a7-43ee-a96a-0de2f4278872","resolution":{"observed_at":"2026-08-06T19:05:00.846509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.835084Z","title":"Focal loss for dense object detection","venue":null,"work_id":"41774032-2e7e-4e94-8b8c-193fe370d54d","year":2017},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.550000Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:9d43f5a8253d2ca15494ba5c212a521bcdd99f7a0d9537eac454babd4f7874f9","observation_id":"d97fc928-a729-48ba-a280-71bc388f888e","resolution":{"observed_at":"2026-08-06T19:05:00.837840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.826593Z","title":"Conflict-averse gradient descent for multi-task learning","venue":null,"work_id":"b6c71cd5-5bd2-44a2-9e02-a45edfed2772","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.552464Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:9fdf8d5a974f206ced0d67084628887e32403c67243d2f2f9207c9fa082888ea","observation_id":"e5254a3b-4762-4671-ba70-a45b427a5d2d","resolution":{"observed_at":"2026-08-06T19:05:00.829344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.818480Z","title":"J., Kumar, V., Zhang, A., Bastani, O., and Jayaraman, D","venue":null,"work_id":"767a75bb-bf51-47f2-b5d0-a598fa1ba339","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.554800Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:cdf43e01177f66c998662e989d6d7b6c11d9c20bdca700c86b559d169c415807","observation_id":"4c6acaec-b2d7-4bcb-a432-bdec2bf8f212","resolution":{"observed_at":"2026-08-06T19:05:00.821377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.810323Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":"57b56ef6-2cf5-49f7-bb51-63521d08b960","year":2015},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.557315Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:328abc6cf5c2a3f886dd6dfdd6143ea3e8ef68d17161aa096ee2a106abedff22","observation_id":"3dd173d8-373e-4d39-b443-a46a8fc53606","resolution":{"observed_at":"2026-08-06T19:05:00.812990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.801908Z","title":"R3m: a universal visual representation for robot manipulation","venue":null,"work_id":"6501750a-40ca-4024-996d-3644f4477a39","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.559705Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:666cd6f289de0e99832074959b4dc364b7135ba87b341003c079db6a376369e2","observation_id":"b8559033-9d6b-4ca7-bd63-a30d969c83a0","resolution":{"observed_at":"2026-08-06T19:05:00.804814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.793201Z","title":"Learning and retrieval from prior data for skill-based imitation learning","venue":null,"work_id":"94a585d6-1000-46d9-bd0d-dc8eacd16620","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.562105Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:2abda10d6e64bcbb59e7d38bb098abef84a50e86fbc5197339dc3eaff36cfdbc","observation_id":"1864ec49-063c-4c1d-bdd1-c29f0fa9ea3f","resolution":{"observed_at":"2026-08-06T19:05:00.796533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.784934Z","title":"Accelerating reinforcement learning with learned skill priors","venue":null,"work_id":"e44d1aa0-4862-4008-8cbb-59b2f08fbe41","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.564462Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:3ebf11f6f22ee122a196212703f0f4b3dc1f33d0476b717df131b51170e57fe4","observation_id":"b7049cb4-f099-4a88-ac3d-ba329623a2ba","resolution":{"observed_at":"2026-08-06T19:05:00.788028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.775263Z","title":null,"venue":null,"work_id":"5a2cbbb8-1b96-44eb-b904-19e3af1ae9e1","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.567271Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:70b630512bf57d2b997f9187e131f42fcc41a5a1158cbb733da12ec9a50738be","observation_id":"b74797b9-7046-4b18-8663-9cbd88b7ed07","resolution":{"observed_at":"2026-08-06T19:05:00.779220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.766843Z","title":null,"venue":null,"work_id":"264147df-9f74-4cde-a51a-e843026385fe","year":2014},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.569767Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:1b9dc61cd8c9e21c4bd59e1779a7006e73761feaf41a4671b13ab9753ee6a506","observation_id":"ca23bf21-1be4-4ee0-9b5f-79bdc4e1cf8d","resolution":{"observed_at":"2026-08-06T19:05:00.769602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.758830Z","title":"Hierarchical and interpretable skill acquisition in multi-task reinforcement learning","venue":null,"work_id":"ed1924ec-3b94-478e-afa2-d430a0a51c35","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.572089Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b0ca150e23bf09037b0a22b7d5efbff6ca659208f012fa65732c9c247156d431","observation_id":"b5c95921-1d44-409c-8238-55314c1fffd5","resolution":{"observed_at":"2026-08-06T19:05:00.761697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.749648Z","title":"Multi-task reinforcement learning with context-based representations","venue":null,"work_id":"e3985ffc-e4b1-4c1d-857a-3062f5c41f9c","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.574384Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:c9cf604e58861586071064eff3a69d89daf83ae0b7f881f7d9e2cbbc6cde159b","observation_id":"e6ea7188-ee28-4a86-b798-478dacec91c7","resolution":{"observed_at":"2026-08-06T19:05:00.753473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.741227Z","title":"MuJoCo : A physics engine for model-based control","venue":null,"work_id":"f7774ad5-dd7f-4a36-8cd2-b6dc90efb523","year":2012},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.577134Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:f696537a1f4bcd797731dacdbf5747494e7c389b51582de8250007357bdb864d","observation_id":"00fe138d-f58a-46e9-a051-b0020730a5ae","resolution":{"observed_at":"2026-08-06T19:05:00.744057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.733292Z","title":"Neural discrete representation learning","venue":null,"work_id":"71a4047e-a9a2-4c9c-b20c-38731fa6f71c","year":2017},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.579931Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:aff881df0ca6ceec7cee2e0987f3a2286011f1ae8fee84dd0535ed84ce5ac0f8","observation_id":"26c62894-6b2b-48fd-988b-e838d4251ed3","resolution":{"observed_at":"2026-08-06T19:05:00.736236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.724941Z","title":"N., Kaiser, L","venue":null,"work_id":"5e4ac7dd-fb4e-4d72-9fa8-6d2a3be5d4c6","year":2017},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.582323Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b075f3ae62252ec8ce82e33c9348fd8fc3d88c7055cebbcd4881ebb352dad8c3","observation_id":"6f0940a5-670d-410d-be91-9bb56f876a1b","resolution":{"observed_at":"2026-08-06T19:05:00.727851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.716952Z","title":"J., and Zhou, M","venue":null,"work_id":"4027f371-6e09-4b76-8817-0abc349c2063","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.584763Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b97396d75a4e39cd1832bff83c54c07d81f3c9688a72d5a29d39377b39cf5ab3","observation_id":"4ee1e941-9ff8-4d7e-8d72-a5cf7f7877a6","resolution":{"observed_at":"2026-08-06T19:05:00.719735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.708383Z","title":"Prompting decision transformer for few-shot policy generalization","venue":null,"work_id":"adb56434-7fcf-4b31-a220-c4309565e243","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.587398Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:ea74728ab7e96e599421ccc7edeb928c27e1757eb65ba12c68b75a175157a193","observation_id":"511c03bb-db4d-4703-b470-66ac6de5acfb","resolution":{"observed_at":"2026-08-06T19:05:00.711682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.699459Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":"a314bac4-fbbf-49cb-8957-a454f1d301fa","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.589746Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:a7cca71ed6e4751266639413858c52f7632619925debdd03e85fa97e06b2f0dd","observation_id":"66754f05-b7dd-40aa-8a18-3e0306d9223c","resolution":{"observed_at":"2026-08-06T19:05:00.702267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.691311Z","title":"Multi-task reinforcement learning with soft modularization","venue":null,"work_id":"19283053-95c6-4873-8744-b4d4e76bc617","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.592429Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:aaa0d2c30562a7af6c17612e4e9950d4496db9bb03bb3b98827efc0538156b26","observation_id":"e9a401d2-b87d-4316-86e5-468c716586f7","resolution":{"observed_at":"2026-08-06T19:05:00.694210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.682384Z","title":"Mastering complex control in MOBA games with deep reinforcement learning","venue":null,"work_id":"ec7c6457-674a-4312-a95a-d62e20a70cab","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.594843Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:0e5f0e1b0776a870522251a595e4f8ed643ef84ac23d3938470b380e93adb8d4","observation_id":"3620bb30-baec-43ad-942b-185862b4b67c","resolution":{"observed_at":"2026-08-06T19:05:00.685346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.674124Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":"7197ae7b-af9b-461b-961c-4113989fe112","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.597176Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:324ebbb486db34e001a8f90dbb3e4b8a301ee11df8fd401d3cd99bd344a1321c","observation_id":"2db120dc-bcb6-48bf-84ef-5d851653a753","resolution":{"observed_at":"2026-08-06T19:05:00.676909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.663646Z","title":"Meta-World : A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"7d170754-5baa-411c-ab51-0b0693dd41ab","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.599488Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:869fd804067942fce36685e11d18b7f2a733aa51eeb3d3ed4edb63ef939122e6","observation_id":"e6ec6746-f7cd-403b-8457-f6af026d8152","resolution":{"observed_at":"2026-08-06T19:05:00.668348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.601759Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.601759Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:e216fcf74157f7fc2abeb61ce3d3c29702e04c584586e59cba0d2ab25abee4d9","observation_id":"e139f114-5079-405d-bb0f-0cf38c201b09","resolution":{"observed_at":"2026-08-06T19:05:00.601759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2507.06628."}