{"as_of":"2026-08-13T03:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96b65ced6bd8fa2d96bbd8dd834a7571ab27cdf4ad90d63ea1812ef51b83f88f","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:05:00.601759Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06628/citation-record","integrity":"/paper/2507.06628/integrity","json":"/paper/2507.06628/citation-record.json","paper":"/paper/2507.06628"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.028580Z","title":"Dynamic programming","venue":null,"work_id":"d1a842b8-7d0e-46fa-b6be-3c7bcbce6601","year":1966},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.484950Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:581c3c08e6444f5af4e201a279ff823f358bd2cf412c50c7e6c9890c282c7b2f","observation_id":"cfaeab78-d518-4a4f-bf72-54d28ae57db8","resolution":{"observed_at":"2026-08-06T19:05:01.031275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.020233Z","title":"End-to-end object detection with transformers","venue":null,"work_id":"e3cf8135-8bca-4590-8f9f-9f34f140cec0","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.604101Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:2ffe0d634500cc462edd54706b6ebc80460d48b58902e92f66fc749433d3575b","observation_id":"3108c96f-b45b-4a89-8017-626e891d2198","resolution":{"observed_at":"2026-08-06T19:05:01.023241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.012441Z","title":"Multitask learning","venue":null,"work_id":"1eda6f9f-2e53-4bc4-a292-59034fd8ff60","year":1997},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.756670Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:4fe7cdcaf2dce6814f9bb8fd614354a6ca316a22ba20a370a638818ae5552da4","observation_id":"4cacba45-312d-4730-9151-a08ffefb0fcb","resolution":{"observed_at":"2026-08-06T19:05:01.015436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:01.004702Z","title":"Offline reinforcement learning via high-fidelity generative behavior modeling","venue":null,"work_id":"e715ddf5-4592-4343-ae8c-23cc381152b1","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:58.923754Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:c64b7f5da6d3b914c370d7676cf9a6ec476c9e43336f37e0503cd85c3b3df805","observation_id":"6f06411e-3478-4cac-8b4b-9ee20a2b8b39","resolution":{"observed_at":"2026-08-06T19:05:01.007475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.997014Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":"093ab360-4cef-4ebe-a1f3-601a86e18f70","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.090250Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:f59f85ce8283315f8525ab180798013d1e6209cf4c20e5bb598fd4d16617898c","observation_id":"caf5ea7e-964e-4513-ad25-1004af798c8b","resolution":{"observed_at":"2026-08-06T19:05:00.999814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.988445Z","title":"Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks","venue":null,"work_id":"9d82ab7d-2e3f-4301-910e-13ed196fcba4","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.206029Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:2ea6b0df2529dcb6a83ecbd71948335a2fdee4619eca85fd6636acffcb4ea925","observation_id":"ef50f3ef-2fa6-47cf-92b8-68b951d24f90","resolution":{"observed_at":"2026-08-06T19:05:00.991781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.980567Z","title":"Sharing knowledge in multi-task deep reinforcement learning","venue":null,"work_id":"1fabc153-6d97-497d-82d5-53dc3a5b2fb9","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.269243Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:d587c2223ca50bbf8bcac057a5a8a56a06add3d333108a272f8b608173213689","observation_id":"0bf9025a-bb2c-4008-96ee-efada1c4990c","resolution":{"observed_at":"2026-08-06T19:05:00.983491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.972740Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"6f06c62a-212f-46e9-9b51-2f3c12044445","year":2019},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.282621Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:9b8c871eb8aeeb86441fdbbe8d4894e251f45053a31001c66d214f5db153a568","observation_id":"8455d468-03fe-4e51-8281-a347ad8341e3","resolution":{"observed_at":"2026-08-06T19:05:00.975727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08742","last_updated":"2023-05-13T00:05:05Z","snapshot_observed_at":"2026-07-31T13:18:08.106331Z","submitted_at":"2023-04-18T05:42:53Z","title":"Behavior Retrieval: Few-Shot Imitation Learning by Querying Unlabeled Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08742","snapshot_observed_at":"2026-08-06T19:04:59.452357Z","title":"Behavior retrieval: Few-shot imitation learning by querying unlabeled datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.452357Z"},"links":{"cited_paper":"/paper/2304.08742","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:08c44a155d854887d15e7b78b41a89b7b4a047b25abbb042fdb986c6836a0b43","observation_id":"a11048d2-ea06-46a6-b930-8b517f2be48d","resolution":{"observed_at":"2026-08-06T19:04:59.452357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.964243Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":"5135d1d3-1310-4d9a-9c5a-8b947f6ad594","year":2019},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.616642Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:2a672f3d0035c657dd8175005b6f919ba9a590219a5cd0d20df2eaec36d55925","observation_id":"ef7c42e5-753f-48f7-bf61-0e4b5aafdcb7","resolution":{"observed_at":"2026-08-06T19:05:00.967674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.956256Z","title":"Offline rl policies should be trained to be adaptive","venue":null,"work_id":"dac3605f-f316-4374-88a4-ee9c0bfed26e","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.826724Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:6f50b3db44b32233d4fdf724a733f762a2b68151b284c6f5b856d0b3662b4f83","observation_id":"35515b93-cadf-401f-9912-76a2f3bacc22","resolution":{"observed_at":"2026-08-06T19:05:00.959102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.948867Z","title":"D., Avoli, M., and Pineau, J","venue":null,"work_id":"42c081dc-1770-450f-98ef-d17aa59f19a4","year":2008},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:04:59.989067Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:888526d9d745637f6a975936e74a1389e2ef88d947cd683da53b8f181ce8eb9f","observation_id":"8f851b1f-d856-47da-a5ec-327ab4287abd","resolution":{"observed_at":"2026-08-06T19:05:00.951518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.941098Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"b20ae3df-a4ee-4ab5-ac13-4b51a096e4b7","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.155527Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:09fec26e90657c7ed2937dbdaace2defe600864f8006fc497b02c3d48d23cae6","observation_id":"89db53cb-39ce-4f18-b8dc-4faf31672579","resolution":{"observed_at":"2026-08-06T19:05:00.943896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.933428Z","title":"Hierarchical few-shot imitation with skill transition models","venue":null,"work_id":"f7c309ec-e0e0-4c32-be0b-cd382160e281","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.319849Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:895a350bd6ef716c74ef1edcaddc2d633467a615913ea8e587383176aba26d3d","observation_id":"b3a8283a-25c9-4df2-89d2-788391eca7ea","resolution":{"observed_at":"2026-08-06T19:05:00.936154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.925367Z","title":"Diffusion model is an effective planner and data synthesizer for multi-task reinforcement learning","venue":null,"work_id":"4ffa20c1-e1f9-440a-9ffa-c52fa2ba6c81","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.479888Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:e4c12544f47cf2b354cb442f22377683cd166fe84fa2e4096404694c5e73fcb4","observation_id":"863863cb-71ad-4cda-bae4-869407494c3b","resolution":{"observed_at":"2026-08-06T19:05:00.928615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.917725Z","title":"Efficient multi-task reinforcement learning with cross-task policy guidance","venue":null,"work_id":"39f28721-01bc-4bba-ac4e-19a191100d1d","year":2024},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.512782Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:a57bf08d3f55ec26a110bf5c6a402ff3ae2e652b631fdf2398d29023f00f8db4","observation_id":"7940986a-1ebb-406d-a02b-d1e7362b8ba4","resolution":{"observed_at":"2026-08-06T19:05:00.920412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.909641Z","title":"Not all tasks are equally difficult: Multi-task deep reinforcement learning with dynamic depth routing","venue":null,"work_id":"fd397703-1b98-4732-8b7c-389f7635e80f","year":2024},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.515347Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:1b39a6848f38729bf0bb8c91e594706c6a80afc25aa61d8c44eb54c105a961de","observation_id":"c589436b-236f-4120-8d0b-ffa811e60a5a","resolution":{"observed_at":"2026-08-06T19:05:00.912575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.901940Z","title":"Harmodt: Harmony multi-task decision transformer for offline reinforcement learning","venue":null,"work_id":"a9b31f47-3acb-405c-8042-0ace34bb88b2","year":2024},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.518935Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:4bdd7a86e1eb15732325b32fffea75ca0341cce3fd3a159cc2cad3d74e7ac039","observation_id":"26029a1f-d0e5-4e0e-8d81-4124633f8e14","resolution":{"observed_at":"2026-08-06T19:05:00.904815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.894218Z","title":"B., and Levine, S","venue":null,"work_id":"efe8324c-14d3-4826-b330-a6830b14ad13","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.521469Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:cb6af8e76e5399a4f2523a4e7da00d5349d97adb37080e6ff0ce874e7813c519","observation_id":"8c6f6859-26e7-4982-97b3-590a264cab8c","resolution":{"observed_at":"2026-08-06T19:05:00.896811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.886018Z","title":"Scalable deep reinforcement learning for vision-based robotic manipulation","venue":null,"work_id":"e227348c-cb07-4150-b404-25e7a53af41e","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.525516Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:0d35af81a8769995ac6e42943d466e6a819c4e4276ec7b8bef0c3ed4e14bfb82","observation_id":"5b73fb77-30c9-4af3-bfcc-eabe7f6b4e47","resolution":{"observed_at":"2026-08-06T19:05:00.888967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08212","last_updated":"2021-04-27T20:06:33Z","snapshot_observed_at":"2026-08-10T23:26:04.016749Z","submitted_at":"2021-04-16T16:38:02Z","title":"MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08212","snapshot_observed_at":"2026-08-06T19:05:00.528075Z","title":"Mt-opt: Continuous multi-task robotic reinforcement learning at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.528075Z"},"links":{"cited_paper":"/paper/2104.08212","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b241b53264fa9be64d003a517d02b498d7bc98d4f474fee5c3b8c19ee880dae2","observation_id":"27752620-cd0d-4863-8994-9340d420234b","resolution":{"observed_at":"2026-08-06T19:05:00.528075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11235","last_updated":"2020-11-23T06:37:08Z","snapshot_observed_at":"2026-08-07T15:44:48.506500Z","submitted_at":"2020-11-23T06:37:08Z","title":"An Empirical Study of Representation Learning for Reinforcement Learning in Healthcare","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11235","snapshot_observed_at":"2026-08-06T19:05:00.531117Z","title":"W., Zhang, H., Subramanian, J., Fatemi, M., and Ghassemi, M","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.531117Z"},"links":{"cited_paper":"/paper/2011.11235","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b41cc04adb64df0f5ce3d9cd69cd123d14e40f4bf83b646a7e7a9c88ef6356e5","observation_id":"d874b1d1-ced1-4f1c-99b2-0387aec47ed7","resolution":{"observed_at":"2026-08-06T19:05:00.531117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.877874Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":"3ab12491-ddcb-46d2-b99a-e0c6768ab1c8","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.534193Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:89f0756487f6e72e7efe06ca897dda3d1ce7e7d1802b5f452a4a1ddee770d28f","observation_id":"ffeccdd7-f3d3-4216-8b15-fe7f7fb7a8a0","resolution":{"observed_at":"2026-08-06T19:05:00.880872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.869179Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":"ee878adb-157e-4dc4-84b8-76f5bb70766e","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.536815Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:ecff8b69b2bc073dee43005b32dde4682dd3ee6e36f97a74ac225a5c744b39cd","observation_id":"57de8e44-6c70-49f4-9637-32aaa1bf1fad","resolution":{"observed_at":"2026-08-06T19:05:00.872702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.860154Z","title":"S., Lee, L., Freeman, D., Guadarrama, S., Fischer, I., Xu, W., Jang, E., Michalewski, H., et al","venue":null,"work_id":"7e742253-ae89-4309-abcf-7aa944e68581","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.539435Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:b19e15e4b2d729473ffc18a2fc83f4101f714b9d08be28da3e45456f496f0cc4","observation_id":"8a9e6aa8-0f5b-40d9-b51e-e7776d867d37","resolution":{"observed_at":"2026-08-06T19:05:00.863344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.851550Z","title":"End-to-end training of deep visuomotor policies","venue":null,"work_id":"201ca0ba-e212-43a8-a455-7c850926e883","year":2016},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.542071Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:de2959098eb044fdcf22957689f9b725ae47f09709b46548be1e82715176d1b0","observation_id":"82366685-18bf-421f-bf27-346fc7462428","resolution":{"observed_at":"2026-08-06T19:05:00.854390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T19:05:00.544604Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.544604Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:434da90da23127940b57135592b3ac27b79bfc3ccc1550ce80ef206ac3ef64d3","observation_id":"628683bb-a700-4caf-80f3-210f50267964","resolution":{"observed_at":"2026-08-06T19:05:00.544604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.843275Z","title":"P., Hunt, J","venue":null,"work_id":"13818dd1-061c-4f18-8974-63022bf37d05","year":2016},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.547449Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:1b48934c26644cb0f1e349081cf8931b630072c6511ca42a859438f0ef3d5892","observation_id":"1f26d98f-a7a7-43ee-a96a-0de2f4278872","resolution":{"observed_at":"2026-08-06T19:05:00.846509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.835084Z","title":"Focal loss for dense object detection","venue":null,"work_id":"41774032-2e7e-4e94-8b8c-193fe370d54d","year":2017},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.550000Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:7fa5f3cbc523ecd526a0ca52c36a03cc6b275ae867203b596550fbd446341379","observation_id":"d97fc928-a729-48ba-a280-71bc388f888e","resolution":{"observed_at":"2026-08-06T19:05:00.837840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.826593Z","title":"Conflict-averse gradient descent for multi-task learning","venue":null,"work_id":"b6c71cd5-5bd2-44a2-9e02-a45edfed2772","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.552464Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:e463562e2246f9b3210cea5726bc391b050c65339312050e2e6c1ea9386a0734","observation_id":"e5254a3b-4762-4671-ba70-a45b427a5d2d","resolution":{"observed_at":"2026-08-06T19:05:00.829344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.818480Z","title":"J., Kumar, V., Zhang, A., Bastani, O., and Jayaraman, D","venue":null,"work_id":"767a75bb-bf51-47f2-b5d0-a598fa1ba339","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.554800Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:d330a3c7549e89995767f6857c937593db9bf9b5c8463fc6368e71d80f40516a","observation_id":"4c6acaec-b2d7-4bcb-a432-bdec2bf8f212","resolution":{"observed_at":"2026-08-06T19:05:00.821377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.810323Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":"57b56ef6-2cf5-49f7-bb51-63521d08b960","year":2015},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.557315Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:4e4be1f58902aaddefa8e582f692f97a4c35c46af11ee022f0fafe3157831694","observation_id":"3dd173d8-373e-4d39-b443-a46a8fc53606","resolution":{"observed_at":"2026-08-06T19:05:00.812990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.801908Z","title":"R3m: a universal visual representation for robot manipulation","venue":null,"work_id":"6501750a-40ca-4024-996d-3644f4477a39","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.559705Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:0ca7e68293680a6fa1539db73e6a2f44a85ffa876e5e26e5dcf0760a4e790438","observation_id":"b8559033-9d6b-4ca7-bd63-a30d969c83a0","resolution":{"observed_at":"2026-08-06T19:05:00.804814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.793201Z","title":"Learning and retrieval from prior data for skill-based imitation learning","venue":null,"work_id":"94a585d6-1000-46d9-bd0d-dc8eacd16620","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.562105Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:768700d5700576c1ffa6f6bfc637ba47d67829e77c58a5e56244282873c041b7","observation_id":"1864ec49-063c-4c1d-bdd1-c29f0fa9ea3f","resolution":{"observed_at":"2026-08-06T19:05:00.796533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.784934Z","title":"Accelerating reinforcement learning with learned skill priors","venue":null,"work_id":"e44d1aa0-4862-4008-8cbb-59b2f08fbe41","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.564462Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:28b2b5cec3f17cff43fdb6949d98aebd5df5a3679006c05525d98394e73bc8a9","observation_id":"b7049cb4-f099-4a88-ac3d-ba329623a2ba","resolution":{"observed_at":"2026-08-06T19:05:00.788028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.775263Z","title":null,"venue":null,"work_id":"5a2cbbb8-1b96-44eb-b904-19e3af1ae9e1","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.567271Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:0b5cb7a6417f4fb0416d2ab1d44e3d5bc967624e31dcb04edfd10dbf1411a963","observation_id":"b74797b9-7046-4b18-8663-9cbd88b7ed07","resolution":{"observed_at":"2026-08-06T19:05:00.779220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.766843Z","title":null,"venue":null,"work_id":"264147df-9f74-4cde-a51a-e843026385fe","year":2014},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.569767Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:54a9a0480bdb6293271350f263cda9b634e07315328e0b0d102b06e7bbf30e6a","observation_id":"ca23bf21-1be4-4ee0-9b5f-79bdc4e1cf8d","resolution":{"observed_at":"2026-08-06T19:05:00.769602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.758830Z","title":"Hierarchical and interpretable skill acquisition in multi-task reinforcement learning","venue":null,"work_id":"ed1924ec-3b94-478e-afa2-d430a0a51c35","year":2018},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.572089Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:8f597fba9097d1d9a83763dd1834d535cc23ed8fdf7730fb09ed764fa39e4c18","observation_id":"b5c95921-1d44-409c-8238-55314c1fffd5","resolution":{"observed_at":"2026-08-06T19:05:00.761697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.749648Z","title":"Multi-task reinforcement learning with context-based representations","venue":null,"work_id":"e3985ffc-e4b1-4c1d-857a-3062f5c41f9c","year":2021},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.574384Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:108ab00e0fd495d5c9137d5436e200f5107b23655fb7884409e689bf6064a519","observation_id":"e6ea7188-ee28-4a86-b798-478dacec91c7","resolution":{"observed_at":"2026-08-06T19:05:00.753473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.741227Z","title":"MuJoCo : A physics engine for model-based control","venue":null,"work_id":"f7774ad5-dd7f-4a36-8cd2-b6dc90efb523","year":2012},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.577134Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:c4f26b8134f46a5bf0217366f84867bc3850b97573e5e5d2d198d6896b63416b","observation_id":"00fe138d-f58a-46e9-a051-b0020730a5ae","resolution":{"observed_at":"2026-08-06T19:05:00.744057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.733292Z","title":"Neural discrete representation learning","venue":null,"work_id":"71a4047e-a9a2-4c9c-b20c-38731fa6f71c","year":2017},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.579931Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:abe53e22943f1861383981294593d53e5bb81852fdccc14f94454c060eceaa29","observation_id":"26c62894-6b2b-48fd-988b-e838d4251ed3","resolution":{"observed_at":"2026-08-06T19:05:00.736236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.724941Z","title":"N., Kaiser, L","venue":null,"work_id":"5e4ac7dd-fb4e-4d72-9fa8-6d2a3be5d4c6","year":2017},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.582323Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:129864722cff2ecb15d33498540ef8a4694476b7f96086930e61cccaa1c47191","observation_id":"6f0940a5-670d-410d-be91-9bb56f876a1b","resolution":{"observed_at":"2026-08-06T19:05:00.727851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.716952Z","title":"J., and Zhou, M","venue":null,"work_id":"4027f371-6e09-4b76-8817-0abc349c2063","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.584763Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:8dcb02052cfaae9dc49a8e4e85b72a9d661d1c5d68b31a087858a93bedbd45c6","observation_id":"4ee1e941-9ff8-4d7e-8d72-a5cf7f7877a6","resolution":{"observed_at":"2026-08-06T19:05:00.719735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.708383Z","title":"Prompting decision transformer for few-shot policy generalization","venue":null,"work_id":"adb56434-7fcf-4b31-a220-c4309565e243","year":2022},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.587398Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:dca103160cae96cf720c063507cbf56d82be44669bb28d5af3b0df2cca9f612b","observation_id":"511c03bb-db4d-4703-b470-66ac6de5acfb","resolution":{"observed_at":"2026-08-06T19:05:00.711682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.699459Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":"a314bac4-fbbf-49cb-8957-a454f1d301fa","year":2023},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.589746Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:a0fd251dbe27f12708bfda783f08013bb7b5f840fe3cbf40d0bfa4bb1ee1abbb","observation_id":"66754f05-b7dd-40aa-8a18-3e0306d9223c","resolution":{"observed_at":"2026-08-06T19:05:00.702267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.691311Z","title":"Multi-task reinforcement learning with soft modularization","venue":null,"work_id":"19283053-95c6-4873-8744-b4d4e76bc617","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.592429Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:2b5d1a2a585c5ed2baad566c2a65736f1156b478d26aa47825ca730f36d7a90f","observation_id":"e9a401d2-b87d-4316-86e5-468c716586f7","resolution":{"observed_at":"2026-08-06T19:05:00.694210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.682384Z","title":"Mastering complex control in MOBA games with deep reinforcement learning","venue":null,"work_id":"ec7c6457-674a-4312-a95a-d62e20a70cab","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.594843Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:3fe49d595c9001121937e78fee0fe7ea199397b971435f9bddeb91a3b61ff1e6","observation_id":"3620bb30-baec-43ad-942b-185862b4b67c","resolution":{"observed_at":"2026-08-06T19:05:00.685346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.674124Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":"7197ae7b-af9b-461b-961c-4113989fe112","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.597176Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:f267c17a73a47cd59559d0fd7a63d43abfc52699a949f45871930284a19c9723","observation_id":"2db120dc-bcb6-48bf-84ef-5d851653a753","resolution":{"observed_at":"2026-08-06T19:05:00.676909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.663646Z","title":"Meta-World : A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"7d170754-5baa-411c-ab51-0b0693dd41ab","year":2020},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.599488Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:0cd3abc2116ab5a975dc441cf99ca60b9e68758d865fa72461a8be96d4958654","observation_id":"e6ec6746-f7cd-403b-8457-f6af026d8152","resolution":{"observed_at":"2026-08-06T19:05:00.668348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:00.601759Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T19:05:00.601759Z"},"links":{"citing_paper":"/paper/2507.06628"},"observation_digest":"sha256:e216fcf74157f7fc2abeb61ce3d3c29702e04c584586e59cba0d2ab25abee4d9","observation_id":"e139f114-5079-405d-bb0f-0cf38c201b09","resolution":{"observed_at":"2026-08-06T19:05:00.601759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06628","last_updated":"2025-07-09T07:54:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:05:07.872057Z","submitted_at":"2025-07-09T07:54:49Z","title":"Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2507.06628."}