{"as_of":"2026-08-18T00:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60b543fad74ebfb27648a195b5f8e853a9cfca4e1bfcb9e86a6f99ae55a6a687","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:42:21.787743Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16590/citation-record","integrity":"/paper/2506.16590/integrity","json":"/paper/2506.16590/citation-record.json","paper":"/paper/2506.16590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.079181Z","title":"Hindsight experience replay.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.079181Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:a349afcfbd0a860556682f7aca4dc9e7508d30bc162d4fd480c05036b14f54b2","observation_id":"5113ad28-9e89-44f7-9197-0fd91d4ee080","resolution":{"observed_at":"2026-08-06T23:42:20.079181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.172706Z","title":"Deep reinforcement learning: A brief survey.IEEE Signal Processing Magazine, 34(6):26–38, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.172706Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:10a3f15d2f4edfc3a8a416540e3bbe8b9413e626c508d6bb34c8a6d04d206ab7","observation_id":"ca7c705d-8b26-4a63-8dfc-2054ddb56fa4","resolution":{"observed_at":"2026-08-06T23:42:20.172706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.320206Z","title":"Torchrl: A data-driven decision-making library for pytorch, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.320206Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:77e8a9fb1f74538ff9976fef5b98ac480e5a84b11b4fd9c4f704a48a88aa0458","observation_id":"cac52097-ca97-4204-a126-8911a88173a2","resolution":{"observed_at":"2026-08-06T23:42:20.320206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.084334Z","title":"Policy transfer using reward shaping","venue":null,"work_id":"7707c569-75d6-4393-90d2-a9fdaa3234f1","year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.398123Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:7b6f3679096dcbb514a7c0f670ef09f1ac31b91d5f2e29aa3f534ea458aa5eea","observation_id":"008bc80b-c5c8-4682-819a-83d7c953d267","resolution":{"observed_at":"2026-08-06T23:42:22.088060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.073755Z","title":"Introspective action advising for interpretable transfer learning","venue":null,"work_id":"a05261e5-4dfc-46ad-9dde-a8cdbcf89875","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.456642Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:9f3f4b3e7dbd8d17fee30c8ccee838d8987f63c89f24f54cd89ff77239c4a82f","observation_id":"6e48e6d6-017d-4a58-a348-191c43078aef","resolution":{"observed_at":"2026-08-06T23:42:22.076920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.514972Z","title":"On the utility of learning about humans for human-ai coordination.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.514972Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:25ac80d55a451009401a0d6c65ee67d80f20d6c4a5df7cf0bf198f00e8f7b162","observation_id":"05fced0e-2742-4d85-8fb1-b2ae41dd85b4","resolution":{"observed_at":"2026-08-06T23:42:20.514972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.603489Z","title":"Minigrid & miniworld: Modular & customizable reinforcement learning environments for goal-oriented tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.603489Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:ea438b7afacab63a5edba554c94c79f3b1ebed45a988e11e0cb9990db2608ba7","observation_id":"b2ce6f32-3ac9-44e1-aa5d-c70fe05a013d","resolution":{"observed_at":"2026-08-06T23:42:20.603489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.051389Z","title":"Explainable action advising for multi-agent reinforcement learning","venue":null,"work_id":"b82b7cb0-752e-437e-9d9a-acfaa8fa562a","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.685516Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:8f526a7059da98686f1547832a1fdb253118aa7eacf6593a848f6238d5dc030f","observation_id":"59b7320d-e1d1-4a40-960b-c78d45b4a243","resolution":{"observed_at":"2026-08-06T23:42:22.056322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.042258Z","title":null,"venue":null,"work_id":"33c92e84-f4d4-4c81-8856-5542e491b9ba","year":null},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.762980Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:739091d99a3293f99d51125acd027cbea907fa152bad6d261fb86124c5197fc3","observation_id":"a05a8e98-8702-47a5-9a09-f5cb650007e5","resolution":{"observed_at":"2026-08-06T23:42:22.044950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.882797Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.882797Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:3159a40c9acd78aa05fc122ae64212831c9c076de4bc2b0fdef79f365c5db3b4","observation_id":"cd113b0a-7a06-4315-b4ad-762c75c3fc03","resolution":{"observed_at":"2026-08-06T23:42:20.882797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.017191Z","title":"Expressing arbitrary reward functions as potential-based advice","venue":null,"work_id":"16a6b6fc-c61f-467c-92cd-5156faa21bc8","year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.043790Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:c395351e9716ee1b70534ca93cd5864704d8d6e2e99862699810ef13879c004c","observation_id":"09ad223d-c11d-4173-af9c-1841939870ce","resolution":{"observed_at":"2026-08-06T23:42:22.020642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02136","last_updated":"2018-10-03T07:32:57Z","snapshot_observed_at":"2026-08-02T06:41:33.803920Z","submitted_at":"2016-10-07T04:06:01Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02136","snapshot_observed_at":"2026-08-06T23:42:21.117919Z","title":"A baseline for detecting misclassified and out-of-distribution examples in neural networks.arXiv preprint arXiv:1610.02136, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.117919Z"},"links":{"cited_paper":"/paper/1610.02136","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:515e8d40fe5cd08ff7a7f7549d2ce2cac73476231e1347a2108f51abb92228a1","observation_id":"57fdacab-3d40-409c-8153-09a9eed7e5f1","resolution":{"observed_at":"2026-08-06T23:42:21.117919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.007240Z","title":"Transferring policy of deep reinforcement learning from simulation to reality for robotics.Nature Machine Intelligence, 4(12):1077–1087, 2022","venue":null,"work_id":"a37d27b8-9533-4c0e-a7d2-1fbfa649b3e4","year":2022},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.220530Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:7c2ce3c7686a0098105947139eebb9351149ef104561be771a92c863b933f611","observation_id":"07477bb6-396d-4878-8f70-86181eb15b77","resolution":{"observed_at":"2026-08-06T23:42:22.010697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.299372Z","title":"A tutorial on energy-based learning.Predicting structured data, 1(0), 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.299372Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:34ba08db255bb1a029e9ffc0eca111d54de8c26e6a06fdb38b81ac558bff15b3","observation_id":"de92af93-cdd2-4882-b7df-b9b0974a7333","resolution":{"observed_at":"2026-08-06T23:42:21.299372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-08-15T10:58:31.329286Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-06T23:42:21.371387Z","title":"Deep reinforcement learning: An overview.arXiv preprint arXiv:1701.07274, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.371387Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:c58a79dc29c38a81809c8760b4bde787dc1fd38a89fb6932e88711b79f53c183","observation_id":"74ac0f85-b374-45fa-b604-3cfa1a4d53ae","resolution":{"observed_at":"2026-08-06T23:42:21.371387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.984877Z","title":"Energy-based out-of-distribution detection.Advances in neural information processing systems, 33:21464–21475, 2020","venue":null,"work_id":"7ba1e267-479f-455c-85ad-3434a6f87f30","year":2020},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.504756Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:8ba05b9dfb6d81b3d6c32d36f6557680e0a869d7d33966381e2e1fa83ffde269","observation_id":"622f3abe-85ee-4e1d-adfb-8c647beb3744","resolution":{"observed_at":"2026-08-06T23:42:21.995051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.973185Z","title":"Characterizing out-of-distribution error via optimal transport.Advances in Neural Information Processing Systems, 36:17602–17622, 2023","venue":null,"work_id":"498bcc68-6c5a-4d30-8132-24936ee28ef4","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.564552Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:b09eeb10a13a47b8be0df8d5b6a9a4f821734fb65ef9e6ab3e3eb9de40ed6a65","observation_id":"d71c0968-6e0d-4cf1-880a-2f5df971e0b9","resolution":{"observed_at":"2026-08-06T23:42:21.976955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.963007Z","title":"University of Wisconsin-Madison","venue":null,"work_id":"534da7db-7272-49cf-9829-c58971c45ca7","year":1994},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.584751Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:6075e2f079b560c1a4d72f8c59be08901e4abf0f900aade5c57c8526d20c4e95","observation_id":"c4ed34d0-b365-4b70-b077-2a68124e78a8","resolution":{"observed_at":"2026-08-06T23:42:21.966387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.722555Z","title":"Policy invariance under reward transforma- tions: Theory and application to reward shaping","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.722555Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:d93323753fccc0ab129d916749c19a30a2892240fa3608acc9d8686d69dbe816","observation_id":"62208f8b-b58f-4ec4-851c-e704ec580428","resolution":{"observed_at":"2026-08-06T23:42:21.722555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.945590Z","title":"Deep neural networks are easily fooled: High confidence predictions for unrecognizable images","venue":null,"work_id":"b82ec3fd-5680-4103-88dc-50a4ac41a52a","year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.746635Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:3a376f487412d9e760f808ef3efc6d86660a974283efa6a25d01f0e4d93bf2d8","observation_id":"aaa8590f-e92e-4dd0-8584-8a37a2104733","resolution":{"observed_at":"2026-08-06T23:42:21.949324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.935094Z","title":"Transfer learning and fine- tuned transfer learning methods’ effectiveness analyse in the cnn-based deep learning models","venue":null,"work_id":"eb59bcfb-3755-4f07-9f94-a3c701870b39","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.749668Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:e38ac5ba507b49ba12eaf6a968a7761902d229f1458c8b371e777aeee5bc3462","observation_id":"5f1562ae-b514-4585-9b3b-fe5ce35ba953","resolution":{"observed_at":"2026-08-06T23:42:21.939727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04664","last_updated":"2020-05-28T20:51:40Z","snapshot_observed_at":"2026-08-09T01:09:42.786424Z","submitted_at":"2020-03-10T12:38:31Z","title":"Automatic Curriculum Learning For Deep RL: A Short Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04664","snapshot_observed_at":"2026-08-06T23:42:21.752276Z","title":"Au- tomatic curriculum learning for deep rl: A short survey.arXiv preprint arXiv:2003.04664, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.752276Z"},"links":{"cited_paper":"/paper/2003.04664","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:69d64f8bc6bc1acfac61818e0f553fa598b0335286b54dded8474a54c32c6f14","observation_id":"7fae3eea-146a-459e-b94a-773036c72f49","resolution":{"observed_at":"2026-08-06T23:42:21.752276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.925519Z","title":"Likelihood ratios for out-of-distribution detection.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"70c72fbc-3bc9-4d32-811f-c056c977daa1","year":2019},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.755646Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:b513169927ac63c32cfba26c5a4639c69796ed9494ef3b686a47abe4db26dbdc","observation_id":"66f54886-a0f0-4295-a22f-3c375323c52c","resolution":{"observed_at":"2026-08-06T23:42:21.929000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-08-18T00:03:21.764059Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-06T23:42:21.758615Z","title":"Policy distillation.arXiv preprint arXiv:1511.06295, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.758615Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:1b6f333d50e7e8f5f653b16188392ef4a623fe08e4e73d44d106d6b38bfdbf30","observation_id":"47b47bf6-2a53-40c5-af74-0a635efaa990","resolution":{"observed_at":"2026-08-06T23:42:21.758615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03835","last_updated":"2018-03-10T16:45:00Z","snapshot_observed_at":"2026-08-14T19:37:32.915923Z","submitted_at":"2018-03-10T16:45:00Z","title":"Kickstarting Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03835","snapshot_observed_at":"2026-08-06T23:42:21.762144Z","title":"Kickstarting deep reinforcement learning.arXiv preprint arXiv:1803.03835, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.762144Z"},"links":{"cited_paper":"/paper/1803.03835","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:93f7e1addcf73f2cd314f021fc7fec21da60de6d2091ef207f1b3ca98f39c0d0","observation_id":"0c28a6a4-bf45-4af6-8a3d-eac8f7dd2c37","resolution":{"observed_at":"2026-08-06T23:42:21.762144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.765683Z","title":"MIT press Cambridge, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.765683Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:bf47c8c7d36308edcefc17b2668d70b20c7b0ec4d71c8bd997d4e182187e8047","observation_id":"1ba6e15f-a06e-40dc-b3e4-ab6d56db54a8","resolution":{"observed_at":"2026-08-06T23:42:21.765683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.770399Z","title":"Transfer learning for reinforcement learning domains: A survey.Journal of Machine Learning Research, 10(7), 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.770399Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:36393a89839961d43ef9036dcc0ef82af33600f29894fdb24e08c218f1ed3ac6","observation_id":"8b0e84c2-564b-48f7-8544-a0432105b2c3","resolution":{"observed_at":"2026-08-06T23:42:21.770399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.903433Z","title":"Teaching on a budget: Agents advising agents in reinforcement learning","venue":null,"work_id":"9f0e9fc2-061a-4362-9bd9-93f8485f3728","year":2013},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.773775Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:15467abd07d57df6995652118a15be2be84f7da0d4c2f81c8c5d899dc27dc5d1","observation_id":"c0890ec2-33a9-4e8c-aea3-63bdb4774db8","resolution":{"observed_at":"2026-08-06T23:42:21.908147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.893484Z","title":"Jump-start reinforcement learning","venue":null,"work_id":"65d9c028-635c-4d40-821d-f855a6a314fb","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.777168Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:cbd58c3fa271d7d12f6b58fd0670ceddb94e27ac00a960060bd14e0fc65af704","observation_id":"210e6868-b91a-46e5-b6d3-1de8433cd77f","resolution":{"observed_at":"2026-08-06T23:42:21.897273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.884100Z","title":"A survey of transfer learning.Journal of Big data, 3:1–40, 2016","venue":null,"work_id":"0a8f3198-1b90-469e-8d4f-202528b232bf","year":2016},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.779630Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:f8e12ce1ea69f131585b81f8074e9614c5d29ae67a4f52bed5b12f572ac930da","observation_id":"f5e207f1-3904-461b-b4b6-7efc8d64dcf1","resolution":{"observed_at":"2026-08-06T23:42:21.887793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.782318Z","title":"Generalized out-of-distribution detection: A survey.International Journal of Computer Vision, 132(12):5635–5662, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.782318Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:a1f2d589b3fdb665ea54a7f0e1102be097149618fe3fa8efb3370d724e3c3724","observation_id":"321fba6f-a874-4e8c-a89b-5b1d588a02cf","resolution":{"observed_at":"2026-08-06T23:42:21.782318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.785030Z","title":"How transferable are features in deep neural networks?Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.785030Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:2e6ee3f9f0ad070894331364f8672fa1036f1d15c8985913c3c6f1db62df0f1f","observation_id":"ce346e79-d1dc-44aa-b7d7-c56bfd72f93e","resolution":{"observed_at":"2026-08-06T23:42:21.785030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.859913Z","title":"Transfer learning in deep reinforce- ment learning: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45 (11):13344–13362, 2023","venue":null,"work_id":"38082480-62bb-495d-87e1-4ed532eabeef","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.787743Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:2d3e29ee6fc0e6539f8c92c6ee3665a5d1094043a9e68fdd66596b0e41e923ec","observation_id":"94a97d4b-e979-4da2-8dc9-8ec0f67164c0","resolution":{"observed_at":"2026-08-06T23:42:21.866507Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.032745Z","title":"URL https://proceedings.mlr.press/v274/guo25a","venue":null,"work_id":"854f614f-a90d-433f-8f8f-a2f0407a71ab","year":2025},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":267,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.817071Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:ba2e61b013886d5e96d400df6607f1e9d1c15855509fadde16ccbb1cd7082210","observation_id":"b492e458-1530-4d01-9fcf-e35719ccad39","resolution":{"observed_at":"2026-08-06T23:42:22.036378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T23:32:20.420955Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2506.16590."}