{"as_of":"2026-08-14T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:390f233d332211bdb81d41f704477d2957a30752b6e2d05718aee117208ccdf3","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:32:07.052068Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.08911/citation-record","integrity":"/paper/2412.08911/integrity","json":"/paper/2412.08911/citation-record.json","paper":"/paper/2412.08911"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1706.05098","last_updated":"2017-06-15T21:38:12Z","snapshot_observed_at":"2026-08-13T21:53:02.384757Z","submitted_at":"2017-06-15T21:38:12Z","title":"An Overview of Multi-Task Learning in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05098","snapshot_observed_at":"2026-08-11T17:32:06.936864Z","title":"An overview of multi-task learning in deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.936864Z"},"links":{"cited_paper":"/paper/1706.05098","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:fe136e9eccb9cc856660eae76d237efd22c1507400cda29a25335a6a17d6b608","observation_id":"9c22d02d-3754-40ad-be22-80f10b87475a","resolution":{"observed_at":"2026-08-11T17:32:06.936864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.388970Z","title":"Multi-task learning as multi-objective optimization","venue":null,"work_id":"d086f5ef-179a-425d-8128-db97a25713ae","year":2018},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.941585Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:7b32d4b159c4f9b577d6dc77310636ee0bf7dc9ba24b909dce41517daef614e3","observation_id":"f3c12bac-1405-4e28-8dc2-081d7bc46a85","resolution":{"observed_at":"2026-08-11T17:32:07.393145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.377552Z","title":"A survey on multi-task learning","venue":null,"work_id":"ae9e6fa5-8246-4aca-ae19-8b69792bb06c","year":2021},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.945401Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:cdd8915f5f13843fdea15ac762901f5b8970081c98b3b3126a305a12a7c2a059","observation_id":"47d24c4c-efff-49d9-bfef-78e0662e93b1","resolution":{"observed_at":"2026-08-11T17:32:07.381404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.365755Z","title":"Modeling task relationships in multi-task learning with multi-gate mixture-of-experts","venue":null,"work_id":"92fabedb-c09c-436b-90b9-85b954536b5e","year":1930},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.949617Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:8eb4509bd383525da8a0cd1a14dc4c3719f2f7166f408d0b21d38e66eed43421","observation_id":"3c3c8c00-7a99-48fa-85c6-5d895e1dbfbc","resolution":{"observed_at":"2026-08-11T17:32:07.370160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.953779Z","title":"End-to-end multi-task learning with attention","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.953779Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:d0fb0e64f16287457feca6ff61ec6d26fb44295e29bc6d12643562f028792e5b","observation_id":"ef40fd43-3394-474b-99f8-5bb9570fe44f","resolution":{"observed_at":"2026-08-11T17:32:06.953779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.957994Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.957994Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:1e4386b32a45740b1a80125ebdc63e2c509475afed72ed44616cba25468f449b","observation_id":"29e6991b-7104-4b51-99c1-abc820cfb8ea","resolution":{"observed_at":"2026-08-11T17:32:06.957994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.340083Z","title":"A pareto-efficient algorithm for multiple objective optimization in e-commerce recommendation","venue":null,"work_id":"912e8da6-6152-44aa-a8ed-0203bd6d9116","year":2019},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.962098Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:dea38de9aa9644de4e03f0a60fc69ede81a50610905876283dc361907ba879b4","observation_id":"ec34560b-1c45-4c1e-8c84-11b8074b8685","resolution":{"observed_at":"2026-08-11T17:32:07.344047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.04478","last_updated":"2022-02-14T04:26:50Z","snapshot_observed_at":"2026-08-13T16:44:12.903413Z","submitted_at":"2022-02-09T14:17:05Z","title":"Rethinking Goal-conditioned Supervised Learning and Its Connection to Offline RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.04478","snapshot_observed_at":"2026-08-11T17:32:06.965689Z","title":"Rethinking goal-conditioned supervised learning and its connection to offline rl","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.965689Z"},"links":{"cited_paper":"/paper/2202.04478","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:a8875e1d5ee85f11991bf060d4d19e0f4fbd8b592f1ace4f813c453cd651c4cd","observation_id":"5ca147e6-54b6-4e09-97a1-21436fb522ef","resolution":{"observed_at":"2026-08-11T17:32:06.965689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08299","last_updated":"2022-09-02T10:46:40Z","snapshot_observed_at":"2026-08-13T16:55:37.923698Z","submitted_at":"2022-01-20T17:06:42Z","title":"Goal-Conditioned Reinforcement Learning: Problems and Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08299","snapshot_observed_at":"2026-08-11T17:32:06.969586Z","title":"Goal-conditioned reinforcement learning: Problems and solutions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.969586Z"},"links":{"cited_paper":"/paper/2201.08299","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:83ffbb4c9823ad57d080ab42ea9b8793c3838f6d40d49dc1119585db5e8c6dc4","observation_id":"3da55db4-9c97-4bda-94d3-71279520a723","resolution":{"observed_at":"2026-08-11T17:32:06.969586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.973352Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.973352Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:a9c973b42bc1da3df04a5adbf4449d43ff6783101e4273dd2d482932ecb75c1e","observation_id":"e3003b99-0289-46c5-801b-1e41b7b9003a","resolution":{"observed_at":"2026-08-11T17:32:06.973352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.321838Z","title":"Rethinking reinforcement learning for recommendation: A prompt per- spective","venue":null,"work_id":"fca61e3d-8c36-4cae-a51d-1c99cf5e4e6e","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.977397Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:57f009adbdb9d44425844f529c4d4f591060507e559d3e2abb59e484455646c6","observation_id":"9f7a887b-d3d3-48be-b8c6-b091466573d9","resolution":{"observed_at":"2026-08-11T17:32:07.326470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.310411Z","title":"Cross-stitch networks for multi-task learning","venue":null,"work_id":"9e253ba1-c7c0-4872-962e-83fd55201541","year":2016},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.981022Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:0ae61ec6d0ea9c00f69ebe514db308b22e18d6718bf900d765ff4dac64981e5a","observation_id":"4e94d1af-4814-4f52-aa7d-32d559637e33","resolution":{"observed_at":"2026-08-11T17:32:07.314406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.299026Z","title":"Famo: Fast adaptive multitask optimization","venue":null,"work_id":"03e44d1d-e241-4e7c-ad83-db45509e705d","year":2024},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.984442Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:357f0033478c35ff936ebbd5441065892355cb174820282a11edb01ba3b02344","observation_id":"d31fb4a2-cd14-460c-83b9-56fdbc037582","resolution":{"observed_at":"2026-08-11T17:32:07.302821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.987847Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.987847Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:5722dc95866f07091f39b1bd5aa67631cf988f728fef1a87174d6949f8577cde","observation_id":"e19777a6-c71c-41cc-ae18-33eb84674f5d","resolution":{"observed_at":"2026-08-11T17:32:06.987847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.280811Z","title":"Online decision transformer","venue":null,"work_id":"dec53745-e3d8-4ca0-9f08-2da240e710c6","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.991343Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:53da3cc8cc880c2349d2c0749108206a1632e5b9c318c8a78326b9cb5262359b","observation_id":"ecc57f5f-9a57-47a3-9722-a6dfbfcc1698","resolution":{"observed_at":"2026-08-11T17:32:07.284507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-13T21:13:28.274879Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-11T17:32:06.994818Z","title":"Opal: Of- fline primitive discovery for accelerating offline reinforcement learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.994818Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:1c8e9a47c165b8f3eb004bf27e148c79bff9346fc17556ed1f342b16e0f7ea33","observation_id":"0d6edf85-53ae-4327-bf2b-0235d61acc91","resolution":{"observed_at":"2026-08-11T17:32:06.994818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.998552Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.998552Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:cc62abd85cb5d7dd8757e03ca30fb896c06f6f1e71321fd36a5301a99afbad53","observation_id":"69a6064c-91e9-4a44-9818-ff69b12f4165","resolution":{"observed_at":"2026-08-11T17:32:06.998552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08740","last_updated":"2024-06-02T10:15:53Z","snapshot_observed_at":"2026-08-13T00:07:50.738471Z","submitted_at":"2024-05-14T16:30:03Z","title":"Reinformer: Max-Return Sequence Modeling for Offline RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08740","snapshot_observed_at":"2026-08-11T17:32:07.002583Z","title":"Reinformer: Max-return sequence modeling for offline rl","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.002583Z"},"links":{"cited_paper":"/paper/2405.08740","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:96c1c42cc6c9bcb05afc5f10ac44d0019208dfb084b7809887db9e45fad853e1","observation_id":"b61b5177-3c07-4603-95da-53f3ec4b5ae5","resolution":{"observed_at":"2026-08-11T17:32:07.002583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13248","last_updated":"2022-05-26T09:36:20Z","snapshot_observed_at":"2026-08-13T15:36:07.682244Z","submitted_at":"2022-05-26T09:36:20Z","title":"Constrained Reinforcement Learning for Short Video Recommendation","version":1},"cited_work":{"arxiv_id":"2205.13248","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.13248","snapshot_observed_at":"2026-08-11T17:32:07.115935Z","title":"Constrained Reinforcement Learning for Short Video Recommendation","venue":"cs.LG","work_id":"f4707e46-0fd0-4f91-bab1-b07c78b15d9b","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.006351Z"},"links":{"cited_paper":"/paper/2205.13248","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:356d5240fc779fa545195bbec0c6a09ae89e1154312cceba825a00b7ebb79763","observation_id":"f6a4aac2-ce35-4c41-a21f-134a92b6932d","resolution":{"observed_at":"2026-08-11T17:32:07.122150Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.263200Z","title":"Choosing the best of both worlds: Diverse and novel recommendations through multi-objective reinforcement learning","venue":null,"work_id":"2c8272d3-a829-441f-861d-c9ade6ee2aa9","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.010676Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:c9f3dde739d0873c259b5d907d2d4a7c6ed603ad9b973704fb59eaeca0635f2e","observation_id":"602e5f06-1bde-4b51-91ed-c301ca570a7b","resolution":{"observed_at":"2026-08-11T17:32:07.266804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.252933Z","title":"A survey of multi-objective sequential decision-making","venue":null,"work_id":"470d05bb-cea3-45dc-a931-1da374a07d8a","year":2013},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.014018Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:79064525758f35e989cd85cad8812628a41f863f70580eed443d68659c9daa91","observation_id":"a4c3179c-7bb8-4422-b8e2-95c5fa8281a0","resolution":{"observed_at":"2026-08-11T17:32:07.256280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.017623Z","title":"Self-attentive sequential recommendation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.017623Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:09ec7f544c72140bf6200f02cf0689f6d36e5909172a42a32ad20cf42e21aafe","observation_id":"fd110922-2c9e-47bb-9f2a-3b460ba6c128","resolution":{"observed_at":"2026-08-11T17:32:07.017623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.233275Z","title":"Strec: Sparse transformer for sequential recommendations","venue":null,"work_id":"2450215b-264c-4d46-b3f5-33b2ee7b06ac","year":2023},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.021140Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:f9ef4ef0fc20da1ac6823cf2dfb799100ff09640b16df7597b88e847173b6ac3","observation_id":"17c3c0a4-f595-4a19-8269-d9509c12b14b","resolution":{"observed_at":"2026-08-11T17:32:07.237519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-08-12T18:51:00.108451Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-11T17:32:07.024760Z","title":"Conditional generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.024760Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:4a06a5565ccb35ca6109a227bb92a94a61a2c8efd9985810ea8cfb629dbb00aa","observation_id":"e9c5eaed-eeea-401f-911c-62b76054fcbc","resolution":{"observed_at":"2026-08-11T17:32:07.024760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T17:32:07.028753Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.028753Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:f43eefae8fd0e8b2b5d215c7d2c91f59346b943ba86ccb4f68d886e627224b50","observation_id":"433845f8-1404-4bb2-a294-b3e7879299bf","resolution":{"observed_at":"2026-08-11T17:32:07.028753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.032868Z","title":"Learning structured output representation using deep conditional generative models","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.032868Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:4f0cb9d8e47600738db6d05aef44f2f43209cc316fc43d204ffebe1697c4a75b","observation_id":"de5fd350-deb5-460c-8802-82377e1790ea","resolution":{"observed_at":"2026-08-11T17:32:07.032868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.214653Z","title":"Multi-objective optimization for long tail recommendation","venue":null,"work_id":"07d0ec90-5cfe-4b18-b803-3ddf5473ff51","year":2016},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.036676Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:ced298855f76818f5d0795fd3ab626574cc00a5676deb4a9f60aa10f29958554","observation_id":"b6f2e1a9-4ef1-47be-b907-1fe029cdf34d","resolution":{"observed_at":"2026-08-11T17:32:07.218933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.202299Z","title":"Self-supervised reinforcement learning for recommender systems","venue":null,"work_id":"b0785268-b958-46ec-a190-6970792c6d45","year":2020},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.040519Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:49b6ae11f808483a7586bcdf1f3bad525d4c1a77e614708bce98e64314eb475b","observation_id":"dc528a4b-5c95-481b-a5c9-d99ced8527e9","resolution":{"observed_at":"2026-08-11T17:32:07.206312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.044156Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.044156Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:c8f8e9faa758fefe04cf30739111b663cd1eb904bf4490f12c8423ed3c02fe7a","observation_id":"5a9e2eeb-0e75-4359-ab7b-ba7f913a0430","resolution":{"observed_at":"2026-08-11T17:32:07.044156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06939","last_updated":"2016-03-29T14:52:58Z","snapshot_observed_at":"2026-07-31T19:00:00.136727Z","submitted_at":"2015-11-21T23:42:59Z","title":"Session-based Recommendations with Recurrent Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06939","snapshot_observed_at":"2026-08-11T17:32:07.048025Z","title":"Session-based recommendations with recurrent neural networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.048025Z"},"links":{"cited_paper":"/paper/1511.06939","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:9b48e81bcdd0672a1d8519b9e8d6b305a6f096774d6b3f78e06eef47b71e6899","observation_id":"ad1e9d07-b190-4982-83bf-5112c493a654","resolution":{"observed_at":"2026-08-11T17:32:07.048025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.182543Z","title":"Tenrec: A large-scale multipurpose benchmark dataset for rec- ommender systems","venue":null,"work_id":"7686c946-1acb-4e96-88a1-d4e94513ef8d","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.052068Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:9f1cdf416cbca673d69ce3bcb67f4b458487c70cfbf489ad667362c6227cfc20","observation_id":"35527f8a-0d17-4298-84b8-9ea14b2b4cd4","resolution":{"observed_at":"2026-08-11T17:32:07.186823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2412.08911."}