{"as_of":"2026-08-16T02:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b19daea30d8f480e8197cd6272e193ca4952566f24b8dd074d6c36c5b2075cad","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:56:22.583071Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:33:04.174258Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06773","snapshot_observed_at":"2026-08-03T03:33:04.174258Z","title":"URL https: //doi.org/10.1609/aaai.v38i11.29148","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.07764","last_updated":"2026-07-10T14:03:51Z","snapshot_observed_at":"2026-08-15T12:07:39.942602Z","submitted_at":"2026-02-08T01:45:01Z","title":"Preference Conditioned Multi-Objective Reinforcement Learning: Decomposed, Diversity-Driven Policy Optimization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T03:33:04.174258Z"},"links":{"cited_paper":"/paper/2501.06773","citing_paper":"/paper/2602.07764"},"observation_digest":"sha256:f6ec96fb9df14347e710601383444f0e1f3ff79f79147ba2ebd28b0fd76a640a","observation_id":"d017fcf7-0138-492d-9d84-c2e46d78296a","resolution":{"observed_at":"2026-08-03T03:33:04.174258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.06773/citation-record","integrity":"/paper/2501.06773/integrity","json":"/paper/2501.06773/citation-record.json","paper":"/paper/2501.06773"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.349905Z","title":null,"venue":null,"work_id":"2835f659-5e44-4679-b2b4-08f846a59cbb","year":2020},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.326968Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:d1d84d348d64ad9bac7680ba40a4158384a83978b52bab7ecab1d7fd0cfbbb2a","observation_id":"7c170187-b999-46ad-845e-004d0d04b3b4","resolution":{"observed_at":"2026-08-10T20:56:23.354826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.335473Z","title":"M.; Lenaerts, T.; Nowé, A.; and Steckelmacher, D","venue":null,"work_id":"849b0585-04c3-4ffb-bf72-dec8ac480f7d","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.332086Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:95944538766ed106ff4d31f16231c176523d04bf0c982a5f0f23d6fa51884a58","observation_id":"7ff44b2f-c219-4b1d-a89d-2630e082a15d","resolution":{"observed_at":"2026-08-10T20:56:23.340390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-10T20:56:22.338020Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.338020Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:a56f6b8eee6c04cc08dc5599d8d2bb46f46d68100aa25b5fccefeef3feda34c2","observation_id":"33a87856-2b12-4f8b-b909-f707518ed391","resolution":{"observed_at":"2026-08-10T20:56:22.338020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.323390Z","title":null,"venue":null,"work_id":"6c678439-9b86-471e-aaf1-1151e5a1a194","year":2017},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.343977Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:48440991a2fc4ba3abe1e7be22db37158f527be75448bb6f86f6cc3bcde4b1fa","observation_id":"62d504c8-1da1-46f4-be6c-eda9ac82361d","resolution":{"observed_at":"2026-08-10T20:56:23.327313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.312021Z","title":"B.; and Trabelsi, W","venue":null,"work_id":"be387087-bf34-4eeb-9a3c-a956ddc09ef6","year":2018},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.348075Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:08277bb6de8f2d3292d22f373a94e1e7474a744e56a4dba8330481bc0a2a541a","observation_id":"6ea8b713-7e80-4e32-9b0e-b2520121b8e9","resolution":{"observed_at":"2026-08-10T20:56:23.316020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.300017Z","title":null,"venue":null,"work_id":"fdd9bac1-bc86-4945-9107-5e856ba68682","year":2023},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.352580Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:130a424828f97826932de1a77732d9a9027e419233fc173f29791d5527910af7","observation_id":"d16c013a-8ee7-4f80-8687-0ea9a50e18a0","resolution":{"observed_at":"2026-08-10T20:56:23.303942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.289605Z","title":null,"venue":null,"work_id":"66e90011-6fde-4878-ac91-4cb04410e03f","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.357810Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:fb1080234b0b8c7d835ff5f25a04e041f7bfc95a69aed544dfd4a6ce26da629b","observation_id":"19cb85e8-3796-40cf-97c5-835aa398adbb","resolution":{"observed_at":"2026-08-10T20:56:23.293371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.278338Z","title":null,"venue":null,"work_id":"abf7b759-505b-4504-964e-df8a24613020","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.361754Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:09b64c281a7faf5167a283ceeaf65ff17d0952c01a60a820b39815c23f4da7e5","observation_id":"9d7cda0d-7827-4252-b014-b351a4407eeb","resolution":{"observed_at":"2026-08-10T20:56:23.282429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.267013Z","title":null,"venue":null,"work_id":"35a55fa1-3143-4060-a67b-6b7b828307ce","year":2018},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.366042Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:689cccf3ede76e15c57adf9b57cc12e1c4ef48810c611f981a6c1de8be97b3e5","observation_id":"6ee08f2b-168c-4188-9bcf-c861cb722293","resolution":{"observed_at":"2026-08-10T20:56:23.270836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.255041Z","title":null,"venue":null,"work_id":"ae80ff5e-d96e-43ab-aae0-3cc435899e0e","year":2018},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.370196Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:437bd79ce9390fd1d8623ab6ffe02539e3011cca3f639c052829ab1ce4378517","observation_id":"edef3e22-886d-4adf-ae96-01ff06ed6b75","resolution":{"observed_at":"2026-08-10T20:56:23.259148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.242143Z","title":null,"venue":null,"work_id":"680b2942-61bf-4572-903a-18582d5d3060","year":2018},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.374631Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:4c335ee3bbfa355d2f8bc042256a4da997c15292cdf67dcecffd04c84da5ab5b","observation_id":"bc5dc1c9-acc0-4adb-b701-1c274a6e91f2","resolution":{"observed_at":"2026-08-10T20:56:23.246541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.229616Z","title":"D., David; and Le, Q","venue":null,"work_id":"e270839b-aaf7-4684-bbaa-8da961950e5b","year":2017},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.378993Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:18f40ed3785535e202f3626564107d9c4e2a25a9dffc5bb29bf1dd6595bfb5bf","observation_id":"7380fc94-09e5-40d7-82a2-cdc713a6fed3","resolution":{"observed_at":"2026-08-10T20:56:23.233904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.216285Z","title":"a llstr \\","venue":null,"work_id":"2b6f9188-8a52-426d-b783-2f12705103d1","year":2022},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.383753Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:e189ef0ed767de63234e6d58b522426478648c9ea1b13fb478e3388fc4a0d12a","observation_id":"3022d7fd-8e41-4f11-892f-a1a79875f89f","resolution":{"observed_at":"2026-08-10T20:56:23.220556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.203827Z","title":null,"venue":null,"work_id":"85be3108-677c-4e4f-96be-4a683b10749e","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.388550Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:172250ef03aaefa1632101e6a570b5514c90650faf3056f6b8148bf103e34629","observation_id":"c9926e23-27b7-4bdb-8f54-a3b7a8318cdd","resolution":{"observed_at":"2026-08-10T20:56:23.207873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.189535Z","title":"C.; Hern \\'a ndez-Garc a, A.; Rector-Brooks, J.; Bengio, Y.; Miret, S.; and Bengio, E","venue":null,"work_id":"d58cc89a-ceac-4b68-aba2-1f07f635afcb","year":2023},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.393056Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:a6cb6ecd1c55a5b744c86dc50b8e443c42e80aebb6a08ddff0bfa33e975649f3","observation_id":"9176d917-9726-4850-a361-fc406ad331c3","resolution":{"observed_at":"2026-08-10T20:56:23.195108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.176448Z","title":null,"venue":null,"work_id":"8f2fa56e-c384-4fac-b6ea-27df69282bf8","year":2022},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.397701Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:c39e914f356f895956db5d16f6ec06eefc94c3b448415971172dbc4cffb545ce","observation_id":"28c8428c-1bf2-49a8-9ea9-6e1b9a0185b3","resolution":{"observed_at":"2026-08-10T20:56:23.180695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.06313","last_updated":"2021-02-15T02:14:57Z","snapshot_observed_at":"2026-08-14T00:37:15.704754Z","submitted_at":"2020-10-13T11:53:55Z","title":"Controllable Pareto Multi-Task Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.06313","snapshot_observed_at":"2026-08-10T20:56:22.403519Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.403519Z"},"links":{"cited_paper":"/paper/2010.06313","citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:f5325391575a3daebe819787d449689a4a02a0d4d58f548e79aacc2d83043883","observation_id":"df4872be-37b5-4cbb-a5ab-c90764f9a792","resolution":{"observed_at":"2026-08-10T20:56:22.403519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.162634Z","title":null,"venue":null,"work_id":"16da9bcd-9ecd-47c4-a72f-f9de1dd8779b","year":2022},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.408823Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:5a76ca12408218f13c319d01649f7f8d8ccf955419389abff0ac83fc84f9c6b9","observation_id":"b354da66-67a3-4fb3-b844-122ca00f2ae2","resolution":{"observed_at":"2026-08-10T20:56:23.167123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.147189Z","title":null,"venue":null,"work_id":"c26ddfe3-d5ad-4d34-b2b7-a95fa37aa76c","year":2021},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.414115Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:3eb167ce638bd3968d0dd699a60c240a6e5549dad1e7d96bb3e87b1c756166bb","observation_id":"d43118bb-064c-4aec-8f8e-efddf4c1228e","resolution":{"observed_at":"2026-08-10T20:56:23.152233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.133117Z","title":null,"venue":null,"work_id":"5fa04821-1f0a-41c9-8dec-6656f2e18232","year":2024},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.419282Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:132b46b8b9d3d68a5343214d98a5053c5297205c3a097c5de0c2cb6c454c83fc","observation_id":"14fa8234-63ff-4ea6-8c98-bd47d962499c","resolution":{"observed_at":"2026-08-10T20:56:23.137696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.120091Z","title":null,"venue":null,"work_id":"21cd45f1-51c8-411e-8def-3380a5970f40","year":2001},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.424080Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:cddf204d0ee4a06058062645cfb15396f49387e8d7db17ed49b1e3dd13be97e5","observation_id":"e3f3c858-d53f-46da-93c8-9e3ba1fb4184","resolution":{"observed_at":"2026-08-10T20:56:23.124247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.429737Z","title":"A.; Veness, J.; Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.429737Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:988e00a736ae3173e24c029419ceb3e6bd3f7011ae5ac5a59dd078fdc8437e1d","observation_id":"b79972ad-0133-4d38-b745-411587a4f213","resolution":{"observed_at":"2026-08-10T20:56:22.429737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02707","last_updated":"2016-10-09T19:08:36Z","snapshot_observed_at":"2026-08-14T21:36:02.227068Z","submitted_at":"2016-10-09T19:08:36Z","title":"Multi-Objective Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02707","snapshot_observed_at":"2026-08-10T20:56:22.437112Z","title":"M.; Roijers, D","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.437112Z"},"links":{"cited_paper":"/paper/1610.02707","citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:e41d19da1c1e7afd058b0e7461e6109d49ebcad6f4adc0a468ba5713caf490ab","observation_id":"c66faaf7-f90c-46f3-b78b-b0ea8c0cffc1","resolution":{"observed_at":"2026-08-10T20:56:22.437112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.099649Z","title":null,"venue":null,"work_id":"be27cc1e-203f-4eb4-bd07-f60d683edd81","year":2021},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.441985Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:8f685030483fbfe8eb96a089571a3b7135b78351b500d9ea4e58a629af1b0d83","observation_id":"7a372f2e-cda6-484e-9657-6f839f431bde","resolution":{"observed_at":"2026-08-10T20:56:23.104299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.086155Z","title":null,"venue":null,"work_id":"b6adad77-5303-4e05-94a3-4fdb0aa2f654","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.448289Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:89f373b572b287ce46499415c0bc39e45909dd10f6f202d29170299931c39144","observation_id":"b4e5b2ac-28b3-4339-af35-0868d89de8ef","resolution":{"observed_at":"2026-08-10T20:56:23.090260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.072068Z","title":null,"venue":null,"work_id":"477b8c5d-0898-4eb0-a188-4339903aa815","year":2024},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.453472Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:00c073d331e78af16a56fbe6047e116e0da9a093fbb85fc24e153333f23f8657","observation_id":"ab5e0177-8a36-42cc-914c-802c0bcd5f63","resolution":{"observed_at":"2026-08-10T20:56:23.077882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.059566Z","title":null,"venue":null,"work_id":"5c07dc38-fb9d-427d-b790-ffd715a0e743","year":2017},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.458259Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:46e0def209aa4f0391ebbfcc87984fe0b0e3897a07521cefa878a807dcf3fcb6","observation_id":"05fa86cc-4a01-454a-8b9f-c5be96053f9c","resolution":{"observed_at":"2026-08-10T20:56:23.064428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.045754Z","title":null,"venue":null,"work_id":"bd18a590-fda2-42ac-843e-03660d09d091","year":2014},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.462275Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:ae1e50f55586023801a007fe43246c78a1f20bf3d3ea65a0d308fb92b25c0617","observation_id":"480d6023-15ec-44ca-805b-6758396b8fb0","resolution":{"observed_at":"2026-08-10T20:56:23.050415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.031759Z","title":null,"venue":null,"work_id":"78a08427-654c-44af-8d65-2aced156433b","year":2015},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.466849Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:91c11a9db088ab92f8d697c041cea825d6e21c7b48b920631fbb2cefda8e02f5","observation_id":"350db008-fcd3-4ad7-806a-6d8cd9103069","resolution":{"observed_at":"2026-08-10T20:56:23.036031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.017585Z","title":null,"venue":null,"work_id":"8858728f-c5c0-45f4-8965-d3b87951a900","year":2017},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.471185Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:dae3d5082568ee8084a4044c70d58caee0d40cc7474bef91942e3ff10dbaa2a8","observation_id":"70963422-53d1-4e2c-a16b-5de7560b4493","resolution":{"observed_at":"2026-08-10T20:56:23.022085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:23.003107Z","title":null,"venue":null,"work_id":"c707db4c-fa4f-4257-be65-169ec590ed19","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.475224Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:059ae4ca88335ac8e0f34a91cccb0d885214c1bff39df32b36d4f96f90d244f7","observation_id":"0bc0b0a8-6b40-4d23-b7d3-293dc249039c","resolution":{"observed_at":"2026-08-10T20:56:23.008050Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.986391Z","title":null,"venue":null,"work_id":"1f419d54-ef42-4208-97ca-55697cde00ff","year":2013},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.480092Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:e55f5cc9d255d4766478b9d140178a43b3e50e4424451be54ab0704c7c1ca377","observation_id":"8d5d5800-6aac-4eb0-b685-f0f70288cdbb","resolution":{"observed_at":"2026-08-10T20:56:22.993540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.968196Z","title":null,"venue":null,"work_id":"c15006cd-e9c4-45e3-a342-5ddf452b527c","year":2015},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.485164Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:eaf250633321d1f53467e4c56a2b331fbf68d8e6281e9c43fffc9b7c931e0884","observation_id":"b23e983d-2c14-4861-be5b-e7ce3f5fc38a","resolution":{"observed_at":"2026-08-10T20:56:22.973231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.952826Z","title":null,"venue":null,"work_id":"0873a3c6-d8b9-4043-8748-3842cb5a21b3","year":2015},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.490054Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:dca52f657fa1ef8d1f4548d5e858684c4e65a32d1f647e00a90e22e04b5cb5b5","observation_id":"2924b5ea-2e77-436d-b194-841e63d5f2ec","resolution":{"observed_at":"2026-08-10T20:56:22.957815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.936650Z","title":null,"venue":null,"work_id":"fada7c73-ad33-4bb2-992a-7707eab0176a","year":2015},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.494917Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:64e744f5cb4de9dfca587665b18930244478166706d9883044011276822178e6","observation_id":"37ab5a46-f01f-449a-a782-fcafb51a6543","resolution":{"observed_at":"2026-08-10T20:56:22.941457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.920405Z","title":null,"venue":null,"work_id":"b0d0ae6b-fca4-4033-8a79-4a4e91bfda34","year":2021},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.499628Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:58efa8f7781c9b50ddde1b19e22cfcd73e40d4fd2b60ec20b151dcb2c1b1a452","observation_id":"16901793-4cba-4304-a5aa-d97375776a49","resolution":{"observed_at":"2026-08-10T20:56:22.925661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.904561Z","title":"M.; Vamplew, P.; Whiteson, S.; and Dazeley, R","venue":null,"work_id":"7dc46a8b-42bd-4637-9cb5-8b9671ff6680","year":2013},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.504331Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:26cb6b1a7905214bfb92eb959187716d03e50adca546e9035f398875efcbfa6b","observation_id":"ae3a75f7-adda-4160-ac32-11f8f4301239","resolution":{"observed_at":"2026-08-10T20:56:22.910849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.882880Z","title":"M.; Whiteson, S.; Oliehoek, F","venue":null,"work_id":"b1544705-288a-4705-af94-35ba628de6e9","year":2014},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.509614Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:bb110003cecbc5dc51d872739ac24f5a67775459fd1587d89b5906cc20b20caf","observation_id":"471a31a3-8e7c-4afc-a578-63564ccc04de","resolution":{"observed_at":"2026-08-10T20:56:22.889494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T20:56:22.514566Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.514566Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:e6fc8cfee6176ebe077016541005c5abdc309947e5e1a7ff8181dc2c5fe32db0","observation_id":"11e5cc3c-1411-447c-b9b5-9f0f0204f86a","resolution":{"observed_at":"2026-08-10T20:56:22.514566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.867290Z","title":null,"venue":null,"work_id":"5db8acae-0632-49ef-a086-d4e968ddb0df","year":2014},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.519758Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:bc985956b26dddee5b8538b238119a83113487e7cf21f85137c8fdf2cc902e2b","observation_id":"0aa71e82-e237-4ef2-83a4-586fc204337c","resolution":{"observed_at":"2026-08-10T20:56:22.871780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.524494Z","title":"S.; and Barto, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.524494Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:13f83d981cb1fc1720c255feae112576cff32a8c70be9724045f03c4445b456f","observation_id":"724fd147-30d9-456a-aef1-ecd48ac9883f","resolution":{"observed_at":"2026-08-10T20:56:22.524494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.844794Z","title":null,"venue":null,"work_id":"a6ac1a4e-2457-492f-911f-3b0018cc80d6","year":2012},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.528553Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:42943a7bceb47e865f33e1ae43bfb70cc12846ef127a648aff00d7efe8594dca","observation_id":"9d51b1fe-1337-4aec-93b9-b9b8d61af862","resolution":{"observed_at":"2026-08-10T20:56:22.848924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.829446Z","title":null,"venue":null,"work_id":"5be30f16-287b-4312-8101-1396d2e6ddac","year":2016},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.532300Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:fe34129bb4a2eca11ba1747faccef055660920bc0f910eb670e8fe41ea76c3fa","observation_id":"ce055aa4-3249-46d1-ba8f-580aef6ae9da","resolution":{"observed_at":"2026-08-10T20:56:22.834108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.817087Z","title":"M.; and Now \\'e , A","venue":null,"work_id":"bb4ab95f-8755-4ce4-9996-d7f51c696756","year":2013},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.536550Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:f0f2d5858a927608fd8def3a5221ab9f7d6266375eb1e30bd0fdb3d8c3efaf32","observation_id":"11317c4a-e6ec-4185-a373-9afc71d00de7","resolution":{"observed_at":"2026-08-10T20:56:22.820911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.803703Z","title":null,"venue":null,"work_id":"300866a7-8ac9-4a76-86f4-0d9f1d961a37","year":2000},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.540262Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:28fc6ad266850beb52926ded6e294a80bc7fd8e4e4c3e4bafc23deb5c8ca55c1","observation_id":"c4775e14-139c-4eda-912c-1eb8ee634b8b","resolution":{"observed_at":"2026-08-10T20:56:22.808218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.791668Z","title":null,"venue":null,"work_id":"d024edc1-e252-4820-8a9a-9fd43f4caf49","year":2020},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.543930Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:0f3b2cd37f6287a721d52dd39a9518097f8a157a3c9b2cef60f3e76c70612a15","observation_id":"0f17b2dd-e990-4432-9873-bb4fb5e4f748","resolution":{"observed_at":"2026-08-10T20:56:22.795627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.779619Z","title":null,"venue":null,"work_id":"add3a7dc-f54f-4fff-b733-d09b8c33dca3","year":2022},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.547644Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:0e74e40968ffb15142676c57366f490893d5ce18b4bd2af6997346dd49bd98d0","observation_id":"e5383555-d1a8-4477-8426-39e2ff0158f0","resolution":{"observed_at":"2026-08-10T20:56:22.783749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.766865Z","title":null,"venue":null,"work_id":"ca2b4bb2-b986-47e5-93c9-d5eb3f369124","year":2024},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.551600Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:4f6bce6b055e89d61abe686e72a504cc34fcf95b14d4b136f2450ed20b4651cf","observation_id":"11f861da-ce93-4143-a476-b540334d345a","resolution":{"observed_at":"2026-08-10T20:56:22.770996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.752892Z","title":null,"venue":null,"work_id":"c6eda3fa-1f81-48ab-ab49-d2f6660dc8c5","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.555577Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:5f7c3641cc96af3aae6cf68ac5ea7cefd0fe2c25027bc6397b2c909da54fa818","observation_id":"df93b411-e0be-4c24-95a7-f40d8e22f533","resolution":{"observed_at":"2026-08-10T20:56:22.757553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.739416Z","title":null,"venue":null,"work_id":"de8bdfd7-bcd9-4784-8929-816f78c86ebb","year":2007},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.559362Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:1ae8e44eb3c9b28dd9ecf68daaf7361390990f840d91d171af59e591a5e218c4","observation_id":"16e0332a-2eda-47ea-8c4a-0a45cf887451","resolution":{"observed_at":"2026-08-10T20:56:22.743702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.725765Z","title":null,"venue":null,"work_id":"c5faa85a-c61f-4240-8a65-3267f45b8f1f","year":2023},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.563333Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:a4f1ad5749c48eb3391e852526b893ac2c73e959ad2fdd2a807c989d24752030","observation_id":"f5cb6212-eaee-4c09-bf20-cbfd9350456f","resolution":{"observed_at":"2026-08-10T20:56:22.730426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.712067Z","title":null,"venue":null,"work_id":"341a3d2d-314a-4931-b3d5-7e058181179a","year":2019},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.567333Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:6195b1a1b58ebbc24174e80a60e38f5ee69ec77e1de20d3460292ca09b57a85d","observation_id":"8612f961-eaaa-43a2-9d06-619d53f4f4f3","resolution":{"observed_at":"2026-08-10T20:56:22.716566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.697729Z","title":"T.; and Gibson, B","venue":null,"work_id":"5e5f67eb-cbce-479d-92ee-cf7f1aef8936","year":2009},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.571092Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:b711c5555a37babea259d5d1fd44dd6faf63f01231dfffe2121eb3b3e606b772","observation_id":"fa5798c9-46a2-4308-b136-757f41644d51","resolution":{"observed_at":"2026-08-10T20:56:22.702783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.683246Z","title":null,"venue":null,"work_id":"bc43981b-7f03-429d-a90e-ef26ecab1920","year":2016},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.574980Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:5d0342a06bebc40b5f6ffee443560aaa1dbca0e43cf020a8ea201a2952506646","observation_id":"159e19f0-055d-4ad9-a39f-41b67f46cd61","resolution":{"observed_at":"2026-08-10T20:56:22.688438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.578935Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.578935Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:dc1601518c92e82ccb269a468ab32478e2e634601589300aeceb4934e185e577","observation_id":"e6ca8ae4-daa3-412e-a300-c86e84bb85e0","resolution":{"observed_at":"2026-08-10T20:56:22.578935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:22.583071Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T20:56:22.583071Z"},"links":{"citing_paper":"/paper/2501.06773"},"observation_digest":"sha256:02297a01fae234d978d8bb8860149ed1f5e515b6a6fcb9a22726d0cabafee37f","observation_id":"4e2bd006-89e8-4a39-b15b-d6b87247bb17","resolution":{"observed_at":"2026-08-10T20:56:22.583071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.06773","last_updated":"2025-01-14T16:08:28Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T04:50:24.502830Z","submitted_at":"2025-01-12T10:43:05Z","title":"Pareto Set Learning for Multi-Objective Reinforcement Learning"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2501.06773."}