{"as_of":"2026-08-19T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b2a1f72960a07863d8b34f1dc7259f72cde35e0ab50df724d62cec6865d09f9","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:37:08.903839Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06706/citation-record","integrity":"/paper/2608.06706/integrity","json":"/paper/2608.06706/citation-record.json","paper":"/paper/2608.06706"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.671207Z","title":"Proceedings of the 33rd International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":"4702a72d-e05f-443b-b227-e95cd93fa593","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.662141Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:4a1eb00e4ca2edea85f81e819abecd76d793214f6f4e1ebbab2910e18bdbeca8","observation_id":"8c517935-2568-4218-a08d-abe37a8babdb","resolution":{"observed_at":"2026-08-15T14:37:09.674857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.659193Z","title":"Causal Influence Detection for Improving Efficiency in Reinforcement Learning , booktitle =","venue":null,"work_id":"a4ec0716-cac3-4e3b-acb0-4e2f517e32e9","year":2021},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.669602Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:267d14d0f3860e739b8cc210686fc0ddb6620572e6b19630798715a13f7495d5","observation_id":"eb83954f-897f-4e40-9346-1fbf3069a2a2","resolution":{"observed_at":"2026-08-15T14:37:09.663303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15705","last_updated":"2026-05-15T07:52:13Z","snapshot_observed_at":"2026-07-30T12:09:30.149303Z","submitted_at":"2026-05-15T07:52:13Z","title":"Feedback World Model Enables Precise Guidance of Diffusion Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15705","snapshot_observed_at":"2026-08-15T14:37:08.674280Z","title":"arXiv preprint arXiv:2605.15705 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.674280Z"},"links":{"cited_paper":"/paper/2605.15705","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:bac9030c7fae846dc67657e71171cfdffecccbe426d63f5f8d72bae56fcbab59","observation_id":"15eaa2ef-b775-48db-a241-05c6549407e3","resolution":{"observed_at":"2026-08-15T14:37:08.674280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.647182Z","title":"Sensorimotor World Models: Perception for Action via Inverse Dynamics , journal =","venue":null,"work_id":"b19ad873-8786-4a35-84ea-f7eea5f625e9","year":2026},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.679335Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:a85fbdc1bc9901d1976f5053db319b13abed8b5f4e305d70f2a99c00be4b4123","observation_id":"493619a6-026d-446a-a534-f3dcc8abb1ec","resolution":{"observed_at":"2026-08-15T14:37:09.651309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.19312","last_updated":"2026-06-03T18:50:40Z","snapshot_observed_at":"2026-08-15T13:44:41.952181Z","submitted_at":"2026-03-13T19:48:14Z","title":"LeWorldModel: Stable End-to-End Joint-Embedding Predictive Architecture from Pixels","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.19312","snapshot_observed_at":"2026-08-15T14:37:08.683404Z","title":"arXiv preprint arXiv:2603.19312 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.683404Z"},"links":{"cited_paper":"/paper/2603.19312","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:409958a240ef1107b6abd9f23b30623d108e9408449b21e43728c23a290cc627","observation_id":"da5b858d-a031-41a3-86aa-ccbd3319f96c","resolution":{"observed_at":"2026-08-15T14:37:08.683404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.08544","last_updated":"2025-11-14T08:38:32Z","snapshot_observed_at":"2026-08-18T08:21:10.395771Z","submitted_at":"2025-11-11T18:21:55Z","title":"LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.08544","snapshot_observed_at":"2026-08-15T14:37:08.687735Z","title":"arXiv preprint arXiv:2511.08544 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.687735Z"},"links":{"cited_paper":"/paper/2511.08544","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:4b5d7a06c5b5f91735a3a04236a9aeb7b446847665bfa1d4f8a58de05154ff50","observation_id":"8d433341-9394-4775-872c-559c96ffbe7b","resolution":{"observed_at":"2026-08-15T14:37:08.687735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-08-15T13:40:01.739055Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-15T14:37:08.692003Z","title":"arXiv preprint arXiv:2506.09985 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.692003Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:38065bac2d26ad710357f61944167fb850ea46284257a4e981f98b894aceac37","observation_id":"f845e0bc-b5be-4d79-983f-6a291177758d","resolution":{"observed_at":"2026-08-15T14:37:08.692003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.634988Z","title":"Proceedings of the 42nd International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"c03c3720-157b-41c4-8a4c-c6f9a4807a32","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.696456Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:501c8427356897badeff4b2b6cfbac430e6bf9b0516b9e71ddfd31e939a5050b","observation_id":"dc1e4afd-93a2-4cbf-ae73-4eff0d40b230","resolution":{"observed_at":"2026-08-15T14:37:09.639910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.622778Z","title":"Proceedings of the 42nd International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"666348a0-7ade-4585-a733-cf81e265066a","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.700418Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:55a2d6de3bbbeb0e1c4faeadb5cd251e2431e7f14c159e55e76245c15b35d0b5","observation_id":"ae05f979-eea9-4790-98e3-75fcd4633252","resolution":{"observed_at":"2026-08-15T14:37:09.626785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.610914Z","title":"Segment to Focus: Guiding Latent Action Models in the Presence of Distractors , journal =","venue":null,"work_id":"178ec897-feab-4fff-ad9d-0119c72293fc","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.704593Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:a6319365d95b6a71bba6b69b5bcebf7d04003aaf6d2411625f1a55e738f38daa","observation_id":"302bfce3-8be7-4977-80b3-6127e5440a88","resolution":{"observed_at":"2026-08-15T14:37:09.614819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03340","last_updated":"2026-04-03T08:53:29Z","snapshot_observed_at":"2026-07-06T22:52:34.609783Z","submitted_at":"2026-04-03T08:53:29Z","title":"Learning Additively Compositional Latent Actions for Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03340","snapshot_observed_at":"2026-08-15T14:37:08.708510Z","title":"arXiv preprint arXiv:2604.03340 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.708510Z"},"links":{"cited_paper":"/paper/2604.03340","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:17e5a92c5b840c15fbfd693ed78bdc85a55121128de748d8ac3b7c7a3420ccdf","observation_id":"da75548d-72c8-410d-bf84-95fcf527eba6","resolution":{"observed_at":"2026-08-15T14:37:08.708510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.599308Z","title":"Advances in Neural Information Processing Systems 37 (NeurIPS) , year =","venue":null,"work_id":"74823acd-c00f-4168-9f8f-cceec32b8d4f","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.712649Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:465c2598039d82f5df53a5fa3ee70638d4f875267ea49acaa97bbea75bb3066f","observation_id":"52aa0217-30f4-4ddd-91ee-80437a90e741","resolution":{"observed_at":"2026-08-15T14:37:09.603294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.588219Z","title":"Proceedings of the 12th International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":"6a496ca9-c6d3-4485-b645-4f2bd1f05fd1","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.716602Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:3651d60b4434dca8520639382fd94b6d13b3f8ebd82650f19158f7a8f5d61d82","observation_id":"8d2867ae-eafe-4246-9a42-4021ff8b3edc","resolution":{"observed_at":"2026-08-15T14:37:09.592101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.576102Z","title":"and Edwards, Ashley and Parker-Holder, Jack and Shi, Yuge and Hughes, Edward and Lai, Matthew and Mavalankar, Aditi and Steigerwald, Richie and Apps, Chris and others , title =","venue":null,"work_id":"67937371-88a1-4f4c-8712-9c7f09329311","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.720460Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:8a5fafa17dad8e5df17f73c36097cb173b56ae02f15b92412cffb1eea1a53663","observation_id":"65931289-720e-47ad-bccc-c8c34c8434c9","resolution":{"observed_at":"2026-08-15T14:37:09.580720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.561595Z","title":"Advances in Neural Information Processing Systems 37 (NeurIPS) , year =","venue":null,"work_id":"76278e2b-c59f-48b6-bf95-d3ba00ecba60","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.724879Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:b656846884e70bc5e1cc047fe9afd8ab8898ab8579e5f3a67c643363af4941c0","observation_id":"113fdd82-4037-4c12-a942-5318e9ad345a","resolution":{"observed_at":"2026-08-15T14:37:09.565586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.550208Z","title":"Advances in Neural Information Processing Systems 35 (NeurIPS) , year =","venue":null,"work_id":"9cd8376f-d160-4131-85e0-1721d7cefcbe","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.728531Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:02bc7254301312ec70b18b6b48e03fc4f18ee95d83855b65ef29f128264503c2","observation_id":"fbeaf28f-a7ab-4104-8515-ae6319e82d25","resolution":{"observed_at":"2026-08-15T14:37:09.554105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14889","last_updated":"2023-11-17T11:18:51Z","snapshot_observed_at":"2026-08-16T15:45:12.657480Z","submitted_at":"2023-03-27T02:55:56Z","title":"Model-Based Reinforcement Learning with Isolated Imaginations","version":2},"cited_work":{"arxiv_id":"2303.14889","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.14889","snapshot_observed_at":"2026-08-15T14:37:09.074191Z","title":"Model-Based Reinforcement Learning with Isolated Imaginations","venue":"cs.LG","work_id":"a3041985-2fd6-457e-abd3-85822cae2c9e","year":2023},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.732174Z"},"links":{"cited_paper":"/paper/2303.14889","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:68a878089789a284441bce3c2e03ae7b233be4de7afd9a3620944cf0ee5b9a5f","observation_id":"e6147d31-38cc-45d4-8363-e284bb21c20f","resolution":{"observed_at":"2026-08-15T14:37:09.082070Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.539494Z","title":"Proceedings of the 10th International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":"45332d3c-7a4f-4ad4-b196-d2fc7f65548b","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.736636Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:4717b29eb6e26bccd790c94415e32836380b87dc3784a0b8e819b49d09e6dce0","observation_id":"ffcfadf5-1591-4938-bc0a-f3e0df46d58e","resolution":{"observed_at":"2026-08-15T14:37:09.543320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.08229","last_updated":"2022-12-27T22:24:38Z","snapshot_observed_at":"2026-08-16T16:45:21.051038Z","submitted_at":"2022-07-17T17:06:52Z","title":"Guaranteed Discovery of Control-Endogenous Latent States with Multi-Step Inverse Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.08229","snapshot_observed_at":"2026-08-15T14:37:08.740627Z","title":"arXiv preprint arXiv:2207.08229 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.740627Z"},"links":{"cited_paper":"/paper/2207.08229","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:d98bfd9fdec041a9b5f36dc0df535ba3d9a340925820f2b9576280dadf39a37b","observation_id":"e6809a92-7bf8-43d7-83b0-8241987b71b5","resolution":{"observed_at":"2026-08-15T14:37:08.740627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.526936Z","title":"Proceedings of the 40th International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"ce9aae12-57b6-40cc-af61-06253f5c00e3","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.744461Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:2488684de78fce32f30cf6c19b14ca19bb2b2b11884b3d1fe6dd0042e7a491d1","observation_id":"9f233e23-58bd-4e25-8ba0-3491d283a516","resolution":{"observed_at":"2026-08-15T14:37:09.530674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.513560Z","title":"Reinforcement Learning Journal , volume =","venue":null,"work_id":"a6613c96-cc51-450e-a78b-3ef7a7c6d851","year":2024},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.748536Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:be183575a32577a2fb988e5606449559e9551654dcdfb9537b6c8dec05bdd8c5","observation_id":"faf2010b-3434-49f3-85de-b06cdd309c9e","resolution":{"observed_at":"2026-08-15T14:37:09.518420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.501985Z","title":"Proceedings of the 41st International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"1314e3e6-f277-4b34-92df-95f0ab980f89","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.752782Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:5b335091ff5540509c3732e10213d0fe34ffc44e55fa768278072657213458cf","observation_id":"4fee6eda-aa64-4d78-928d-73ee157e4ec3","resolution":{"observed_at":"2026-08-15T14:37:09.505597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.488719Z","title":"Proceedings of the 38th International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"fd37bb70-1896-4d2d-b4e5-9ffb09fa1287","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.756432Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:d4fb0dc641a7a859df7cc7062448438091ba915ee86e3535b2d317d53e817406","observation_id":"39060c9f-3101-4d5e-abbe-4a1b1672d02c","resolution":{"observed_at":"2026-08-15T14:37:09.494643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.477365Z","title":"and Torralba, Antonio and Isola, Phillip and Zhang, Amy and Tian, Yuandong , title =","venue":null,"work_id":"72fe4fa0-be28-4c27-9278-bc661ebc4fd8","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.760263Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:f1d8c2252c5b290b9795f69e9b0cd19c4ec4d4349dd355eb061e1e3e521e6dac","observation_id":"33e2fcf0-30ba-4f92-96cd-789ecdff3d27","resolution":{"observed_at":"2026-08-15T14:37:09.481303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.465821Z","title":"Proceedings of the 39th International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"2ab7f1fa-ea41-47e7-9c6f-48a73844e578","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.764301Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:5f3fefdd5356d59f003f9708ace5602ad666b821a0d1d98654cc30cd54ce029e","observation_id":"6eb6a31d-7cec-4da0-a8cb-6f4a19a3f848","resolution":{"observed_at":"2026-08-15T14:37:09.469631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.454494Z","title":"Advances in Neural Information Processing Systems 36 (NeurIPS) , year =","venue":null,"work_id":"e98c7150-d3a6-4e77-8492-e3b396bbd9fa","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.768820Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:37f1bc015073de3c1130df316ca40233b7c94ec54ce3b4e4104510e39ef389e7","observation_id":"402ee844-064c-44ec-bd4a-6b16fd7eca55","resolution":{"observed_at":"2026-08-15T14:37:09.457832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.441910Z","title":"Proceedings of the 41st International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"f4dae6c3-d234-44ef-a158-2add00434503","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.772650Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:b54452c7790df1e1cbb1f7107e75ce757524b10a8e9b4e090a50b583636e2a0c","observation_id":"52c552ec-8ecf-41ac-8d9f-4f8bc0fabada","resolution":{"observed_at":"2026-08-15T14:37:09.446222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.427283Z","title":"Advances in Neural Information Processing Systems 37 (NeurIPS) , year =","venue":null,"work_id":"38896138-d713-490f-85be-f52682915a68","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.776383Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:b5517cfee03d24cbf38126b2189fac1b55f2275b3d79983ff3c61b8a7ac4d734","observation_id":"b6f0fc9e-ae09-4ab5-9565-761c641537c7","resolution":{"observed_at":"2026-08-15T14:37:09.431997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.412469Z","title":"Proceedings of the 10th International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":"1a7e4eab-1588-41c1-b0cd-913f08036a71","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.780600Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:12e088d38f723f03b2b92be36fb2c418ef19c5bfd65fa88e289f5c0529582c4e","observation_id":"f0f5a60c-31e1-40f3-8ece-7197c9c88504","resolution":{"observed_at":"2026-08-15T14:37:09.417033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.01289","last_updated":"2017-08-25T22:18:11Z","snapshot_observed_at":"2026-08-14T20:43:19.222288Z","submitted_at":"2017-08-03T19:32:33Z","title":"Independently Controllable Factors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.01289","snapshot_observed_at":"2026-08-15T14:37:08.784358Z","title":"arXiv preprint arXiv:1708.01289 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.784358Z"},"links":{"cited_paper":"/paper/1708.01289","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:f396ee79652359886aecbc97dd824e7e362b35a146a3627a8e0e363f976fe8a5","observation_id":"4ad27729-a690-4754-81b3-1545a5a00e67","resolution":{"observed_at":"2026-08-15T14:37:08.784358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09484","last_updated":"2018-02-26T18:03:56Z","snapshot_observed_at":"2026-08-17T20:04:24.859742Z","submitted_at":"2018-02-26T18:03:56Z","title":"Disentangling the independently controllable factors of variation by interacting with the world","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09484","snapshot_observed_at":"2026-08-15T14:37:08.788867Z","title":"arXiv preprint arXiv:1802.09484 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.788867Z"},"links":{"cited_paper":"/paper/1802.09484","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:bcfe9cc3fbbfe17f2ccce6eeaa1f4987c745a326d4ed0d56194b80c990161f4d","observation_id":"d03fc1fe-7d7d-4e10-97d2-c42bbdb3a664","resolution":{"observed_at":"2026-08-15T14:37:08.788867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06955","last_updated":"2018-05-22T00:10:17Z","snapshot_observed_at":"2026-08-14T19:24:27.787523Z","submitted_at":"2018-04-19T00:53:34Z","title":"Disentangling Controllable and Uncontrollable Factors of Variation by Interacting with the World","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06955","snapshot_observed_at":"2026-08-15T14:37:08.793027Z","title":"arXiv preprint arXiv:1804.06955 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.793027Z"},"links":{"cited_paper":"/paper/1804.06955","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:93304bcf9c4194ccde515106983b8dc851c0382a98e7a2267d1668968215f0cf","observation_id":"7a2c092d-a259-4da9-a7fc-02d5a56e1b31","resolution":{"observed_at":"2026-08-15T14:37:08.793027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.400031Z","title":"and Hoogendoorn, Mark and Fran","venue":null,"work_id":"e80e532a-bbc1-4353-af14-d6a72ea814c0","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.798030Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:e09da5e6d652f32ba999d0438adbb65428be3cd84c9a2f7e8c73fc71ff78eb4f","observation_id":"e2f80d68-325a-4a58-ad11-e09982f84180","resolution":{"observed_at":"2026-08-15T14:37:09.403833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.388651Z","title":"Proceedings of the 40th AAAI Conference on Artificial Intelligence (AAAI) , year =","venue":null,"work_id":"e603b9d2-d060-4d11-83a2-81ef3e3af72b","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.802726Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:943f94c98c857bf5a17a6d3b865bd8b5586c048d4e6eec91783fa75be443c8be","observation_id":"63d9a03a-4a12-4432-ad57-d47e9b96d3d6","resolution":{"observed_at":"2026-08-15T14:37:09.392520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.377775Z","title":null,"venue":null,"work_id":"7cc28219-b211-40b0-845c-a607c06e6845","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.806398Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:6f6f69e4f99c55f912b55953ebf6fcfe3d1a42365186173a547cd688641eec55","observation_id":"7f8124e6-3e39-416f-9563-a28bf0cd3478","resolution":{"observed_at":"2026-08-15T14:37:09.381436Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.365721Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , year =","venue":null,"work_id":"0cc45efb-507a-423d-910d-b8cc4120be5c","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.810114Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:320c5e74718c82815a2acb4fe25b69fcf0d6f27b19815d3cf3a05ead10044c7a","observation_id":"f2217135-8440-4bc4-96d3-c840fd6afc39","resolution":{"observed_at":"2026-08-15T14:37:09.370034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-17T22:50:34.371081Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08471","snapshot_observed_at":"2026-08-15T14:37:08.814081Z","title":"arXiv preprint arXiv:2404.08471 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.814081Z"},"links":{"cited_paper":"/paper/2404.08471","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:b79e823d588b9434a1e3dc529e30e723299dcd34e62bc4d61a1ac2f3ff66e039","observation_id":"fd578a89-53ba-4a0e-93d4-7a9e638f732b","resolution":{"observed_at":"2026-08-15T14:37:08.814081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.353284Z","title":"Proceedings of the 10th International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":"7ca684e9-6e13-4104-b893-4116fa7f0eb8","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.818409Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:ad2c8649126afad1767aa6a7a7997b5a7b56d6e9b291dedd05aa68f6c59496be","observation_id":"431e426c-4c25-453f-9be1-a4f920357c5e","resolution":{"observed_at":"2026-08-15T14:37:09.357933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.341988Z","title":"Bootstrap Your Own Latent: A New Approach to Self-Supervised Learning , booktitle =","venue":null,"work_id":"e63bfbb4-7baf-46d0-9723-2391c937610a","year":2020},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.822311Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:3e992dd4bceb42a0b08a30dbb82705e358709da91f59fb463c01db0845649e62","observation_id":"110f0a88-e428-4232-b114-624de0d00ede","resolution":{"observed_at":"2026-08-15T14:37:09.345788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.329553Z","title":"Representation Learning with Contrastive Predictive Coding , journal =","venue":null,"work_id":"c0df3dab-1680-4d5b-8c64-79059c9eb888","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.826402Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:291a0df5cc47eabf95e1f7fb742fb95a4e6135bcbac98c580b38a1af16ec280c","observation_id":"f9975f9d-d33e-4805-a130-ee1191e08149","resolution":{"observed_at":"2026-08-15T14:37:09.333617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.315043Z","title":", title =","venue":null,"work_id":"105348fb-6d44-4a6f-ad42-f6eea8a4f339","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.830363Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:7656ae1302f550f824394534e7c96efd67c09821eda3b7c99e33f8f3610cc0d6","observation_id":"c9078045-f7b3-4c63-8377-08ba16b0a7bd","resolution":{"observed_at":"2026-08-15T14:37:09.318914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.301679Z","title":"Proceedings of the 36th International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"bf61c751-2974-4449-8926-a615939beda9","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.834180Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:e41ba14aa360258ac56f3f38ab9208ef37f8911a7b518d7b201ebb3fbef48dab","observation_id":"1604fdaf-917b-4fbf-85ec-8a846352cb32","resolution":{"observed_at":"2026-08-15T14:37:09.306564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.285261Z","title":"Proceedings of the 8th International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":"4a503f43-dca7-4401-ae95-e16cf01f9985","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.837729Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:181baa7ba3bb310d8ce5dddb1b1372625d83fc9a6419e2a51ef2d8c33ae9a85c","observation_id":"446580e6-ce86-4c07-8302-ae3a74679e94","resolution":{"observed_at":"2026-08-15T14:37:09.291424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.264502Z","title":"and Mannor, Shie and Rubinstein, Reuven Y","venue":null,"work_id":"5fb0e710-f72d-4062-8066-9bbb0f35fb82","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.841700Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:78d470a16aaad59006104a8ee62192500169043d972550aae97e7e2a6976240d","observation_id":"7e6aa9bf-cc7d-4f22-a35d-f746806bb369","resolution":{"observed_at":"2026-08-15T14:37:09.269084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.02722","last_updated":"2021-01-07T19:03:34Z","snapshot_observed_at":"2026-08-16T18:53:38.320743Z","submitted_at":"2021-01-07T19:03:34Z","title":"The Distracting Control Suite -- A Challenging Benchmark for Reinforcement Learning from Pixels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.02722","snapshot_observed_at":"2026-08-15T14:37:08.845606Z","title":"arXiv preprint arXiv:2101.02722 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.845606Z"},"links":{"cited_paper":"/paper/2101.02722","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:c5e4fa87deff6174937e19dd046e80dc335c4c0d60d953f02ab6bc4ce29ecd35","observation_id":"268f6ff6-4f9a-46ac-bc68-5940bfe5faa0","resolution":{"observed_at":"2026-08-15T14:37:08.845606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.247111Z","title":"Unsupervised State Representation Learning in","venue":null,"work_id":"5d1b73fd-fd96-418c-a28e-2e35bbc05a85","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.849621Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:de25b0899f61b541334b39510c61b61327acd63e830f80bb6482c96f64f822e3","observation_id":"f9dee095-85b1-4e00-b517-702af074ce35","resolution":{"observed_at":"2026-08-15T14:37:09.251619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.234330Z","title":"Software Impacts , volume =","venue":null,"work_id":"17b7fc10-51e1-4ebb-8d28-edd3347a15cc","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.854473Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:42324c1d3f01da54c3634d6dd4941763907dfd57a3fc8949059ac58be04cb7cb","observation_id":"db533cb6-0d8d-4391-914e-cf0bbf33494b","resolution":{"observed_at":"2026-08-15T14:37:09.238165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-15T14:37:08.858396Z","title":"arXiv preprint arXiv:1801.00690 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.858396Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:7da08903a888ac11417becd38d991ff28de29242558d79ed423bf7e8a840bc71","observation_id":"8a16b555-2059-45d5-9523-1a9dc40fe9fe","resolution":{"observed_at":"2026-08-15T14:37:08.858396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.220249Z","title":"and Naddaf, Yavar and Veness, Joel and Bowling, Michael , title =","venue":null,"work_id":"049ecf95-9943-4495-9f47-2b0298b4c516","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.863037Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:cae1d1cac92c43e32bbe4531024983cc52cce645c8ceb0ee510cac7359c63398","observation_id":"16d7abe7-b281-41ac-94a7-dbcb7b427a10","resolution":{"observed_at":"2026-08-15T14:37:09.226712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.208776Z","title":"and Bellemare, Marc G","venue":null,"work_id":"eda22334-8798-4350-b093-ce33a5e68c96","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.868030Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:7be4f62dd59bdb68a25eebd9e389faa46a0e8f4997ca437ea582377ec34cbf0f","observation_id":"c67a1310-3575-4496-a3ea-7865cfcdd567","resolution":{"observed_at":"2026-08-15T14:37:09.212503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.196110Z","title":"Advances in Neural Information Processing Systems 36 (NeurIPS), Datasets and Benchmarks Track , year =","venue":null,"work_id":"5f6777bf-a1ed-4828-bc22-29af4a9b24c1","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.872409Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:a312b2a4d27523a23d798a98482c681093907d8d1e6077443e116c0f9c6b1758","observation_id":"43e34b65-3188-4296-b673-503371ebf628","resolution":{"observed_at":"2026-08-15T14:37:09.200056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:08.876811Z","title":"and Precup, Doina and Singh, Satinder , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.876811Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:8b35281914ba3b0bdefbe3d35876f4e0eef5b31945e03cb7b8276a0edb66cd53","observation_id":"02c88e57-2d9a-4d13-b25a-2094907aaadf","resolution":{"observed_at":"2026-08-15T14:37:08.876811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.173228Z","title":"World Models , journal =","venue":null,"work_id":"ac3fce6a-df7e-42f6-85dc-bfcdbe90e2a3","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.881847Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:244c4495f2e6fc61cd1b9ae37ea3d20c99f3628639d989059ea9d06c5ba9bb33","observation_id":"50fdb983-37a2-446b-b65b-d4cf0d8467a8","resolution":{"observed_at":"2026-08-15T14:37:09.179939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-15T14:37:08.886035Z","title":"arXiv preprint arXiv:2301.04104 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.886035Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:551dc0332f47614067307bb8718519f3b8a1a893278a572bd6610a63886c9d5e","observation_id":"01a2a016-1b46-4751-9aa6-355e6bfc5de3","resolution":{"observed_at":"2026-08-15T14:37:08.886035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.159865Z","title":"Neural Computation , volume =","venue":null,"work_id":"71a68da9-a098-44ad-be68-94679bb8960b","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.890222Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:17a45f11ab9af3dfe8119ea0ad48d2f55fdedb918f6ca8b2f0e6333ad400103f","observation_id":"704c4396-8e2d-45bf-8a66-9b1bd8f11f4c","resolution":{"observed_at":"2026-08-15T14:37:09.164550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:09.146596Z","title":"Successor Features for Transfer in Reinforcement Learning , booktitle =","venue":null,"work_id":"72cb4466-d970-49d4-a6b4-01440b339dd3","year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.894558Z"},"links":{"citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:64675c74425c7e04230221f2473c38dd5430f9d0482529cbfee6c852409bb106","observation_id":"4e4e3b3b-d038-4396-a72a-761f9c33df40","resolution":{"observed_at":"2026-08-15T14:37:09.150845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-15T14:37:08.898824Z","title":"The 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.898824Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:5469cd40f959c936582a6f66a0b04d209e3981a03b4b373021eac5cd3d3e191b","observation_id":"e5dd62ab-1bbf-413b-82ed-0647a481eacf","resolution":{"observed_at":"2026-08-15T14:37:08.898824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-15T14:37:08.903839Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:08.903839Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2608.06706"},"observation_digest":"sha256:c73f701369f0f84bbdad206204e5ad7a7cb2a27700a4c86baf07e88af85557cb","observation_id":"20e33f60-057c-4df4-83c8-36c293d89fc7","resolution":{"observed_at":"2026-08-15T14:37:08.903839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06706","last_updated":"2026-08-07T02:02:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T13:25:59.788144Z","submitted_at":"2026-08-07T02:02:19Z","title":"Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":16,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2608.06706."}