{"as_of":"2026-08-10T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89106b067c5b086592e3bc2e9ed5b99c5f7087d79968534629246c9f30df370a","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:13:46.110853Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.17059/citation-record","integrity":"/paper/2510.17059/integrity","json":"/paper/2510.17059/citation-record.json","paper":"/paper/2510.17059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.005000Z","title":"u c l\\\" u , Julia Berezutskaya, Eva van den Borne, Ya g mur G\\","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.005000Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7947393abe54ed51d82019186d733d8335992624e0ca295c91cc3c2973335e67","observation_id":"d38c9e45-22aa-49df-8dfb-a60714c4bd70","resolution":{"observed_at":"2026-08-04T09:13:38.005000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-04T09:13:38.158656Z","title":"Concrete problems in ai safety","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.158656Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:9f8031f9bb0b2c4336451facda76e8eaec3ae787f8b97b847a98770abcb39324","observation_id":"c4e8c1b1-4b18-49f4-a95d-067d86376ab1","resolution":{"observed_at":"2026-08-04T09:13:38.158656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.354288Z","title":"Hindsight experience replay","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.354288Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:cddfcfea66417e4be966694e44f025114ae14eb859c725028a2c3da28594b5cf","observation_id":"27cfe413-2135-4805-88ee-bed36f98326a","resolution":{"observed_at":"2026-08-04T09:13:38.354288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.500604Z","title":"End to end learning for self-driving cars","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.500604Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:0e2d083d91bd25b0bcab59d00b11d2c88ed11a1660eeeef0d77fe2fe11724ec1","observation_id":"f7a59cdd-b8e4-4f37-9268-1934400f8236","resolution":{"observed_at":"2026-08-04T09:13:38.500604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.760654Z","title":"Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, Michael S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.760654Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:bf126792ebb78a1531b3c85dcc22acbb09a1fb3ec37187ad8fa4f543b2d64fc8","observation_id":"929e2a63-46ac-40f7-9452-cdab8e71ae85","resolution":{"observed_at":"2026-08-04T09:13:38.760654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.937247Z","title":"Goodman, Elizabeth Spelke, and Laura Schulz","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.937247Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:b2f54a855f506300567bb1e83650df2273d2775e5e43b22b49e916ab6f2a174c","observation_id":"8385915e-2694-4219-b18c-0d5a2fe32b8f","resolution":{"observed_at":"2026-08-04T09:13:38.937247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.192551Z","title":"Accelerating Goal-Conditioned RL Algorithms and Research","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.192551Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:4627b1330eb40be57bb3da20a950a001cefa9bd41698bc2d7c72d6fd008a8d5f","observation_id":"70e91582-7f45-4163-b9a3-a158ae3c059c","resolution":{"observed_at":"2026-08-04T09:13:39.192551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.356566Z","title":"JAX : composable transformations of P ython+ N um P y programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.356566Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:de6d0bd840a15688aa26b7696aaeb6705855def1b97f629367bbf5bc24aa0fcc","observation_id":"a8dba354-1957-4bfa-b265-7a7f5d51e41f","resolution":{"observed_at":"2026-08-04T09:13:39.356566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-09T23:24:21.399948Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-04T09:13:39.522753Z","title":"Openai gym","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.522753Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:07606ba143b7fa8ef25dcb86beae4cfb044ae2317c4ba8d37e762ed0143545e1","observation_id":"933ece06-7611-4693-88fd-ba67ee79357c","resolution":{"observed_at":"2026-08-04T09:13:39.522753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.649756Z","title":"Explore, discover and learn: Unsupervised discovery of state-covering skills","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.649756Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:2b2fa81c41d00a117fba52fc3a11fb222e5d0e325f97865175f797dc4619c13a","observation_id":"0a031eaf-ed5e-457c-bbcc-f06576b01b64","resolution":{"observed_at":"2026-08-04T09:13:39.649756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.799969Z","title":"Multi-task hierarchical adversarial inverse reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.799969Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:3b76204c4df36cf55e46dde3177800ab6bf7c9f27386b3c6a1e752a08b2eb2ce","observation_id":"c817bad4-b1f1-43b5-9b8d-3a8dabeaa8c0","resolution":{"observed_at":"2026-08-04T09:13:39.799969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.922016Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.922016Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:c2edab3887c893fc1bfb1aa93da80d64c7ce24fbee23cfe00ff1f153cec1c0c1","observation_id":"a74c84a0-7bbc-49a4-a91a-53a57f8ae4f0","resolution":{"observed_at":"2026-08-04T09:13:39.922016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.993261Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.993261Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:867213cdace8cf7bb308edbd34e758eb94bd561e7c43a6cb0e9a1904b3ba3343","observation_id":"c13b1b3b-7d47-4fe6-be0c-434307c30129","resolution":{"observed_at":"2026-08-04T09:13:39.993261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.143681Z","title":"Dragan, Kenton C.T","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.143681Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:126d855bfb7fd80c4e77217521ba47a4c1e6c839c0b419b94cc858e1b5a78248","observation_id":"5eea04b8-b574-454e-ad1d-3d956bde30dd","resolution":{"observed_at":"2026-08-04T09:13:40.143681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.303485Z","title":"Rewriting history with inverse rl: hindsight inference for policy improvement","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.303485Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:8efd9d9cc4fdfa4ac42edf36e92cfcb9bfd5ab3c370d8b8313228dc5e2fc5e80","observation_id":"7a96a078-4972-4d8d-bf4a-7fdd65b57d3d","resolution":{"observed_at":"2026-08-04T09:13:40.303485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.432655Z","title":"Contrastive learning as goal-conditioned reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.432655Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:a2f4d684761f66a08035168d8296111f307b32f9cac429f27eed9a7cd06aab31","observation_id":"f932746c-25c1-4aa8-b391-b61dda89fa8f","resolution":{"observed_at":"2026-08-04T09:13:40.432655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.588013Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.588013Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:f891ef440c4c10ef5db2120042945a81bc11d53cde9d077d16029a5ea5fe3236","observation_id":"13a3fa3d-ce8e-473e-8a8a-341be9f88242","resolution":{"observed_at":"2026-08-04T09:13:40.588013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.650012Z","title":"One-shot visual imitation learning via meta-learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.650012Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:2164d8271008b2a716f38525a6f8b84fe71128657ec4d6df1c95f18bfcb356be","observation_id":"267f0237-36f7-4078-a0e4-d30b274b1972","resolution":{"observed_at":"2026-08-04T09:13:40.650012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.831139Z","title":"Automatic goal generation for reinforcement learning agents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.831139Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e6fa6b3f038a77cc29bd3fba2f8fbf97c48ab7aea3e6f0ddbafefca6d7809624","observation_id":"0933dbc6-7c66-4041-b83f-90b48b68630f","resolution":{"observed_at":"2026-08-04T09:13:40.831139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.951233Z","title":"Brax -- a differentiable physics engine for large scale rigid body simulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.951233Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:f5eccc83d3187dd447562843d646dabdf10fe8003c5546ffb2698e9e7372516d","observation_id":"6b3b7084-ff4a-4800-82d6-9fc02e59b706","resolution":{"observed_at":"2026-08-04T09:13:40.951233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.070975Z","title":"Learning robust rewards with adverserial inverse reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.070975Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:6614c69e63b8673faeb78a9850d89b6159060c0243462c8ea6df46f7ce3c5e6f","observation_id":"66b9b235-668e-4ae9-8d5d-579ee992a518","resolution":{"observed_at":"2026-08-04T09:13:41.070975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.192615Z","title":"Childhood as a solution to explore–exploit tensions","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.192615Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:51970bb6c4a1af14b206719dd229b7e32e6066b837b0138c6fe35c5d7e40dd9e","observation_id":"2d10fdfc-483b-4207-8d66-cadf61fac8b4","resolution":{"observed_at":"2026-08-04T09:13:41.192615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/cdev.13059","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From exploration to instruction: Children learn from exploration and tailor their demonstrations to observers’ goals and competence","venue":"Child Development","work_id":"cdd2190b-0325-410e-a6b1-471e53b8e876","year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.311477Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e1129270b81eaff5d1f1f7696f70f455d1da541db12990136b129f6fc5f3ee6d","observation_id":"d03e36c1-877c-4e58-b4ff-d2928353fc98","resolution":{"observed_at":"2026-08-04T09:19:41.762434Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.452871Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.452871Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:69acd2ac9149eee8f3931e6ae87b67138fc5b17d6b7b48cbc65e9a77eece51b9","observation_id":"5696ae83-8730-4b20-bfba-4ced83715268","resolution":{"observed_at":"2026-08-04T09:13:41.452871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.537974Z","title":"Generative adversarial imitation learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.537974Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:03d6262ed5349004fe816e2153e52408e08ab6e06412dfe3aa751e88e6ec099e","observation_id":"8daca791-ef19-4094-8814-a16e157eda47","resolution":{"observed_at":"2026-08-04T09:13:41.537974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.660099Z","title":"BC -z: Zero-shot task generalization with robotic imitation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.660099Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:41bda75764403f41a7ec1890717aacd0ae8e3f2296fe28f8e993ede6cc5724f8","observation_id":"63b13824-8cc7-47ff-a6a6-325743b7cce3","resolution":{"observed_at":"2026-08-04T09:13:41.660099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.838120Z","title":"Learning to achieve goals","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.838120Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:d8ef1fdfae1908ba869bc2fe08ef02e8b51a4dd2f1b3d8fa3bcd5a4c33218acf","observation_id":"9bf686f9-4498-4349-8947-ccd45e497db3","resolution":{"observed_at":"2026-08-04T09:13:41.838120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.003804Z","title":"Variational curriculum reinforcement learning for unsupervised discovery of skills","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.003804Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:078f4f33290679996cdfd20b06a340c5a6b349fb3ad9e6603b617b0072917962","observation_id":"9a12263d-a1ec-4510-a767-041acaa4fa02","resolution":{"observed_at":"2026-08-04T09:13:42.003804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.137865Z","title":"Urlb: Unsupervised reinforcement learning benchmark","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.137865Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:ce8d12f2d2ea149bbbf476f3dbc785d1a2a539303b2350515f35e0af23dc8362","observation_id":"9b02b917-31a8-4c2d-9044-5b7ca7f5a9c0","resolution":{"observed_at":"2026-08-04T09:13:42.137865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.220660Z","title":"Learning Temporal Distances : Contrastive Successor Features Can Provide a Metric Structure for Decision-Making","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.220660Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:34b0ea4b59effce5e78d88d277d1aae6d9b4eb440afd9b4280d660aed8589694","observation_id":"d6493173-d5f7-4868-b4e6-20c443719648","resolution":{"observed_at":"2026-08-04T09:13:42.220660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.323979Z","title":"Visual reinforcement learning with imagined goals","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.323979Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e448b79a598b3c05df1114d1655e5a473fde5de728c934a19d507e9c5da8a892","observation_id":"cd9059e9-b2a1-47f8-876b-98086928dd8d","resolution":{"observed_at":"2026-08-04T09:13:42.323979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.455819Z","title":"Ng and Stuart J","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.455819Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:2c59f7b75d4e5128088a61ce220df2fb5cd48e576693218aa4c92d34062f9497","observation_id":"9e60e639-0f2a-450a-9eee-4f6007570b0f","resolution":{"observed_at":"2026-08-04T09:13:42.455819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.587587Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.587587Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:6bfd2b956b7580199e4f3952b4bc80e67ef50f53b99fc51dca1bc8c70242459e","observation_id":"f9917932-8820-467f-8298-19e74cdf65d6","resolution":{"observed_at":"2026-08-04T09:13:42.587587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-04T09:13:42.702322Z","title":"Representation Learning with Contrastive Predictive Coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.702322Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:2bab1b55879dc8573062fc73fe452bd934b5f1e1665f7d84145005061b50e526","observation_id":"cb46936d-9b86-47b9-86e5-9e44e2605a7b","resolution":{"observed_at":"2026-08-04T09:13:42.702322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04882","last_updated":"2021-01-13T05:20:20Z","snapshot_observed_at":"2026-08-05T15:46:28.102967Z","submitted_at":"2021-01-13T05:20:20Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.04882","snapshot_observed_at":"2026-08-04T09:13:42.758136Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.758136Z"},"links":{"cited_paper":"/paper/2101.04882","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:ec8d11c5f80eab404abd35d006bf393c437ff9c6793db3b58fc0be26233ce472","observation_id":"23208fef-b9b2-480f-97fd-fdc51c537970","resolution":{"observed_at":"2026-08-04T09:13:42.758136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.836550Z","title":"Efros, and Trevor Darrell","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.836550Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:282308f602ffdc8b1527b9e4efa20dfe1a5c170fa9697d294c022fa957ec9f27","observation_id":"aada6a38-8403-4dba-a29e-08cba8f192a2","resolution":{"observed_at":"2026-08-04T09:13:42.836550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.923057Z","title":"Fast imitation via behavior foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.923057Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:17e36158b7aab27d52bfca74a08a80ad11ebbb0113c33671a1e7df9bf66639f5","observation_id":"a7f85e20-d2e7-442e-80df-4e453e33b435","resolution":{"observed_at":"2026-08-04T09:13:42.923057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.979411Z","title":"Maximum entropy gain exploration for long horizon multi-goal reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.979411Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:0091b5070b95b8f984428576e8665367554787c890c1cc5b682a5efebbdd1c91","observation_id":"b2e87f02-e280-4d7b-9352-3d269b26aa77","resolution":{"observed_at":"2026-08-04T09:13:42.979411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/cdev.14158","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mars, and Sabine Hunnius","venue":"Child Development","work_id":"d63eb092-7cee-424d-92ce-c1812429df5e","year":2025},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.199000Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:cac431aff8c40c1329715fc9e34c35a4ca23637d7084a7b4d1621602dbc9ee8f","observation_id":"ab4d95a2-01c7-491d-97bb-4135905ae3a5","resolution":{"observed_at":"2026-08-04T09:19:41.601827Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.359512Z","title":"Pomerleau","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.359512Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:a720810ef7bf76a573ce5c3b935ec758aaa1b13cf9103d159745db35ef34d388","observation_id":"faa3e819-622a-4b6a-9c86-76a2713778f8","resolution":{"observed_at":"2026-08-04T09:13:43.359512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.502039Z","title":"Pong, Murtaza Dalal, Steven Lin, Ashvin Nair, Shikhar Bahl, and Sergey Levine","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.502039Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:02a2f7e9fa1c7ecc520f39528204dc129f8cc1adfa37eaa0ad0051bcecd90522","observation_id":"ac747817-3d3b-47d2-bb4c-97ba83324c7e","resolution":{"observed_at":"2026-08-04T09:13:43.502039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.647391Z","title":"A generalist agent","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.647391Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e8e257d0a01dc611e377339a441617c58ec5f0a2fc1aa7039a2bcb10f13309ec","observation_id":"2a9123f5-695d-4f51-9e5e-7051c01aea31","resolution":{"observed_at":"2026-08-04T09:13:43.647391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.766494Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.766494Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:032cd82a28b01e0aa3af1042b16109a5bde8b3b2abc3b076ac0530b666477567","observation_id":"d90bb985-c42b-4a32-baa3-27170d6f1817","resolution":{"observed_at":"2026-08-04T09:13:43.766494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.891571Z","title":"Universal value function approximators","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.891571Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:b4f0110e46454e977e305cfe5680178c73ee3d2c1690ea80550c06e2725b3a97","observation_id":"d80a857d-b193-4492-8980-5d65faeeb44e","resolution":{"observed_at":"2026-08-04T09:13:43.891571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.027911Z","title":"Smile: Scalable meta inverse reinforcement learning through context-conditional policies","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.027911Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:83933d2cc1056452bcb5ba7693ebe7de5475b25b308c70c8663f71cf3d129359","observation_id":"82b2a3cb-db7e-45ad-b7bf-0f2bd16f9aaf","resolution":{"observed_at":"2026-08-04T09:13:44.027911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.203028Z","title":"Mastering the game of go with deep neural networks and tree search","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.203028Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:54035b51bdcea11730f6ffd8e3bd6706e8a3a4ed63750d00e5af2fb5996b5423","observation_id":"6e4f21bc-79db-4853-bed2-37e4dfe689b3","resolution":{"observed_at":"2026-08-04T09:13:44.203028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.325710Z","title":"Stahl and Lisa Feigenson","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.325710Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:22835604415c23221aaa95e014a34258a4ef5e2725b2f3077114d3817df72c55","observation_id":"60f17fd8-6fe3-45f6-b24a-d0f9f0fcac49","resolution":{"observed_at":"2026-08-04T09:13:44.325710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.503585Z","title":"Learning one representation to optimize all rewards","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.503585Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:505f65191f808893c4ac03eaa456805dce2b203269dba9789c1e0186551a2ee2","observation_id":"cf57dec7-32bd-41e5-9762-40d321ff9d41","resolution":{"observed_at":"2026-08-04T09:13:44.503585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.671189Z","title":"Optimal goal-reaching reinforcement learning via quasimetric learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.671189Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:24eea6df68876d476205caca6dba1cac707438698417a5325e5311a4c4093a19","observation_id":"398d1796-5be7-4e43-b705-574bf8d6acbe","resolution":{"observed_at":"2026-08-04T09:13:44.671189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.807858Z","title":"Unsupervised control through non-parametric discriminative rewards","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.807858Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:0a8dd74decec28cf67d4b9f644e487480b286d9e403cc4a0e80d4450d80c224c","observation_id":"654b6e25-acf6-4c75-ab75-0a6419f0c76e","resolution":{"observed_at":"2026-08-04T09:13:44.807858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.967363Z","title":"Outracing champion gran turismo drivers with deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.967363Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:93996a6cc3dc03028cd21e42f2c418b150d394450753c7b21fb92110d173eca9","observation_id":"82d6db6b-eb09-4abb-bf89-2ce82df9d26b","resolution":{"observed_at":"2026-08-04T09:13:44.967363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.071186Z","title":"Meta-inverse reinforcement learning with probabilistic context variables","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.071186Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:c223ec5b9399f74a221c14ce7e580ffce85db2abfb67a451bf99e113291f2517","observation_id":"870cb88d-5996-4736-ae55-a4bc744497ec","resolution":{"observed_at":"2026-08-04T09:13:45.071186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.200047Z","title":"One-shot imitation from observing humans via domain-adaptive meta-learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.200047Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7a0db9bed6ff6783c268e7627c09586c6f6c8f3d15d120a570945e29de2f3bcb","observation_id":"d0384562-177c-4940-b133-00a9e52b9452","resolution":{"observed_at":"2026-08-04T09:13:45.200047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.315827Z","title":"Maximum entropy inverse reinforcement learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.315827Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e50c1d74238e35602819fdf4c781007e97100fed20a6584731cf734be557bc09","observation_id":"23645e0e-ee35-4ef3-afba-d509455796b3","resolution":{"observed_at":"2026-08-04T09:13:45.315827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.480466Z","title":"Brown, and Anca D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.480466Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:0c877369abbe7b8e4fc8fc5a9e0232c5e6f98b213148d63a443d69db2b08d0ff","observation_id":"35b39290-c102-4415-bfcc-594b03fa3fc2","resolution":{"observed_at":"2026-08-04T09:13:45.480466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.622822Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.622822Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:59d11f4acebeac3791735784303a4964b7846089a6fd5deaf50b98619847c872","observation_id":"a5bed69c-756d-437b-bbe9-39533c8f78dc","resolution":{"observed_at":"2026-08-04T09:13:45.622822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.791789Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.791789Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:9440a146932840d6f738b18f73c288d2d19be1f088ed9cb8bed0ad3def26b62e","observation_id":"14c214e3-d300-4d91-bccf-0cfda30b598f","resolution":{"observed_at":"2026-08-04T09:13:45.791789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.928079Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.928079Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:67187d51fda322bf8365b1c9e5b2322d7e752b92373fae13e902ab1ee0ee801a","observation_id":"37c08ce4-105c-4d6d-aae1-fdd6cfdb6c5b","resolution":{"observed_at":"2026-08-04T09:13:45.928079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:46.110853Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:46.110853Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:868958c797e7041c4e4e5caf4a9cc9841639fcf08b3515de4244334fbdb77c88","observation_id":"a838e487-a640-4b6c-b825-64fd357dffef","resolution":{"observed_at":"2026-08-04T09:13:46.110853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T12:13:33.685877Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2510.17059."}