{"as_of":"2026-08-17T22:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:594f09389836b34e7f209bfd44591d84a7bc1b32b869cb4f18041bdab1f69da6","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:49:22.597415Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15891/citation-record","integrity":"/paper/2411.15891/integrity","json":"/paper/2411.15891/citation-record.json","paper":"/paper/2411.15891"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.403485Z","title":"Constrained Markov decision processes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.403485Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:4c9b5bb4b85096ab55258bc042ba88d4c99a72a0a5e6e2aec2f2342270ae1b31","observation_id":"e5730b2e-a828-47f9-9db7-50efc51751c9","resolution":{"observed_at":"2026-08-12T13:49:22.403485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.093316Z","title":"Routledge, 2013","venue":null,"work_id":"e1517d5a-fb89-4aa5-8e5a-a974eb29beb7","year":2013},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.406267Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:424e2f6105800651a8f261218cff4b3bf6288b5455561fc2c4dbacc9915037f7","observation_id":"12300fe1-1be6-40ad-bd72-40d9bbc8c343","resolution":{"observed_at":"2026-08-12T13:49:23.095642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.086713Z","title":"Reward, motivation, and reinforcement learning","venue":null,"work_id":"9c5e873c-309f-45e3-93f3-bd892931c8af","year":2002},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.409277Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:3855305ec426b9b8ac42fcb72e113279e6281d3fcc3bd1e66c985e9bed49c2c6","observation_id":"8a77f1bf-fc4b-4949-9143-1e0469e68530","resolution":{"observed_at":"2026-08-12T13:49:23.089131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10936","last_updated":"2022-07-16T01:27:59Z","snapshot_observed_at":"2026-08-16T17:20:17.721189Z","submitted_at":"2022-02-18T15:15:46Z","title":"A Survey of Vision-Language Pre-Trained Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10936","snapshot_observed_at":"2026-08-12T13:49:22.411985Z","title":"A survey of vision-language pre-trained models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.411985Z"},"links":{"cited_paper":"/paper/2202.10936","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:f1da2f8b279104b71a384d6db28224a2e7d3acfec153a4b95c874fa35324c39f","observation_id":"fe8d358f-6622-41e2-b030-a2414705ac9f","resolution":{"observed_at":"2026-08-12T13:49:22.411985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.414852Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.414852Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:88c8d875c9d5549154cea2d9f1d3efc634d932c1f490f64772a925998dea2c70","observation_id":"4de2b189-1c2e-4e41-86c5-025e47a03736","resolution":{"observed_at":"2026-08-12T13:49:22.414852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-08-14T16:39:48.171461Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-12T13:49:22.417608Z","title":"Challenges of real-world reinforce- ment learning","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.417608Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:3a2d5d3cceca2b86e033a9d7149bdec9b533ac5f200f7f573054036bc64ce1a3","observation_id":"16a60ee7-862c-4707-835e-dee2b3826ad0","resolution":{"observed_at":"2026-08-12T13:49:22.417608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.422248Z","title":"Minedojo: Building open-ended embodied agents with internet-scale knowledge","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.422248Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:f48f42108019eb8c036aa200a65fba3816829b844e646c2ae26a7f3f0d02eaab","observation_id":"3409a428-f6ae-4849-ab2d-9f4df05da5d4","resolution":{"observed_at":"2026-08-12T13:49:22.422248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.425200Z","title":"Policy shaping: Integrating human feedback with reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.425200Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:95c48ba9739a1ae7d05b1c613303560e2813b7b5b1cfb7bf0d6add8786196ac8","observation_id":"d037a2e5-923a-4859-88e1-d7251c096643","resolution":{"observed_at":"2026-08-12T13:49:22.425200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06780","last_updated":"2022-02-12T20:02:13Z","snapshot_observed_at":"2026-08-16T17:56:40.043488Z","submitted_at":"2021-09-14T15:49:31Z","title":"Benchmarking the Spectrum of Agent Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06780","snapshot_observed_at":"2026-08-12T13:49:22.428266Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.428266Z"},"links":{"cited_paper":"/paper/2109.06780","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:aebfcb1a0d92ea4e39d80fd9980799954c0e92acf3e4682167765082d8330ae0","observation_id":"e0c32622-99b0-4e7f-a7e5-24d5a1210185","resolution":{"observed_at":"2026-08-12T13:49:22.428266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.066834Z","title":"Using reward machines for high-level task specification and decomposition in reinforcement learning","venue":null,"work_id":"121d94b6-86f9-44e3-b900-726cf5b26965","year":2018},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.431464Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:3868e9323b76fa9145c7832c929fe7b0d99517d1367309076d08ea720dd91791","observation_id":"7249f65d-f425-41c1-9887-bbb3f57e0980","resolution":{"observed_at":"2026-08-12T13:49:23.069945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.434197Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.434197Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:dbcc24f559a05a432b6167e4995c206a38f537ac0651067b3f8f04eee960dae5","observation_id":"f91fc658-83e0-4206-95f5-6305ac82f773","resolution":{"observed_at":"2026-08-12T13:49:22.434197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00001","last_updated":"2023-02-27T22:09:35Z","snapshot_observed_at":"2026-08-16T15:52:16.749650Z","submitted_at":"2023-02-27T22:09:35Z","title":"Reward Design with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00001","snapshot_observed_at":"2026-08-12T13:49:22.437321Z","title":"Reward design with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.437321Z"},"links":{"cited_paper":"/paper/2303.00001","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:807fe2ba16ce4028ecae877808d7f3fd722fe5eb4a517de0089ade3fe989330a","observation_id":"e52a120c-1d04-4860-9bba-02ba5df35fda","resolution":{"observed_at":"2026-08-12T13:49:22.437321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-08-15T10:58:31.329286Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-12T13:49:22.440447Z","title":"Deep reinforcement learning: An overview","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.440447Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:65edde25afa6f66f50cda35cef7dbff0d5e61f7f21810193eb48421536eec459","observation_id":"b4b6bb14-1776-43a9-af9c-09b861b19979","resolution":{"observed_at":"2026-08-12T13:49:22.440447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-12T13:49:22.443566Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.443566Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:1c7081db40dae5c07ad98c11e3736e3011a17341fe57809796d1d5cdf18ad76a","observation_id":"936a3f44-63da-45ab-8f05-074f56abeed3","resolution":{"observed_at":"2026-08-12T13:49:22.443566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-12T13:49:22.446439Z","title":"Eureka: Human-level reward design via coding large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.446439Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ea6a8057ade2516c8047476d362eeb6d540b2a8f13d49062e1c0eea0dc4e1ddb","observation_id":"06679766-064e-43be-99eb-09c151dedb3f","resolution":{"observed_at":"2026-08-12T13:49:22.446439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.449596Z","title":"Policy invariance under reward transfor- mations: Theory and application to reward shaping","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.449596Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:90aeecbe5d76175615ac93ab4ea954e5b64f96b935a69f7e52650054d2e7e916","observation_id":"c36864a1-fc4f-445c-8588-33f21e9b297c","resolution":{"observed_at":"2026-08-12T13:49:22.449596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.451642Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.451642Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:9ba85ad2cf5b2eb1f3471554e4c86046055df3036bdf89b88f09400849149eaf","observation_id":"7d38c55d-13b2-406e-8a4e-8be5b3cbafaa","resolution":{"observed_at":"2026-08-12T13:49:22.451642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T13:49:22.454044Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.454044Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:6c4e0a8725ddaadbbd848f884e2b888a426a78cea9b0d129bb571ceca90d24f8","observation_id":"f27520aa-6c16-492c-bb19-499631754dc9","resolution":{"observed_at":"2026-08-12T13:49:22.454044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.047161Z","title":"Common-sense and scientific interpretation of human action","venue":null,"work_id":"a19bb101-8bd6-499b-ba8b-dec05964d172","year":1962},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.456610Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:61ef5b6a5d0669adb4ae47700ba2ccfac2e57fe8620614ab10e7b1ae6249536b","observation_id":"ce3d7bed-052d-4a40-8067-94b8f74de25c","resolution":{"observed_at":"2026-08-12T13:49:23.050911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.459217Z","title":"Defining and characterizing reward gaming","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.459217Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b716b6880ef2b817319b6bd780ad67ec0c96ad35bb21d08d3da39cae9ed399af","observation_id":"264f7a10-4f8d-44d6-95b7-44060dedf42a","resolution":{"observed_at":"2026-08-12T13:49:22.459217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.461520Z","title":"Adaplanner: Adaptive planning from feedback with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.461520Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:86891f722eef56de1de354c9c55a5cd60b3b29cf22d72e7060b3a35a157e4104","observation_id":"e28a564e-f73d-4722-837f-ed08c3bcc499","resolution":{"observed_at":"2026-08-12T13:49:22.461520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-12T13:49:22.464096Z","title":"V oyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.464096Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:e9aeb9fd5caeb3504c9f996370b3ce6cc43acd046a6d1cbc676e6d1e4ac549de","observation_id":"8df67df2-7f27-4c70-9d24-1e2a7b942df1","resolution":{"observed_at":"2026-08-12T13:49:22.464096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01444","last_updated":"2024-04-14T03:47:19Z","snapshot_observed_at":"2026-08-16T14:56:09.352301Z","submitted_at":"2023-10-01T07:50:30Z","title":"Adapting LLM Agents with Universal Feedback in Communication","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01444","snapshot_observed_at":"2026-08-12T13:49:22.466971Z","title":"Adapting llm agents through communication","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.466971Z"},"links":{"cited_paper":"/paper/2310.01444","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:21093691056f8a6f16840b9054a657b60c3dac93139605ebb1b0d4ed5a57f5b3","observation_id":"67912c35-e889-4121-a4da-9fae28b5ad30","resolution":{"observed_at":"2026-08-12T13:49:22.466971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.032709Z","title":"Read and reap the rewards: Learning to play atari with the help of instruction manuals","venue":null,"work_id":"71c7e59c-69a7-4c39-97a1-b19b15a9099c","year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.469441Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0275012bb74aed4a6092941a7579e6219bf3c563faa3c25b1cc556e2d82da8f7","observation_id":"f3ceab26-fdc6-43c5-b71d-a11be1351dd8","resolution":{"observed_at":"2026-08-12T13:49:23.035442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.025624Z","title":"Spring: Studying papers and reasoning to play games","venue":null,"work_id":"0043e012-de3b-4f79-a116-81b59a6e8863","year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.472050Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:2c02960bb7685ee79e877a3aca6cf07ba8ddcca9bd453ffc02ea23954afb8adf","observation_id":"1af16bc7-5f2b-4aa0-b907-dcc65a32a5ca","resolution":{"observed_at":"2026-08-12T13:49:23.028424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-17T06:15:32.510873Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-12T13:49:22.475284Z","title":"The rise and potential of large language model based agents: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.475284Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:55cc35715141a4d59c6a43f293e259153be15967952f56124b2a9b3e73e14f8a","observation_id":"13a21f45-de4b-420e-a84c-c2dadda6046d","resolution":{"observed_at":"2026-08-12T13:49:22.475284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.018306Z","title":"Language models meet world models: Embodied experiences enhance language models","venue":null,"work_id":"18fe945c-0c59-481f-9f59-eb8fa026176c","year":2024},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.479025Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:7dfdb5b40639d1ba11991a403392e29949dc342f8c602adc08829321fcc539e6","observation_id":"4b27f341-6dba-45e7-bff7-c4c47ed1846c","resolution":{"observed_at":"2026-08-12T13:49:23.021347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11489","last_updated":"2024-05-25T06:42:10Z","snapshot_observed_at":"2026-08-16T14:59:02.373142Z","submitted_at":"2023-09-20T17:39:13Z","title":"Text2Reward: Reward Shaping with Language Models for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11489","snapshot_observed_at":"2026-08-12T13:49:22.482971Z","title":"Text2reward: Automated dense reward function generation for reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.482971Z"},"links":{"cited_paper":"/paper/2309.11489","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:27ba8cbc2302ad9cb8492b0678479dd293207a69969f97fd2b36c8a5fe819c04","observation_id":"e10fc02c-5a48-4546-9eb0-6ef2a4909a80","resolution":{"observed_at":"2026-08-12T13:49:22.482971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01711","last_updated":"2024-02-15T02:57:22Z","snapshot_observed_at":"2026-08-16T15:27:02.984230Z","submitted_at":"2023-06-02T17:32:17Z","title":"OMNI: Open-endedness via Models of human Notions of Interestingness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01711","snapshot_observed_at":"2026-08-12T13:49:22.485844Z","title":"Omni: Open-endedness via models of human notions of interestingness","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.485844Z"},"links":{"cited_paper":"/paper/2306.01711","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:49367b8d0f07d2545b2b34216c8af63b8142be1cd3aa0759c4a77a765a0230ba","observation_id":"5ea22727-e5cb-4801-964e-7cb077289ecc","resolution":{"observed_at":"2026-08-12T13:49:22.485844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17144","last_updated":"2023-06-01T09:18:01Z","snapshot_observed_at":"2026-08-16T02:27:56.530647Z","submitted_at":"2023-05-25T17:59:49Z","title":"Ghost in the Minecraft: Generally Capable Agents for Open-World Environments via Large Language Models with Text-based Knowledge and Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17144","snapshot_observed_at":"2026-08-12T13:49:22.488729Z","title":"do\" (which means","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.488729Z"},"links":{"cited_paper":"/paper/2305.17144","citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:89b334b100a9aacdec5130f0c64b9bda6c1b4b06d782fb83c4475f82ee740f2e","observation_id":"efa46d08-1148-460f-9781-6f35a2d6a8a4","resolution":{"observed_at":"2026-08-12T13:49:22.488729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.010886Z","title":null,"venue":null,"work_id":"efe87ae7-4834-4471-a8b0-d3a0c87c7810","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.491989Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:d8f4baa5de767d512fb8da58d8bfbfc1224f1d71a93c90b01129748b8f5ad9d6","observation_id":"4a74a080-8481-4c52-82ff-6f8a93feb884","resolution":{"observed_at":"2026-08-12T13:49:23.012959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:23.004657Z","title":null,"venue":null,"work_id":"979f9b8b-53b9-4b54-993a-6263562a3b97","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.494749Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:486b6eb60b258b5293ae04f3b94ebb5d3b0f5b5cef3043733608f34dea1a6fd5","observation_id":"46a8fe70-3469-4916-90d0-81478148b121","resolution":{"observed_at":"2026-08-12T13:49:23.007094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.998055Z","title":null,"venue":null,"work_id":"46154cda-7ffe-4e92-83d4-54a0fd62338f","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.497747Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:eedbf6cf0c215be5f6fc779a8ed1977de3b9ea5ea8b624ebed3fbbb3c07060ce","observation_id":"7b929018-5046-4546-b087-aa7c99c0b3f6","resolution":{"observed_at":"2026-08-12T13:49:23.000850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.992069Z","title":null,"venue":null,"work_id":"7322970b-1d82-465a-bb4b-6a0381ab4bed","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.500397Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b8c2d3b907fd5cdb973a7e5f941df4c532355d96cf9e8543d9af75d07695eb92","observation_id":"e621dc82-1499-403e-9df5-4014b9563a5a","resolution":{"observed_at":"2026-08-12T13:49:22.994241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.986231Z","title":null,"venue":null,"work_id":"7c3a40d7-b746-4989-a1db-5696099754c7","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.503135Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:afbc129d826470e6f39c9de0f1830e482d2b0879d71b8c89b3c184a4abde7fb3","observation_id":"6d685bb7-6749-4618-84e8-8eb7bd3161b2","resolution":{"observed_at":"2026-08-12T13:49:22.988326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.979917Z","title":null,"venue":null,"work_id":"40b08367-6202-4ff5-bf14-7cbb12e3157a","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.505707Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ba81953aaff3d48af935d6913f204bc466c34a3882c45b003abd068fd43fa57d","observation_id":"66474603-aa76-4732-a49b-5a0f34c193e7","resolution":{"observed_at":"2026-08-12T13:49:22.982408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.972931Z","title":null,"venue":null,"work_id":"694ad2ef-8933-43b6-9897-7f5cdb30d461","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.508195Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:a54d4b7569c263ed076003546bb5c4150ad83be27ea9c3d57532f2e786dabcb2","observation_id":"d9a7c310-31e7-48f7-9b94-ddd5cc33ef07","resolution":{"observed_at":"2026-08-12T13:49:22.975598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.966212Z","title":null,"venue":null,"work_id":"2467f3a2-02e3-4d51-8773-946c9aa001c2","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.510429Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:ef9f487d593764366337d5658b43eae40b2a30d474feab9104136628dcd457c3","observation_id":"3fe177cc-efbc-44ba-8641-11f028878161","resolution":{"observed_at":"2026-08-12T13:49:22.968782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.959493Z","title":null,"venue":null,"work_id":"a64a7d6f-1f3a-42ef-bb0f-2de92684493b","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.512541Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:14c422b52c2d380c4079160bbc736783dcb081f9625b94b494fdece94eb4d695","observation_id":"41c1f031-09b0-43be-aba5-18972c6e6f80","resolution":{"observed_at":"2026-08-12T13:49:22.962060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.952697Z","title":null,"venue":null,"work_id":"08e849f9-3b3a-495d-baf9-91942229fbaa","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.514506Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:20d324ece5e4d3976b1aa2e25daf667d629405c3931e056287b24694ed6ffc7d","observation_id":"3b50d6bb-ab1e-4b4b-ae2f-f1e391e5fd38","resolution":{"observed_at":"2026-08-12T13:49:22.955190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.945992Z","title":null,"venue":null,"work_id":"44de65b1-4533-4dcf-ad6e-99871d8091a4","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.516639Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:8f8a82fb233ca1df00dbb97fb451c4f2aa00eeabdd8e9b6ff7026a7c0ea318f5","observation_id":"fde7b0de-3a64-4066-a508-30610fab0051","resolution":{"observed_at":"2026-08-12T13:49:22.948571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.939709Z","title":null,"venue":null,"work_id":"356e2912-7ee5-4766-9b73-1b339f5ef27d","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.519215Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:64866e65341edaba51a4ea8a78f8ba0a629822dd466ba3c2927b638b4330e77c","observation_id":"00e9ad08-24d0-4348-8a51-8fe3b303c352","resolution":{"observed_at":"2026-08-12T13:49:22.942247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.933860Z","title":null,"venue":null,"work_id":"eb95ee86-afc5-4097-b0c6-ca07a271d59d","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.521211Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:d038ac6247a4314bde9f3e87df32681e3ddf49228c7f0488b8b9eac8fcb6a5f7","observation_id":"83dbc9e3-3687-4fe2-8559-7c95b456ca8b","resolution":{"observed_at":"2026-08-12T13:49:22.935943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.927896Z","title":null,"venue":null,"work_id":"1e40161a-a242-4d01-8ab4-9720ec3b0e4f","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.523280Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:9a0955a85e9f39971a9dd75a63fa34cdd047d39e4acf31940b4125d1afcd9cd9","observation_id":"bebd3f05-7696-4be3-98cb-e1761a8ffe6a","resolution":{"observed_at":"2026-08-12T13:49:22.930201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.921571Z","title":null,"venue":null,"work_id":"b6081ce0-e381-4071-a77f-efe7b45e8848","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.525420Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:52a7bc0e212cd326f96ad2bacf965ec8b06fb2747281c863460c1c00fb0660f1","observation_id":"ea5ee6bc-b48d-4bc2-aa8a-b9bd9933e8e1","resolution":{"observed_at":"2026-08-12T13:49:22.923861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.915875Z","title":"sleeping","venue":null,"work_id":"559db1da-e3b0-4ee0-8cc4-e19d22b2181d","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.527692Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:437b92e01f8d64842290b85a85fbfe993b3e219ac8d166eea9382ae09ba38043","observation_id":"d4f4f4de-532b-4e11-beb4-92af02666f2b","resolution":{"observed_at":"2026-08-12T13:49:22.917802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.909066Z","title":null,"venue":null,"work_id":"86b63856-5c9c-4916-845e-2bc0f035aa67","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.530172Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:2e45a545ed04dab2e8305df5efc6f3348c7e0b06d2f2f07e7732cfb14a90fe7c","observation_id":"45878069-6aeb-412c-b3db-74664c42074b","resolution":{"observed_at":"2026-08-12T13:49:22.911742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.901779Z","title":null,"venue":null,"work_id":"8406aa99-2c26-4595-a4ea-06eee9799179","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.533371Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:36a8640767e637939f70c96f0af4f1d30a865527467b01a545e3d395b7fcfc92","observation_id":"6cc88eea-2c4c-4a40-b288-702100e5d486","resolution":{"observed_at":"2026-08-12T13:49:22.904332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.892637Z","title":"Successfully collected iron from the grid directly to the right of the player, converting it from an iron() to path(), without affecting other attributes or nearby grids","venue":null,"work_id":"142ede76-5b14-4373-b40f-7f14ca08226b","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.535817Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b46f0107b602ef82f9329c6515f393d920233fc359b70bd6ba33fba3850f481b","observation_id":"200f1df5-ddd4-430d-bc27-a8a99db98d7b","resolution":{"observed_at":"2026-08-12T13:49:22.896847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.884768Z","title":null,"venue":null,"work_id":"73e26dd9-382e-4b84-bbd1-b2b0de0bf6bc","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.538590Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:104f8b1801fe65568fa3bc98896b420a9465683dd3746fee2076c9e46a70f9ac","observation_id":"f9966044-20dc-4c3f-af9d-aaaa34cd449f","resolution":{"observed_at":"2026-08-12T13:49:22.888405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.877286Z","title":null,"venue":null,"work_id":"c6e73a80-fbbd-41c8-843d-539ac132a9e6","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.541641Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:f618737af95ff37f3c3383a0314c2a493750d7cc07eab994d2072b0062e3533f","observation_id":"6b64fc6c-d066-4048-97cd-b2cce6abe3be","resolution":{"observed_at":"2026-08-12T13:49:22.879821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.871810Z","title":null,"venue":null,"work_id":"2a491f1b-7412-468c-813c-2a056d80e984","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.544952Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:3e95fb88db19acbe5c85331a8d401c9688674d058dce3d30b2b974cc80c7dcb5","observation_id":"2f633399-fdb2-4d51-87d3-ec9d321080ae","resolution":{"observed_at":"2026-08-12T13:49:22.873705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.865905Z","title":null,"venue":null,"work_id":"bd52a326-29ec-4e63-9d8a-e884d0948bde","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.547816Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:dea87ab1f7ff545422293e6586b0aad9d1d7d85175b3db97b486d2fab56dfb84","observation_id":"b4391285-1389-4f95-b3fe-0280b6d1a2c7","resolution":{"observed_at":"2026-08-12T13:49:22.867973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.860156Z","title":null,"venue":null,"work_id":"9511f1b8-a432-4c7c-ad1c-13f1344b473f","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.550982Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:509a8249adb7e60daf3075f931b2b056816498f06f86f447f87ded62aede1d92","observation_id":"347fa5f9-e611-494b-a1df-64d30fd70e28","resolution":{"observed_at":"2026-08-12T13:49:22.862268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.854279Z","title":null,"venue":null,"work_id":"e3a72a60-fc24-49ff-9a32-0123194f7644","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.554156Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0b0c322fb2620d8bdebd01e5d1472ea60bc2844a1cfca91980712d4d99ee1c23","observation_id":"e4618e09-9713-4090-b117-68114f72c6cb","resolution":{"observed_at":"2026-08-12T13:49:22.856390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.848330Z","title":null,"venue":null,"work_id":"f950bb0f-727c-4c42-9743-22d3faf57024","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.556895Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:f66cc7dc8cf277ffc495cc7602cf7422b7c889deb57e9f32a12b488b73c6aff6","observation_id":"508d8b72-78b6-41ea-8b47-240babd5e45b","resolution":{"observed_at":"2026-08-12T13:49:22.850370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.841524Z","title":null,"venue":null,"work_id":"d1f52902-5b07-4244-8add-75f6a936df68","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.559870Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:4dd643050db61036fc97b0daf10a82c35d8556633a2d75081ea9894adcb66dac","observation_id":"641a49b5-e437-4936-98cf-bf6262ee6027","resolution":{"observed_at":"2026-08-12T13:49:22.844113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.834403Z","title":null,"venue":null,"work_id":"b3a4e65f-8a04-4ff4-a325-74fe560c7c71","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.562918Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:bbb9a0a947ac75b70312eca4fee36172a1d5856f7cda1bee9df1ff7fac62e119","observation_id":"282bf817-c163-4a6a-846d-b49d62b415e2","resolution":{"observed_at":"2026-08-12T13:49:22.836898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.826625Z","title":null,"venue":null,"work_id":"2fc87a26-76b7-4ce3-9516-c42912680ea5","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.565932Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0b7dfac0d507e54d31366a16f3afb4685f66ac4b96d7bf11c01404cd82753aa5","observation_id":"f3eb0622-46cf-4bb7-b3d6-0cb8a6326d3a","resolution":{"observed_at":"2026-08-12T13:49:22.829329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.817038Z","title":null,"venue":null,"work_id":"6fa5752d-1cab-48a5-afff-54475512866e","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.568968Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:aeebaf31f5222c89e5b6b09dda7f4d5e06f573fdc33afa4db917a3f95df990ee","observation_id":"b3f48125-48b6-43ed-9f82-9820ae7e0372","resolution":{"observed_at":"2026-08-12T13:49:22.820455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.808718Z","title":null,"venue":null,"work_id":"1b07b3d7-510c-4a5c-a981-cddc304eff2c","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.571729Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:a6e7cfd5305e0860a2aab8a051f0f2f696afc2e1c3e77804ec8c8804ff0b7777","observation_id":"52098a18-0407-4a57-b008-b4c58db2395c","resolution":{"observed_at":"2026-08-12T13:49:22.811591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.800228Z","title":null,"venue":null,"work_id":"06b00a13-981d-41bf-953a-9e62b45a5ccb","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.574013Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:d0f10909473306954b8dd60bdad141ada330436250cd430f71a67bb1666f7e37","observation_id":"e0921cda-c1f5-432e-b86a-be8f930aedc6","resolution":{"observed_at":"2026-08-12T13:49:22.802846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.792555Z","title":null,"venue":null,"work_id":"2afca51e-d6f0-4981-8989-c3e0d898ea1a","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.575885Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:dd7ed7e71b543c3ba109113ac5c3484657b7992866d22c76c400658b4296569f","observation_id":"bd99934c-0bef-4d82-88fb-052bc0b489cd","resolution":{"observed_at":"2026-08-12T13:49:22.795132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.785699Z","title":null,"venue":null,"work_id":"5461a7d9-5534-47c0-827c-05a3a9dccbf1","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.577954Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:0bb9d7346ad1d6616312d9ae46ed4a9a182bca76189ab5abf305d2fe2717c14a","observation_id":"e31ce025-e848-48d6-92c3-c051183bf464","resolution":{"observed_at":"2026-08-12T13:49:22.787992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.778655Z","title":null,"venue":null,"work_id":"6c132e1b-f8f6-4486-935c-c523b79c3ae2","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.579829Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:9d88b298651adcbcc93000776ff093a487ab5afd6cb23b7bd74e3ff64832c8ca","observation_id":"90dab58b-7474-4a12-802a-47ba440a0ac5","resolution":{"observed_at":"2026-08-12T13:49:22.780964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.769846Z","title":null,"venue":null,"work_id":"7b00dbc3-0522-4e35-b71c-fd4722b55226","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.581989Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:585768cc433b5fd4ef106f14fd2dcbb4bfe403c65c9fab61d8d1514e404277ae","observation_id":"6bb94166-6052-4d3f-a10f-4fcf1115e681","resolution":{"observed_at":"2026-08-12T13:49:22.773772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.762626Z","title":null,"venue":null,"work_id":"57a0283d-a91a-4ed4-a51b-bb682e1f82a0","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.583906Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:35a930b9e8cd4d0d5360cc6961e48cdf4788583cd55adb7e5513d567b30e49f8","observation_id":"d37fd1cd-cf5d-4132-ae7a-26a3f7f9c666","resolution":{"observed_at":"2026-08-12T13:49:22.765203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.754381Z","title":null,"venue":null,"work_id":"2c37cda8-d4a4-4668-84eb-9fbccfda004a","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.585940Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:66bd1e4ba13a53de65f46b21f3f578bf70f038fdcdacb3b002ea47246044789e","observation_id":"954c261e-7907-4cb0-9b76-65439a5224f4","resolution":{"observed_at":"2026-08-12T13:49:22.757858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.746194Z","title":null,"venue":null,"work_id":"5655c2a3-455a-4495-8926-aa65dcf85244","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.587707Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:58bc52df98f8b71eefb9cff566bbcf0380b55c1d0023ae4f8bd8805a69954b5d","observation_id":"2d74857a-7325-4476-8f28-ba68a212a0ec","resolution":{"observed_at":"2026-08-12T13:49:22.748655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.737788Z","title":null,"venue":null,"work_id":"bc998c6e-af1e-474d-8bc9-d8d4beda330c","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.589584Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:f7af0e368b7676b00fe46ae737493c18ca06982ca91029ec92aefbf5e3641148","observation_id":"c467ebd5-cbd9-487b-a035-2a2dc58c5679","resolution":{"observed_at":"2026-08-12T13:49:22.740583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.731225Z","title":null,"venue":null,"work_id":"a1feefe7-b9bf-435d-b470-7959958f4a26","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.591330Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:89b0570222e19ee9a46c2d0114049c267090118cdeb02088cca986f9b34b3340","observation_id":"c5ceb2f5-480c-40f3-931d-02b6243b41ff","resolution":{"observed_at":"2026-08-12T13:49:22.733505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.724685Z","title":null,"venue":null,"work_id":"84ed3fe1-e363-49c5-9dd3-f6ab97c4844e","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.593280Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:3db128ab1654cd92d860cf3c084b9ee2d6f3027502f97d2e5caefa22557bda0e","observation_id":"b401951b-4a44-41c7-ba1a-a4cfc9ad7d49","resolution":{"observed_at":"2026-08-12T13:49:22.726771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.717493Z","title":null,"venue":null,"work_id":"8943a025-7c86-4904-80a2-d3824c6faacd","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.595268Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:b79caa6ce124733ffffff5d54d4af439be292ca6909c0245f1926fb6a1dc2c49","observation_id":"831c091e-1f53-4432-b106-10e4be9b3718","resolution":{"observed_at":"2026-08-12T13:49:22.719543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:49:22.708997Z","title":null,"venue":null,"work_id":"22e85ccb-bbd5-44e9-853c-d854333b650c","year":null},"citing_paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T13:49:22.597415Z"},"links":{"citing_paper":"/paper/2411.15891"},"observation_digest":"sha256:e4aff7ebcd86f79df7cbe2cf736f99b54e73ed3d27da590d184396951c076bd5","observation_id":"85c5164e-2f7a-4d30-8605-cac959ef08ba","resolution":{"observed_at":"2026-08-12T13:49:22.712371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15891","last_updated":"2024-11-24T15:57:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T23:43:09.136629Z","submitted_at":"2024-11-24T15:57:53Z","title":"From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2411.15891."}