{"as_of":"2026-08-23T01:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38554d3858baa045395318b00ca5f23161cbd29894e88f627977ae5e1d6814cb","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:56:44.297886Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.00381/citation-record","integrity":"/paper/2501.00381/integrity","json":"/paper/2501.00381/citation-record.json","paper":"/paper/2501.00381"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:45.046781Z","title":"Human Compatible: Artificial Intelligence and the Problem of Control","venue":null,"work_id":"0d710faf-bc64-4ad4-9ee5-2cb35579ed2a","year":2019},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.174953Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:70ef6fc234480272760b268990a31009681249c4d0302990938569389345ba89","observation_id":"a73649d9-245e-440e-9ee3-08a4a786a07a","resolution":{"observed_at":"2026-08-10T22:56:45.052130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:45.031366Z","title":"Active learning for reward estimation in inverse reinforcement learning","venue":null,"work_id":"7b0fe50c-7150-4a3d-a52c-4dc520f763c1","year":2009},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.181767Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:39ee57a83c3432db3f8768bc454608f0dbd4f7118a981d066582d13fe6e9db63","observation_id":"d55e18c0-50d2-4b12-8c4b-afd1d4db1c30","resolution":{"observed_at":"2026-08-10T22:56:45.036331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:45.015768Z","title":"Brown, Yuchen Cui, and Scott Niekum","venue":null,"work_id":"caa0a47f-2d01-4368-b11f-873036dfc922","year":2018},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.187998Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:4038926b5f3141ed7b8915b42fea426c0f1a0dfd66b67c5d276671d61a7b5f69","observation_id":"c86268c7-2074-4caa-aa07-505887ce5bf8","resolution":{"observed_at":"2026-08-10T22:56:45.020690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.998795Z","title":"Provably Efficient Learning of Transferable Rewards","venue":null,"work_id":"0cce270c-18f0-4dd5-a645-92a12cf206ac","year":2021},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.194479Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:3c7b38803e9d62c32039536b684622b5a658d2f0a36a0e75364ab2add42db814","observation_id":"1a10a6a2-d163-435e-b883-5c7f459af65a","resolution":{"observed_at":"2026-08-10T22:56:45.004047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.983304Z","title":"Trajectory-based active inverse reinforce- ment learning for learning from demonstration","venue":null,"work_id":"b63c7c2f-820d-4a04-86c9-96379be5d7ed","year":2023},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.199580Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:a99f2755da84c4156e29db62caa59663f2d4be8db41b8d498162c3e60c94580c","observation_id":"7c3af399-514d-47a6-b3dd-e0e33d5d36f6","resolution":{"observed_at":"2026-08-10T22:56:44.988531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14545","last_updated":"2023-11-29T10:20:19Z","snapshot_observed_at":"2026-08-16T15:52:06.123148Z","submitted_at":"2023-02-28T13:10:04Z","title":"Modern Bayesian Experimental Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14545","snapshot_observed_at":"2026-08-10T22:56:44.205492Z","title":"Ivanova, and Freddie Bickford Smith","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.205492Z"},"links":{"cited_paper":"/paper/2302.14545","citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:3f7d7cedb9a8282354d04868428df2c8147dece519cecb0bde7f49332231ac14","observation_id":"01122049-58e0-4676-b163-a2f447626763","resolution":{"observed_at":"2026-08-10T22:56:44.205492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02811","last_updated":"2018-07-08T13:06:26Z","snapshot_observed_at":"2026-08-18T00:58:48.914606Z","submitted_at":"2018-07-08T13:06:26Z","title":"A Tutorial on Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02811","snapshot_observed_at":"2026-08-10T22:56:44.211639Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.211639Z"},"links":{"cited_paper":"/paper/1807.02811","citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:55ab6a0219370c00597308cc67e03999b360c1274c013e889b05d6f6aebc8b22","observation_id":"090e4c14-29e7-48fe-b7f5-9d15980bff4e","resolution":{"observed_at":"2026-08-10T22:56:44.211639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.217089Z","title":"Bayesian optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.217089Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:70ca7a8da8a9d858af8a2d609eaae86b6d89065483d97cf0b87ea9ab7a87c95e","observation_id":"669aee4f-deed-4be2-a39d-d5aeb5abe8a7","resolution":{"observed_at":"2026-08-10T22:56:44.217089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.957473Z","title":"A versatile stochastic model of a function of unknown and time varying form","venue":null,"work_id":"55476738-09f1-4ae3-9fb4-5b6df07cb357","year":1962},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.221378Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:0c7c28d10dc94fa401e2634be61f12129bcc7e101929888811b0b934703ac560","observation_id":"8afa3070-cc2d-474f-a31c-1eef6f8137b1","resolution":{"observed_at":"2026-08-10T22:56:44.962347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.227198Z","title":"Learning agents for uncertain environments (extended abstract)","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.227198Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:682bf9c9e6db9aec3434b2e866cc23341daf8d790a3f4b9b6afbae98877096d9","observation_id":"5e8d4b3e-14c0-4b66-8237-d3baab7b618c","resolution":{"observed_at":"2026-08-10T22:56:44.227198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.231991Z","title":null,"venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.231991Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:a63280093a4b0f7a4baf4415371aafad031a4ed1380e39f0835d1503dc2fe35a","observation_id":"c8fe45fc-2de4-468f-9d08-314a644a1fb5","resolution":{"observed_at":"2026-08-10T22:56:44.231991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.237339Z","title":"A survey of inverse reinforcement learning: Challenges, methods and progress","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.237339Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:3640ee23bcb7a9a2a145ea90fa340aaad5c7db1ecab3aac82c56140ed30a3477","observation_id":"f9ea9e3e-dab3-424e-be90-a422eccf3a03","resolution":{"observed_at":"2026-08-10T22:56:44.237339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.942138Z","title":null,"venue":null,"work_id":"5231a632-9cfd-484e-997c-a3ed9f77e3f1","year":2022},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.242088Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:adb164af2d40bdb1698f8faebae625c5109262565688b1083e9f424022560c2f","observation_id":"c9042d4f-cd21-406e-a8fc-26ea3e908867","resolution":{"observed_at":"2026-08-10T22:56:44.946828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.924092Z","title":"Bayesian Inverse Reinforcement Learning","venue":null,"work_id":"3b6bbc4f-68f3-4fb0-8ae6-8b2cccb598a4","year":2007},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.252121Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:c8dc07df6729192deb0c705ff8fd8506a4e23e2e69030df5cbca75245d8f461a","observation_id":"beecdc7d-8bcf-456c-8163-24c8be05bebf","resolution":{"observed_at":"2026-08-10T22:56:44.931392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.908151Z","title":"Environment Design for Inverse Reinforcement Learning","venue":null,"work_id":"6221a8b2-a02f-4eb7-bf5b-345eec754161","year":2024},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.256621Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:70be289bfc2de1dd8048299e771fe97dbc353e4081b2f0a1727937dcae84b1c4","observation_id":"e2f8d37e-c5f8-4bd2-8607-8d5cd19b7f00","resolution":{"observed_at":"2026-08-10T22:56:44.913446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.891049Z","title":"Interactive Inverse Reinforcement Learning for Cooperative Games","venue":null,"work_id":"fd680150-fbf5-4319-afdd-655daab37b39","year":2022},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.261156Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:d6d16cd127a202391d1a28cffcdfafd3d76150663b4010e3d399266db7744059","observation_id":"465724d2-ddbd-41b1-9593-958e47323240","resolution":{"observed_at":"2026-08-10T22:56:44.896509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.265705Z","title":"Active Preference-Based Learning of Reward Functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.265705Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:5397e6341935648eb0dfb1239192c6bd1d2f03e4e237b2b03eaa129c35459e8d","observation_id":"f82e5197-958b-468c-8ee4-2e32d8bb4ad4","resolution":{"observed_at":"2026-08-10T22:56:44.265705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.872242Z","title":"Losey and Marcia K","venue":null,"work_id":"18418032-8372-474d-9a90-8fa533d0996d","year":2018},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.270419Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:35fbd58126eaf4958c1454786a8cd37efdeff0d5911d130dff8fb4176d58e136","observation_id":"6be15342-e14f-42aa-8e2b-ff395a73e335","resolution":{"observed_at":"2026-08-10T22:56:44.877389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.853957Z","title":"Active Exploration for Inverse Reinforcement Learning","venue":null,"work_id":"211bd0f7-de8a-4002-80aa-9289b80f78b9","year":2022},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.275977Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:d6e4daa70dcacab96f3b8876885368fc93e1cb0873678766060987c94248f226","observation_id":"2b0ca698-522a-475f-94c5-03628a697269","resolution":{"observed_at":"2026-08-10T22:56:44.860614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.838027Z","title":null,"venue":null,"work_id":"e98a355d-14b1-4c72-b30e-456a43a74cee","year":2024},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.281234Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:680e139e12e2fd137b285f9d6f27ed62547fdad4e88547dc45c58404c6c8cd24","observation_id":"8710d1a6-0b99-4929-84bd-7e3c8512175b","resolution":{"observed_at":"2026-08-10T22:56:44.842815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.821321Z","title":"Scalable Bayesian Inverse Reinforcement Learning","venue":null,"work_id":"0b0a0b44-d445-4afb-883f-b4ec9bfae56f","year":2021},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.286658Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:89d77d47653b0538da73227dff6a7c1744bd0d0b12506bf1c517da5114cb525a","observation_id":"32ec3210-06e7-4363-b1ff-aac7dd90a4db","resolution":{"observed_at":"2026-08-10T22:56:44.827252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.292149Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.292149Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:14707ff70ad5248cfc1179f89c13cfcc72be3e78624b59f6e787f8700787b491","observation_id":"0190ef5a-e3b9-4a71-8a22-2ee84ab6bb3e","resolution":{"observed_at":"2026-08-10T22:56:44.292149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.804648Z","title":"upper bound","venue":null,"work_id":"cac3088d-abe2-4207-a578-5443f0e40b4f","year":2014},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.297886Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:33e57b871f1830959355a7e77accf94312fa490c8b6bdc8dfce40e1534d17952","observation_id":"417d667c-ca71-4777-a691-e628207536b3","resolution":{"observed_at":"2026-08-10T22:56:44.810401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.247119Z","title":"URL https://link.springer.com/10.1007/ s10462-021-10108-x","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":7462,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.247119Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:8868aa9e65cb3bd2b9fad24d1565fbf0bf51f1d46e6975952c4646bf37e07651","observation_id":"cc468039-ed6b-44b2-b261-1417190f41c2","resolution":{"observed_at":"2026-08-10T22:56:44.247119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T17:20:54.994403Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2501.00381."}