{"as_of":"2026-08-16T01:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c14667cfcc370df47473426270b31d55580fc2ad1084d153066797f4ff1273e4","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T04:00:47.056185Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08647/citation-record","integrity":"/paper/2607.08647/integrity","json":"/paper/2607.08647/citation-record.json","paper":"/paper/2607.08647"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-00982-2_1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URLhttps: //doi.org/10.1007/978-3-642-00982-2_1","venue":"Lecture notes in computer science","work_id":"13ea27f4-e2e2-4fea-9f79-d974ef3a7368","year":null},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:4635d50138c0f7914cdb2f71fc12e3bee9fe3a1a7fdfa760e5c1af5513fab03b","observation_id":"208e9110-1738-43dc-8668-0ea9739d0691","resolution":{"observed_at":"2026-07-10T04:06:44.494310Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-17T21:51:25.054703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T21:51:25.054703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.09712","last_updated":"2020-03-21T17:53:26Z","snapshot_observed_at":"2026-08-13T12:34:05.360819Z","submitted_at":"2020-03-21T17:53:26Z","title":"Understanding the Power and Limitations of Teaching with Imperfect Knowledge","version":1},"cited_work":{"arxiv_id":"2003.09712","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.09712","snapshot_observed_at":"2026-07-10T04:06:44.794035Z","title":"Understanding the Power and Limitations of Teaching with Imperfect Knowledge","venue":"cs.LG","work_id":"6e03c4bc-5bbe-472b-b3fc-b2533a83402d","year":2020},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/2003.09712","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:0ca8a89d6dd68c842cedf1da4fbaa46117f765cc40f161f0b982b37d0644cf36","observation_id":"724bce8f-8f9f-4345-bdfe-4a3af69c8bed","resolution":{"observed_at":"2026-07-10T04:06:44.795817Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11248","last_updated":"2018-08-13T18:33:24Z","snapshot_observed_at":"2026-08-14T20:18:41.596978Z","submitted_at":"2017-10-30T21:22:28Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1710.11248","doi":"10.48550/arxiv.1710.11248","metadata_source":"pith","pith_arxiv_id":"1710.11248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning","venue":"cs.LG","work_id":"2564d6da-3b91-484b-8a81-b84704794698","year":2017},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/1710.11248","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:02903cf652a7523b9a84fe0a75c9375645b33d9b47148a1ea8fa3823466d0aad","observation_id":"89ae9dcb-9b29-4a60-bfdc-084100c778b2","resolution":{"observed_at":"2026-07-10T04:06:44.799707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.254217Z","title":"The effect of modeling human rationality level on learning rewards from multiple feedback types","venue":null,"work_id":"2747165b-84b3-4d25-9aa6-5d7009ea9d39","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:5d583ec206402346967ac5fabbf202f247e8a4b0c81255c4d05168d3e8acf59d","observation_id":"0cfe838c-0d66-413a-bbbf-cf1ecf6df5d8","resolution":{"observed_at":"2026-07-10T04:06:45.255728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09884","last_updated":"2021-11-18T18:59:33Z","snapshot_observed_at":"2026-08-13T17:31:46.472814Z","submitted_at":"2021-11-18T18:59:33Z","title":"Assisted Robust Reward Design","version":1},"cited_work":{"arxiv_id":"2111.09884","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.09884","snapshot_observed_at":"2026-07-10T04:06:44.785062Z","title":"Assisted Robust Reward Design","venue":"cs.RO","work_id":"81f90cf0-03e1-4dc2-8f07-6c8940ac6889","year":2021},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/2111.09884","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:507c9cfe117d0db987e4dd5994b6fc02d91dba08064f45b05ae84ca2c312b4be","observation_id":"4bbd38d5-4249-47c0-bb47-2893f642f869","resolution":{"observed_at":"2026-07-10T04:06:44.786673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11867","last_updated":"2019-06-05T21:51:13Z","snapshot_observed_at":"2026-08-14T16:25:09.374754Z","submitted_at":"2019-05-28T15:03:14Z","title":"Interactive Teaching Algorithms for Inverse Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.11867","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.11867","snapshot_observed_at":"2026-07-10T04:06:44.791180Z","title":"Interactive teaching algorithms for inverse reinforcement learning","venue":"cs.LG","work_id":"67d5d17e-f48d-4eef-bf9e-f98ff4a53916","year":2019},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/1905.11867","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:4e189edb532a27b0f9344205578aa4449a7d91ba566343346506a0a94c4b5c72","observation_id":"eab54314-22fd-4d18-8bc3-a2d7e765b742","resolution":{"observed_at":"2026-07-10T04:06:44.792911Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3623384","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mehta and Dylan P","venue":"ACM Transactions on Human-Robot Interaction","work_id":"e762a788-d67a-482b-ab6b-d9880bd0a0ac","year":2024},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:a10bef3fcf50fed89c5436818862320330f580054b315da9b5d6e8d5bfa7fa87","observation_id":"165abf34-3469-4981-a613-e4638b6b1fc0","resolution":{"observed_at":"2026-07-10T04:06:44.496762Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-17T21:51:25.561921+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T21:51:25.561921+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03515","last_updated":"2025-01-07T04:17:15Z","snapshot_observed_at":"2026-08-13T12:48:45.419654Z","submitted_at":"2025-01-07T04:17:15Z","title":"Effects of Robot Competency and Motion Legibility on Human Correction Feedback","version":1},"cited_work":{"arxiv_id":"2501.03515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03515","snapshot_observed_at":"2026-07-10T04:06:44.787718Z","title":"Effects of Robot Competency and Motion Legibility on Human Correction Feedback","venue":"cs.RO","work_id":"751fe732-7a69-4483-820c-ed7516267c69","year":2025},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/2501.03515","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:5bcaae8e729b6d1d99c637b2831e2605152bceb6951a1c93b9fad4cda5037c58","observation_id":"f31d1d4c-ea9e-4b6a-856b-c57a00822c25","resolution":{"observed_at":"2026-07-10T04:06:44.789465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.05927","last_updated":"2018-01-18T03:53:56Z","snapshot_observed_at":"2026-08-14T19:54:11.576186Z","submitted_at":"2018-01-18T03:53:56Z","title":"An Overview of Machine Teaching","version":1},"cited_work":{"arxiv_id":"1801.05927","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.05927","snapshot_observed_at":"2026-07-10T04:06:44.801053Z","title":"An Overview of Machine Teaching","venue":"cs.LG","work_id":"b50a2a87-b8af-4dd1-b5cf-94509fd0b38d","year":2018},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/1801.05927","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:63e7c794fa020ad54e7526849d6961dadf419e98b665d32ab2ad18fbf56ea0a3","observation_id":"05e0804c-f802-43d4-803d-94241f7b81be","resolution":{"observed_at":"2026-07-10T04:06:44.803111Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.252353Z","title":null,"venue":null,"work_id":"6df9f929-4c2a-4cce-bd85-42853c8f9960","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:866eb656dc613246bdbff299383e798b95f3dc30544ecb669e9746de7ea34e9e","observation_id":"395203d5-155b-44ed-8db4-dd4d596c1fd9","resolution":{"observed_at":"2026-07-10T04:06:45.253692Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.248644Z","title":null,"venue":null,"work_id":"341ffb3f-8468-4bf8-acf1-d3c782d84bbc","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:0b1a41902ed39990adfec00971e7ed1784e99ac2da04f1042df27eab08afe190","observation_id":"db90686e-f1e6-4046-9935-59cf7cb9866c","resolution":{"observed_at":"2026-07-10T04:06:45.250108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.245037Z","title":"We use2×3gridworlds with two cell features (drawn gray and white) and a randomly placed terminal cellTthat may occupy either feature","venue":null,"work_id":"a302d248-994b-4cfc-abe3-7a6fd267771f","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:f9281fec3bfab67ead08029fd9e48159472404aecc3377ad065da73bdaef42f3","observation_id":"f4b88810-7a0b-417d-ab89-bd2594532659","resolution":{"observed_at":"2026-07-10T04:06:45.246599Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.247067Z","title":null,"venue":null,"work_id":"8c6bcc14-86cb-430e-8adf-38e64bfff328","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:ee753ac98012c669554d388914e20aa833690f6b0ea96756309778848ada012d","observation_id":"8a7cab3b-aa36-43cc-a292-133c09631019","resolution":{"observed_at":"2026-07-10T04:06:45.248495Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.250541Z","title":"S1) 2:Restrict candidate atoms to those in environmentsK 3:D←Greedy Atom Selection(K,U)(Alg","venue":null,"work_id":"b54ed0c7-e538-415b-8411-a2e789690dd7","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:fde24690fa188e60d44a2d5bb5711dd70bc0d8204bb8f9d641cda904a5f89b0b","observation_id":"5a762f50-e6a9-4847-9796-477fb4079fb4","resolution":{"observed_at":"2026-07-10T04:06:45.252086Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T14:38:51.268395Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":4,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":1,"verified_exact":6,"verified_fuzzy":1},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2607.08647."}