{"as_of":"2026-08-10T11:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bde648badf2c0cff5d595be14168ae47139e75d8e330e6150eade6a979b1053a","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:55:08.160720Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06786/citation-record","integrity":"/paper/2506.06786/integrity","json":"/paper/2506.06786/citation-record.json","paper":"/paper/2506.06786"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.037952Z","title":"Exploration in deep reinforcement learning: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.037952Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:a652c9207a22ad704e214780db26c545f3289d18a9ad92b7699b634dd8768342","observation_id":"7398286a-4956-4f95-a711-1972aa3f39ce","resolution":{"observed_at":"2026-08-07T05:55:08.037952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.043659Z","title":"Deep reinforcement learning for time-critical wilderness search and rescue using drones,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.043659Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:fa1e3bc35434d3e72d101b8c4237144ea36f9c6eca0a401db4373fb4d81a4b6a","observation_id":"2b7abad1-1726-4681-be06-c2e94e5c61fb","resolution":{"observed_at":"2026-08-07T05:55:08.043659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12098","last_updated":"2025-07-31T14:50:20Z","snapshot_observed_at":"2026-08-09T04:06:30.022481Z","submitted_at":"2024-12-16T18:59:53Z","title":"MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12098","snapshot_observed_at":"2026-08-07T05:55:08.048563Z","title":"Maxinforl: Boosting exploration in reinforcement learning through information gain maximization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.048563Z"},"links":{"cited_paper":"/paper/2412.12098","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:39416db68b2f7bdbeaa08261093e4ecf91a2328c837df2ab085be281c3b42b07","observation_id":"292fd82b-4056-49fd-bcbe-7899350d43ac","resolution":{"observed_at":"2026-08-07T05:55:08.048563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.535735Z","title":"Regret bounds for information-directed reinforcement learning,","venue":null,"work_id":"ed2d101f-e8d3-450e-ad00-e169fa9db938","year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.054122Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:2642ca00ff2bd9f30699d56c945d7d153acb6ac3dcc11a22a458afdbc8d69487","observation_id":"e5e0854f-babb-4008-85b6-8929849cc418","resolution":{"observed_at":"2026-08-07T05:55:08.540988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.517508Z","title":"Selective exploration and information gathering in search and rescue using hierarchical learning guided by natural language input,","venue":null,"work_id":"acaccd83-ea4e-408d-b9ff-992a84561dd1","year":2024},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.059018Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:618c982d5330694637e26b880da6ed9ac1be4f24b5c081e8531b0ba410c230a7","observation_id":"adf17a1d-4b14-4273-a5f1-24b4f5ddc7b7","resolution":{"observed_at":"2026-08-07T05:55:08.523642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.501420Z","title":"Adversar: Adversarial search and rescue via multi-agent reinforcement learning,","venue":null,"work_id":"f9d6dd8e-5cf1-4574-8882-2700425cb166","year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.064858Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:722bf8edcdbf449e9f51dcd21f1f0f062e85e9c49e5e311bc2f202039e62c567","observation_id":"021747fd-36ab-4553-82ce-91559fef86b9","resolution":{"observed_at":"2026-08-07T05:55:08.506480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.484620Z","title":"Target search and navigation in heterogeneous robot systems with deep reinforcement learning,","venue":null,"work_id":"6bfa483d-cce3-4703-9432-eecd45a66360","year":2025},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.070670Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:4092b5634767ef6743825d7b16590ff3af8c0ae70cf6869097caf9d8e73538ec","observation_id":"7867432d-7291-4cf8-8fbc-71340a251fdd","resolution":{"observed_at":"2026-08-07T05:55:08.490184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.467682Z","title":"Multi-robot cooperative target search based on distributed reinforcement learning method in 3d dynamic environments,","venue":null,"work_id":"aa8d5599-ac27-411c-a4ac-fdfeb7ab3f43","year":2024},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.075594Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:5fd7175bef80ba5576e3740ed52d826492595e74bd3878b88d6ac69f557d8138","observation_id":"f7627ad9-0862-4d8c-8e21-2015ab9d841f","resolution":{"observed_at":"2026-08-07T05:55:08.473171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.080420Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.080420Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:5b79564451476e667b21366d2af97a8e1a7c4ce4130612693ce222cb5d920210","observation_id":"399349a3-5f65-4f6e-8ac5-275f1bafbadf","resolution":{"observed_at":"2026-08-07T05:55:08.080420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.438322Z","title":"Boltzmann exploration done right,","venue":null,"work_id":"1b94a294-caae-4692-a763-70d31ae5d421","year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.085052Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:7433009ffa59861d800761972a9b193bed21eb009faa6e4041d5878f8e7cdd9b","observation_id":"9d35c641-da1d-4d39-933d-4eb8530a0265","resolution":{"observed_at":"2026-08-07T05:55:08.444604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.421606Z","title":"Using confidence bounds for exploitation-exploration trade- offs,","venue":null,"work_id":"775f8429-b4d0-4cff-ac9f-f5565d557002","year":2002},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.089768Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:ebdba0d29a09e9ed26742e4410418a61b35a1c0a324ff06c826648668552818f","observation_id":"35cbcc6b-197f-486b-9597-9c78e7c6b97d","resolution":{"observed_at":"2026-08-07T05:55:08.426789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.402989Z","title":"An empirical evaluation of thompson sam- pling,","venue":null,"work_id":"28bbf340-21d4-4c73-853b-c2706d339024","year":2011},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.094471Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:77dcc8e6fbb89757946ece0a36389fce11602fe00851dd56e695b6b0cd741dab","observation_id":"4a812954-355a-49bf-a755-6be8287c776d","resolution":{"observed_at":"2026-08-07T05:55:08.408573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.099735Z","title":"Curiosity-driven exploration by self-supervised prediction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.099735Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:5813bb3b2753e101bc85e8d8a41fa8affef9fb1f86a292fe4fcd26a87a40d02c","observation_id":"b9813539-f0d5-48f3-8c5c-cada4c50e4c9","resolution":{"observed_at":"2026-08-07T05:55:08.099735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.104666Z","title":"Unifying count-based exploration and intrinsic motiva- tion,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.104666Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:6d2dd21cbc012495bc9efc2ae35f6cd2ceadd2c5d525e6fdcda07cf357947e1f","observation_id":"95e244b5-9f07-4d80-b95f-e0a892e61399","resolution":{"observed_at":"2026-08-07T05:55:08.104666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01732","last_updated":"2017-03-06T05:51:42Z","snapshot_observed_at":"2026-08-09T14:19:09.221373Z","submitted_at":"2017-03-06T05:51:42Z","title":"Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01732","snapshot_observed_at":"2026-08-07T05:55:08.110056Z","title":"Surprise-based intrinsic motivation for deep reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.110056Z"},"links":{"cited_paper":"/paper/1703.01732","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:c51d4d84586f63e76ef8e36b71e5ecfa4ee358611beb1e354d41528c3c6e95b3","observation_id":"1e91654f-7996-496d-9846-07d9ccb8f408","resolution":{"observed_at":"2026-08-07T05:55:08.110056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-07-06T07:11:32.319931Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-07T05:55:08.116114Z","title":"Exploration by random network distillation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.116114Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:97e7b4b5f3c0b981f9009a421b710bf9ddbfa2819ce9f4684f0bfd6c6830aa70","observation_id":"217eb0e2-bdb2-4011-aec0-5feafce2fd0a","resolution":{"observed_at":"2026-08-07T05:55:08.116114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.121560Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.121560Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:2cf839ec9bfa2c9680119c506eee79c99c997d7fb4c46b0c7245475a5c36f3fc","observation_id":"20bf38b9-0336-400e-80d1-e7f705d683df","resolution":{"observed_at":"2026-08-07T05:55:08.121560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.353533Z","title":"Lattimore and C","venue":null,"work_id":"24620bdd-638b-4f9b-959a-19e764390322","year":2020},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.126666Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:6dacd74ec85264d52bb625e8f19303682600e82ff0737d174985a10b724abb78","observation_id":"beca5d45-bc1d-40dd-93c9-efe68b3f5075","resolution":{"observed_at":"2026-08-07T05:55:08.358828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.335968Z","title":"Hidden parameter markov decision processes: A semiparametric regression approach for discovering latent task parametrizations,","venue":null,"work_id":"9a59bc17-ea8d-41ca-b39a-15a221bf4a54","year":2016},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.131798Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:15c82761e3dc881ca6411ac8ffaee95c90ea87cd3739fefb15770bc9741c9b64","observation_id":"d2b74e39-e08d-469b-bce2-248c23810283","resolution":{"observed_at":"2026-08-07T05:55:08.341394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.02259","last_updated":"2015-02-08T14:58:50Z","snapshot_observed_at":"2026-08-03T17:17:59.241164Z","submitted_at":"2015-02-08T14:58:50Z","title":"Contextual Markov Decision Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.02259","snapshot_observed_at":"2026-08-07T05:55:08.137170Z","title":"Contextual markov decision processes,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.137170Z"},"links":{"cited_paper":"/paper/1502.02259","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:acea4662b157d6b70268d0d8bf0fba0b91c29a30ed68ddf5b58e6306d6600620","observation_id":"9135ebbd-6a7a-4ac0-89ff-ded3ac6cd182","resolution":{"observed_at":"2026-08-07T05:55:08.137170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06557","last_updated":"2022-02-14T08:52:36Z","snapshot_observed_at":"2026-08-09T09:33:14.472841Z","submitted_at":"2022-02-14T08:52:36Z","title":"Reinforcement Learning in Presence of Discrete Markovian Context Evolution","version":1},"cited_work":{"arxiv_id":"2202.06557","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06557","snapshot_observed_at":"2026-08-07T05:55:08.199869Z","title":"Reinforcement Learning in Presence of Discrete Markovian Context Evolution","venue":"cs.LG","work_id":"7ea7ddc3-ebc2-4123-936f-36314e665fed","year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.142795Z"},"links":{"cited_paper":"/paper/2202.06557","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:70160b790b77111a4745bb77b60e4d89138ef05b35198b92f703887b0e70c240","observation_id":"5d9ee41b-2377-4147-b8d2-58f513e91a1e","resolution":{"observed_at":"2026-08-07T05:55:08.207365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.317500Z","title":"Context-aware dynamics model for generalization in model-based reinforcement learning,","venue":null,"work_id":"bb03ec40-64fe-493b-8e10-88b381fc0a94","year":2020},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.149028Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:1ce31286f4c202ddb45c0a145e06094d740830ea06723f57442e87203d1dcb78","observation_id":"3e2e32e3-2288-4089-91a9-9d2c56dae461","resolution":{"observed_at":"2026-08-07T05:55:08.323520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.300651Z","title":"Learning to optimize via information- directed sampling,","venue":null,"work_id":"cc02ca50-1f47-44ce-8d91-370e9ebb107e","year":2018},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.155554Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:9ff435ae0c47328a0f04c2c049524af39f5ed98da743891e79053a80c61d3b18","observation_id":"26648876-6b35-45f1-8482-0234814bf0cc","resolution":{"observed_at":"2026-08-07T05:55:08.306067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.160720Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.160720Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:d38f5cdb948ff1ead763333286535149bb0ff62924fa33df094acb75d4a12adb","observation_id":"7f08c08f-3949-43d9-b9a4-7393359e6b6f","resolution":{"observed_at":"2026-08-07T05:55:08.160720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T04:06:24.132247Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.06786."}