{"as_of":"2026-08-20T02:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2bb7831a86f97ac1d87189233fb3bb16a0a409949e29ebe2fbfcf7e09a2919e","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:18:21.317554Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:30:35.551368Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T13:17:55.011830Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03335","snapshot_observed_at":"2026-08-15T16:30:35.551368Z","title":"Actions speak louder than words: Rate-reward trade-off in markov decision processes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04787","last_updated":"2025-09-05T03:54:15Z","snapshot_observed_at":"2026-08-15T16:25:04.321393Z","submitted_at":"2025-09-05T03:54:15Z","title":"SREC: Encrypted Semantic Super-Resolution Enhanced Communication","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:30:35.551368Z"},"links":{"cited_paper":"/paper/2502.03335","citing_paper":"/paper/2509.04787"},"observation_digest":"sha256:d3dea622275129da169ae8fc5b7ad962e0e299793bccd07636adcce685fb41bf","observation_id":"2a50a4b5-1ead-4810-b068-24c35d83579f","resolution":{"observed_at":"2026-08-15T16:30:35.551368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03335","snapshot_observed_at":"2026-08-15T16:29:08.886016Z","title":"Actions speak louder than words: Rate-reward trade-off in markov decision processes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04801","last_updated":"2025-09-05T04:33:12Z","snapshot_observed_at":"2026-08-19T19:45:08.468805Z","submitted_at":"2025-09-05T04:33:12Z","title":"KGRAG-SC: Knowledge Graph RAG-Assisted Semantic Communication","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:29:08.886016Z"},"links":{"cited_paper":"/paper/2502.03335","citing_paper":"/paper/2509.04801"},"observation_digest":"sha256:fd916c66e8d07ba7b5585da8eddc6af523ff1e1d8514d3b697601b3cd22c36e3","observation_id":"37a5071b-c011-41c4-a493-2d0a7a24d025","resolution":{"observed_at":"2026-08-15T16:29:08.886016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"cited_work":{"arxiv_id":"2502.03335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03335","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Actions speak louder than words: Rate-reward trade-off in markov decision processes","venue":null,"work_id":"cf95ff2e-3bdf-428c-b345-26089ce24a00","year":2025},"citing_paper":{"arxiv_id":"2601.11520","last_updated":"2026-05-05T08:19:30Z","snapshot_observed_at":"2026-08-18T19:12:28.704891Z","submitted_at":"2026-01-16T18:59:06Z","title":"Empirical Coordination over Markov Channel with Independent Source","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T13:14:03.942387Z"},"links":{"cited_paper":"/paper/2502.03335","citing_paper":"/paper/2601.11520"},"observation_digest":"sha256:c0c817940b1e6f19b76b04e48e1d0ba215be088020dbe8385016260e7dbc9784","observation_id":"32d8cca5-cd68-49e6-ab10-11c082498875","resolution":{"observed_at":"2026-05-16T13:17:55.013450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03335/citation-record","integrity":"/paper/2502.03335/integrity","json":"/paper/2502.03335/citation-record.json","paper":"/paper/2502.03335"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.03148","last_updated":"2023-09-06T16:44:08Z","snapshot_observed_at":"2026-08-16T15:02:46.511656Z","submitted_at":"2023-09-06T16:44:08Z","title":"Data-Driven Neural Polar Codes for Unknown Channels With and Without Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03148","snapshot_observed_at":"2026-08-09T05:18:19.981483Z","title":"Data-driven neural polar codes for unknown channels with and without memory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:19.981483Z"},"links":{"cited_paper":"/paper/2309.03148","citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:0e7d166e5095eff7869699e12953f08217082b4c0df2d99e57882b11549997e0","observation_id":"e6e2bedc-efc1-4b4a-bd00-e8b4e73a79bd","resolution":{"observed_at":"2026-08-09T05:18:19.981483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:20.014764Z","title":"Constrained Markov decision processes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.014764Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:0e1bd581392e0513404da8769eb79e40761f09ea5173f1442b30d96ba87553a4","observation_id":"46153b5a-4783-4cf8-a062-cf835679900a","resolution":{"observed_at":"2026-08-09T05:18:20.014764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.520338Z","title":"Nonlinear programming","venue":null,"work_id":"ea0cd43f-49be-4eaf-b14f-ad7692e81db9","year":2016},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.034978Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:2935f5d1d6d1952c3ca1586c827e3ef812e882007223b811946847c9da6fcd28","observation_id":"eb2b6180-1700-414d-aed8-a2bf91803608","resolution":{"observed_at":"2026-08-09T05:18:24.525032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.504697Z","title":"Proof of shannon's transmission theorem for finite-state indecomposable channels","venue":null,"work_id":"0f8ebc7a-92ec-4a1c-882d-d8e32f61e94f","year":1958},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.041331Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:79c44daaa40dc43829e40916de21f3695a07b810602d75644177e200185ba987","observation_id":"1e6ed971-ba11-4359-b0fb-6e5af41b906f","resolution":{"observed_at":"2026-08-09T05:18:24.509782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.489448Z","title":"A review of the applications of deep learning-based emergent communication","venue":null,"work_id":"d030bcd0-912c-4977-8f8a-d63c4f8c3b63","year":2024},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.048357Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:c3498220724eda136f62b5af6f49f6ecfcb0e529b67291156f4f2dcd6190bee9","observation_id":"93df4b53-3bdf-46c8-b3a6-7f46531f9134","resolution":{"observed_at":"2026-08-09T05:18:24.494086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.472787Z","title":"Rgmcomm: Return gap minimization via discrete communications in multi-agent reinforcement learning","venue":null,"work_id":"ec5ea786-0c08-45f4-8f93-bfd4340095cf","year":2024},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.053798Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:b222431d5129e4ea3b46215af759560d60777447974cd73278d616a0f139efb3","observation_id":"6faf89ab-8cb7-4ddc-80d5-57aac4a8e880","resolution":{"observed_at":"2026-08-09T05:18:24.478495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:20.059626Z","title":"Elements of information theory","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.059626Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:f2fec71edf6110ce748d2cc891b88e7246de9d39d0959c76c57f117f12d3bde0","observation_id":"081af5ea-a5b6-4f09-9467-7758bae2767d","resolution":{"observed_at":"2026-08-09T05:18:20.059626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.741158Z","title":null,"venue":null,"work_id":"afc848b1-b36c-4e31-bc07-413fbd09bad7","year":2024},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.064455Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:8d6c4ac1b6fb8fd69c54f51213ffe9f56af7ce7b50ea7f49b0a8ea108e9e9b1c","observation_id":"0d9cc454-57c0-4f11-b4bf-99bf6e3287fc","resolution":{"observed_at":"2026-08-09T05:18:23.747788Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.446176Z","title":"On controlled finite state markov processes with compact control sets","venue":null,"work_id":"b95b6dda-a922-4875-9690-2367c3acc2d0","year":1976},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.071355Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:ef850ac4db15edc308f08c5abbd2114b676806f882aff299f8306126569b0285","observation_id":"4fdaa2b7-e740-41b4-9ff2-103b2bc8e139","resolution":{"observed_at":"2026-08-09T05:18:24.451428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.429805Z","title":"Learning to Communicate with Deep Multi - Agent Reinforcement Learning","venue":null,"work_id":"415e4c74-d177-454a-8a42-a7c4c3d4c909","year":2016},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.075716Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:6e87b600a878bf905a18570db13ffa0477c93d937a7178df51d6bd0e4dc1ee6a","observation_id":"91ddddf9-e85c-43d8-9960-a4761f4ea86f","resolution":{"observed_at":"2026-08-09T05:18:24.435057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.380934Z","title":"Information theory and reliable communication, volume 588","venue":null,"work_id":"dd661e0a-326b-45ec-a52b-955dce104b69","year":1968},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.124149Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:cfe36e7da87c58b5b24441a00222d1ff594e0820b810ddd3a13ca32e0b60f7d5","observation_id":"bda70a46-9631-450d-ba4c-55272ebe675d","resolution":{"observed_at":"2026-08-09T05:18:24.411336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/18.490551","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Goldsmith and P.P","venue":"IEEE Transactions on Information Theory","work_id":"f84c7e68-20d6-4ca0-a66f-188d2ed3e914","year":1996},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.193759Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:8a0d1cbfe540404f4b0cd6cfdb17c7415a684cf587bca087eebedbd1ca2c0b4a","observation_id":"29b828f5-1f01-4a33-8881-41497008c29d","resolution":{"observed_at":"2026-08-09T05:18:21.471612Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08864","last_updated":"2024-06-05T02:05:13Z","snapshot_observed_at":"2026-08-16T14:18:48.233675Z","submitted_at":"2024-02-14T00:18:10Z","title":"DeepPolar: Inventing Nonlinear Large-Kernel Polar Codes via Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08864","snapshot_observed_at":"2026-08-09T05:18:20.298024Z","title":"Deeppolar: Inventing nonlinear large-kernel polar codes via deep learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.298024Z"},"links":{"cited_paper":"/paper/2402.08864","citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:435351f4fc9851554acc4db7915b9398c135f02c4ab60673ec9119196bf80c17","observation_id":"43f35f52-f4f2-4dbc-99e5-969da4afad14","resolution":{"observed_at":"2026-08-09T05:18:20.298024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.300776Z","title":"Discrete-time Markov control processes: basic optimality criteria, volume 30","venue":null,"work_id":"018f43c1-dacf-469a-a3a0-f7bc4a5fd155","year":2012},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.367389Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:a5bb60c494302d4134afe416387e136cb2a8e2c93fa9322391de156826e0f4eb","observation_id":"3fe4fb14-9e9f-4214-94f2-3fade099b98c","resolution":{"observed_at":"2026-08-09T05:18:24.333496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.281435Z","title":"Turbo autoencoder: Deep learning based channel codes for point-to-point communication channels","venue":null,"work_id":"1a30c59e-7144-434d-b104-2926738eb43f","year":2019},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.429908Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:ebbf3b675904a5e8c5979fda738eb686d815b347a0f9ce1dd4a8f22c8669e131","observation_id":"9fe14588-2ef3-45aa-91ec-18f3fca0cff3","resolution":{"observed_at":"2026-08-09T05:18:24.286468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.265609Z","title":"Learn codes: Inventing low-latency codes via recurrent neural networks","venue":null,"work_id":"6aa38fc7-196f-41c4-89ad-6edfbbc81a57","year":2020},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.489190Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:f9cc0dafdb21c1c2bb10ca20622ddb9b3389d37a56fca477cf427e50164049e8","observation_id":"2c42b39b-180a-45b4-b37a-3600c0f1c8a6","resolution":{"observed_at":"2026-08-09T05:18:24.270855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.455839Z","title":"Karabag, Melkior Ornik, and Ufuk Topcu","venue":null,"work_id":"4cd76317-af64-4f68-90aa-7ce6c53a5305","year":2019},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.530983Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:10b0f1e548071d2a5d4cb1c5dbe13dcf7a36335652365307fc29e99a9a54935b","observation_id":"b924600d-b80a-4741-aac5-998f82fe4e4f","resolution":{"observed_at":"2026-08-09T05:18:23.485102Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.249467Z","title":"Deepcode: Feedback codes via deep learning","venue":null,"work_id":"d77dcb2d-8239-4409-a8f6-1644907ee9ce","year":2018},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.535767Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:f117424acbb071df86d58a2b69602f4e00ae3a2003492ee3e0f07b53186d713f","observation_id":"956b39da-8f12-4942-a96c-9f56f6bbe4b8","resolution":{"observed_at":"2026-08-09T05:18:24.254882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.233114Z","title":"Deepcode: Feedback codes via deep learning","venue":null,"work_id":"620c8540-dff7-4074-bf26-7bc45a899999","year":2020},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.541003Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:cfe76bef3246c6f2151eeb3b3d5f4947a5a457b0f4f4a075fff658401563fbd1","observation_id":"fc791d2b-5ff5-47b6-a60a-dbaca465c4ba","resolution":{"observed_at":"2026-08-09T05:18:24.238452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.209965Z","title":"Knepper, Christoforos I","venue":null,"work_id":"f3016385-0b9f-4975-ab5c-6ded910caa77","year":2017},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.547577Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:d04b355b3b99aff6a36874888477d1b1b12e4bdefb0d7bfe2f1495281dc053c1","observation_id":"012b0907-6a78-488f-b60d-8c3c73aaff67","resolution":{"observed_at":"2026-08-09T05:18:24.215883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.193305Z","title":"Joint source-channel coding with feedback","venue":null,"work_id":"37f4392c-c6c8-4743-87a3-ab3d1da61ebb","year":2017},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.552584Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:d6a8ed47368723ca70c2648d664a65487ca2637bd01c99c72f210aecd8e9cb2d","observation_id":"52d532ad-451f-4f84-83ba-0ecedc999a13","resolution":{"observed_at":"2026-08-09T05:18:24.198767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.175064Z","title":"Ko codes: inventing nonlinear encoding and decoding for reliable wireless communication via deep-learning","venue":null,"work_id":"c611e349-a6bc-431f-9525-dbd24f1000f7","year":2021},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.557588Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:a1f0cdec7261c299ccdd9c8c88fb78d1e038137f979216b34bda5033f3fe6abf","observation_id":"28d803df-0f7f-471d-b275-13986158bbb6","resolution":{"observed_at":"2026-08-09T05:18:24.179771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.152796Z","title":"Survey of unmanned subterranean exploration, navigation, and localisation","venue":null,"work_id":"df1d3cd2-3ee3-4165-a64f-2db05bdfbee0","year":2020},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.568183Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:1d3df834cd85176648776f8791ad4d42d65f96581aa25bcf72310b348348c9ce","observation_id":"564fc2a2-9d90-4527-a4ee-1f7c98a35124","resolution":{"observed_at":"2026-08-09T05:18:24.161080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.114603Z","title":"Causality, feedback and directed information","venue":null,"work_id":"b901c796-6b93-4fde-873d-093058852ae0","year":1990},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.573785Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:28482b534ae90611e0f0b40f486d22f72dbd3fd07c16e9ff4480d049d2e13106","observation_id":"f56bfd43-53cc-48ef-918b-017f65fc5c9e","resolution":{"observed_at":"2026-08-09T05:18:24.140516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.201115Z","title":"Capacity of a post channel with and without feedback","venue":null,"work_id":"e45bb08f-b214-4e3d-a56f-f1205dab4a0d","year":2014},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.579128Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:8b03b83aa5dcca3221d5390bf6fda6728fe89553545e5b6e33fcf0211240f170","observation_id":"a01e3185-fe8d-4e02-b4bc-01b9ff9eeb5f","resolution":{"observed_at":"2026-08-09T05:18:23.208809Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.019982Z","title":"Goldsmith","venue":null,"work_id":"8c2078d1-6ada-4820-8b58-131a4d286aec","year":2009},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.583149Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:720ec571af3f74187d935c58f3114df83ba7d7fdcfc7d6036bcffe3cfae4253e","observation_id":"f05a14a9-9854-4087-b27b-fcacb2c544f8","resolution":{"observed_at":"2026-08-09T05:18:23.026752Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:22.669287Z","title":"Jamming attacks and anti-jamming strategies in wireless networks: A comprehensive survey","venue":null,"work_id":"1e84ee67-73e0-4005-8b38-fa188b131770","year":2022},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.593918Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:9e416821f65d54561f9f0be4e31c906b94e9a1c41187acf9107f554d068a9321","observation_id":"90d8b4c9-3bd6-41d5-af83-9d20a09e91b9","resolution":{"observed_at":"2026-08-09T05:18:22.730910Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.1618130114","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Vincent Poor and Rafael F","venue":"Proceedings of the National Academy of Sciences","work_id":"9cba7d1a-fff8-481d-843d-5b2e6bb260e1","year":2017},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.602523Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:a3e6afe01b2bf65c9936149ad5a099f1a6a0c38bb8988d2e946a9bd8f459aa5d","observation_id":"b2119d3e-481b-4820-8546-51db03d231a3","resolution":{"observed_at":"2026-08-09T05:18:21.428111Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:20.618920Z","title":"Markov decision processes: discrete stochastic dynamic programming","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.618920Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:b29c4cb7bd285034be4e284b56447dbc160100532c35100035289ccf70c72b52","observation_id":"2f4e4595-b5b6-4831-834c-046be8c33890","resolution":{"observed_at":"2026-08-09T05:18:20.618920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:22.503588Z","title":"Permuter, and Henry D","venue":null,"work_id":"8aaa7e67-9352-4138-a905-b12e30a2a2ae","year":2017},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.652560Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:d002160de525cd22579d86b6867c79b0d5af79d7f37c02c3fb7307d163b03ccf","observation_id":"9fb589f1-084e-43a1-908b-4809b251bf30","resolution":{"observed_at":"2026-08-09T05:18:22.508049Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:24.039776Z","title":"Channels with side information at the transmitter","venue":null,"work_id":"2705cf1c-e6d4-4fc0-858b-148fb14b5ec0","year":1958},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.712945Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:2c3f3b95ba50954bf9ee8c0c350938e2786d4db997dc7cdc2b2f3ceb2b8b6b3a","observation_id":"6c7427ca-3a63-4f05-9123-70747d01f51d","resolution":{"observed_at":"2026-08-09T05:18:24.064816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.12886","last_updated":"2022-12-25T10:29:26Z","snapshot_observed_at":"2026-08-16T16:06:06.973190Z","submitted_at":"2022-12-25T10:29:26Z","title":"Finite-State Channels with Feedback and State Known at the Encoder","version":1},"cited_work":{"arxiv_id":"2212.12886","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.12886","snapshot_observed_at":"2026-08-09T05:18:22.299145Z","title":"Finite-State Channels with Feedback and State Known at the Encoder","venue":"cs.IT","work_id":"e582e701-2dbd-4932-9b21-9ddafb08ec7c","year":2022},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.756543Z"},"links":{"cited_paper":"/paper/2212.12886","citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:e3338d1f3de54687b890bcf79caf70e2e436caffe54d8721d56cdefa3f620d99","observation_id":"c316b5ff-1dd7-4aac-8190-5715f06d3eab","resolution":{"observed_at":"2026-08-09T05:18:22.341081Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:22.213209Z","title":"Permuter","venue":null,"work_id":"566a1b2f-88e9-46c6-ad2f-aebf8ac00146","year":2024},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.782277Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:2ea8106e721b177b54978cd23cb42e7ee48b827e913628d98ca9340c2773c34c","observation_id":"8a84dbba-4e52-4876-8ec3-ddd20fafedfe","resolution":{"observed_at":"2026-08-09T05:18:22.227178Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.977881Z","title":"Communicating via markov decision processes","venue":null,"work_id":"5bc917e9-9a6f-45fc-95e9-d9862c4cb26c","year":2022},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.795786Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:7cfff463658ada2a1590090b134f1eb24cd588e635a9da9be94bab9c1c20426d","observation_id":"aea2c008-eaf3-4ff6-b35c-a1aff566ba5c","resolution":{"observed_at":"2026-08-09T05:18:23.996914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.932264Z","title":"Learning multiagent communication with backpropagation","venue":null,"work_id":"ff056c3f-a4ea-422a-800d-ee2d616dde1d","year":2016},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.800925Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:71be77b4ce8b93bb7701437b8e67ff6986db3045a93768d190a72928ab099f0c","observation_id":"0a17092b-f3c9-462d-8821-501ce84feb85","resolution":{"observed_at":"2026-08-09T05:18:23.938090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04444","last_updated":"2019-11-20T20:05:08Z","snapshot_observed_at":"2026-08-15T01:17:54.114986Z","submitted_at":"2018-10-10T10:16:55Z","title":"Learning to Communicate Implicitly By Actions","version":4},"cited_work":{"arxiv_id":"1810.04444","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.04444","snapshot_observed_at":"2026-08-09T05:18:22.024001Z","title":"Learning to Communicate Implicitly By Actions","venue":"cs.AI","work_id":"a68be887-1df6-43af-8ab2-90ba2bad955d","year":2018},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.809995Z"},"links":{"cited_paper":"/paper/1810.04444","citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:d8a4822fcb9c388f96810cce466f99ad92c5596277ab39e19830983420ddf60e","observation_id":"fc69dfc5-da12-4f48-9965-59312123996a","resolution":{"observed_at":"2026-08-09T05:18:22.032374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4324/9781003016366","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Trenholm","venue":null,"work_id":"659dec76-4224-4ced-8cda-d307444d26f9","year":2020},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.816829Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:c6b0b559eae025828112b44dec83cfc6ee8d886930089ecd0c14f1d8a9cbcbb9","observation_id":"2e5b81ad-7430-4500-afec-48b82928c8af","resolution":{"observed_at":"2026-08-09T05:18:21.393965Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.933710Z","title":"Effective Communications : A Joint Learning and Communication Framework for Multi - Agent Reinforcement Learning Over Noisy Channels","venue":null,"work_id":"11c32386-888b-4e20-8916-9c25aaa5095f","year":2021},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.821686Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:614e46409db729be7f0f3ca2a877ee6c9cd1f5af2199dbeedd1f9b70e0e4e150","observation_id":"f14752e1-4276-4835-bcc4-516cd78fbed7","resolution":{"observed_at":"2026-08-09T05:18:21.998328Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:20.826920Z","title":"Verdu and Te Sun Han","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.826920Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:f56361c3c31e62e6fb9a798e36b38b68fc41fd431d1137f8569cd262a8188c35","observation_id":"99ba74da-3b6d-4788-bff9-372e8c18fd84","resolution":{"observed_at":"2026-08-09T05:18:20.826920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.905244Z","title":"Pheromone communication in ants: a detailed analysis of concentration-dependent decisions in three species","venue":null,"work_id":"adfb4ee3-d26c-4e78-86f2-8a0c40346f97","year":2014},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.868876Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:3f1a568b51f5d2cebf60d5738627e120d51773f9b2f67fde8d4e2a149fe761dc","observation_id":"30a06a0e-ed7f-4f21-8414-ebbd5c648e5e","resolution":{"observed_at":"2026-08-09T05:18:23.917025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.645793Z","title":"Towards practical and scalable molecular networks","venue":null,"work_id":"01562521-ec69-4fad-a39b-19dea7f38651","year":2023},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:20.974151Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:837877adc82f3cb103b57c9217ae4ce214e7423cb3447fafca44d69ca1989798","observation_id":"000b885a-96de-4767-a35a-bc66d7a6019d","resolution":{"observed_at":"2026-08-09T05:18:21.697245Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.883503Z","title":"Learning Efficient Multi -agent Communication : An Information Bottleneck Approach","venue":null,"work_id":"e444de94-ae7f-40ce-a364-f4a402626040","year":2020},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.015753Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:8be3676996efeea4def1c77f1875a8c1093f2007299664c96bda8e12e2e0339b","observation_id":"bb8d74dc-e533-422d-b5e5-1e50c1ead51c","resolution":{"observed_at":"2026-08-09T05:18:23.889222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.861583Z","title":"Quorum sensing: cell-to-cell communication in bacteria","venue":null,"work_id":"0b55aa2e-69c9-480d-9201-be852042fd98","year":2005},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.044940Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:c561c2378cccf02dd09420d93b57f398737d09eb64d9f349ab5ecf551c935892","observation_id":"d6f8ccfc-2f46-4ac9-8ecc-bcc5a65c35ae","resolution":{"observed_at":"2026-08-09T05:18:23.866802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:23.843707Z","title":null,"venue":null,"work_id":"936be594-9d41-4e0a-979a-7c68c57961b5","year":2001},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.090973Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:31ec7256871a3b62ff5c45b0a92043264daa5520245b66e64aa6173e2f235a3d","observation_id":"721a3650-ab8a-443e-bbf5-7219a5c2200c","resolution":{"observed_at":"2026-08-09T05:18:23.848890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.196623Z","title":"Lookahead optimizer: k steps forward, 1 step back","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.196623Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:bc2de60f2e325f768f09c9370dc77f5b1b5a22b275846b4935754b6d3da43827","observation_id":"d7e3739a-cd96-4965-983b-818fe30e73b1","resolution":{"observed_at":"2026-08-09T05:18:21.196623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.235900Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.235900Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:724063a9e3393cbf7b4f323027d58727279db573f4b4dc66f3039fe8aaec8d4c","observation_id":"20b2e69e-ae7f-4ad9-8996-547307b454c8","resolution":{"observed_at":"2026-08-09T05:18:21.235900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.306386Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.306386Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:0b1fe4bbc4efb12e238ea1ce4dd2f9f192ef53631ea5ddebe9e097d855ded6c6","observation_id":"029b2ed2-3493-495e-8213-ff7c9b9011fc","resolution":{"observed_at":"2026-08-09T05:18:21.306386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.312192Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.312192Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:65e3ea9576921fe3126414d6067b56ab5d245577cd9ae6c0083e4ef3fd435382","observation_id":"a9302eb2-f670-428b-9d7c-d390ebbc684c","resolution":{"observed_at":"2026-08-09T05:18:21.312192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:18:21.317554Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T05:18:21.317554Z"},"links":{"citing_paper":"/paper/2502.03335"},"observation_digest":"sha256:edf9ac566752d98250d0f6c980314a0462d3238a620b3e6e4f78f8bca30cd54f","observation_id":"c05b7e8e-b4df-47db-b132-5a6b26f45176","resolution":{"observed_at":"2026-08-09T05:18:21.317554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.03335","last_updated":"2025-09-03T23:38:04Z","latest_version":3,"primary_category":"cs.IT","snapshot_observed_at":"2026-08-09T05:02:48.132594Z","submitted_at":"2025-02-05T16:29:47Z","title":"Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision Processes"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":14,"verified_fuzzy":23},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 3 inbound Pith citation observations for arXiv:2502.03335."}