{"as_of":"2026-08-10T01:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73974b7b3fafcefbeab48beecc85943421f4027c16af7be71057f0d20adad131","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:31:58.854906Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T13:58:53.430492Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:00:28.739440Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"cited_work":{"arxiv_id":"2506.05070","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05070","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d06c4bb-6114-47e1-9c70-4577fff26020","year":null},"citing_paper":{"arxiv_id":"2604.13602","last_updated":"2026-04-15T08:11:34Z","snapshot_observed_at":"2026-07-06T23:01:32.542040Z","submitted_at":"2026-04-15T08:11:34Z","title":"Reward Hacking in the Era of Large Models: Mechanisms, Emergent Misalignment, Challenges","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-05-10T13:58:53.430492Z"},"links":{"cited_paper":"/paper/2506.05070","citing_paper":"/paper/2604.13602"},"observation_digest":"sha256:9818f2aee58f946c1cb8d041ab3f12a1a440f953c663c9ebf6f44d94c582a5fc","observation_id":"50cc0c47-2c40-480a-bfaa-f44cd5bc1755","resolution":{"observed_at":"2026-05-10T14:00:28.742286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05070/citation-record","integrity":"/paper/2506.05070/integrity","json":"/paper/2506.05070/citation-record.json","paper":"/paper/2506.05070"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.341810Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.341810Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:8ebaf305484f736c1f050011b01deb260eab49aff709c5ad508fad9d6f596a50","observation_id":"4aef4f8a-4efb-448e-9302-1fb752988ee2","resolution":{"observed_at":"2026-08-07T10:31:58.341810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.348130Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.348130Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:98d5f9db238db5be015f3bbc52ad57f0414f22eb9ac0111dfa686c121658d21a","observation_id":"43a10ab0-bd84-49f3-ab43-6a4e4d51e9ae","resolution":{"observed_at":"2026-08-07T10:31:58.348130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T10:31:58.352960Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.352960Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:360f3dc22f66a71a9a72e6b72dfc61381ae36efe1dd439f7648885b1fa6d8428","observation_id":"d3c297ee-c723-4649-ad59-260d500d7ba2","resolution":{"observed_at":"2026-08-07T10:31:58.352960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01013","last_updated":"2024-06-18T20:53:08Z","snapshot_observed_at":"2026-07-06T18:24:13.721696Z","submitted_at":"2024-06-03T05:46:53Z","title":"Scalable Ensembling For Mitigating Reward Overoptimisation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01013","snapshot_observed_at":"2026-08-07T10:31:58.359316Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.359316Z"},"links":{"cited_paper":"/paper/2406.01013","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:eb15e6014b037e563e7bbf9aaf930ae3cac2b1d47ce60a532c2007f11d9f7786","observation_id":"814d1cc0-7757-44a5-8247-f66e06bdb408","resolution":{"observed_at":"2026-08-07T10:31:58.359316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17733","last_updated":"2024-02-27T18:09:36Z","snapshot_observed_at":"2026-07-06T17:36:23.851926Z","submitted_at":"2024-02-27T18:09:36Z","title":"Tower: An Open Multilingual Large Language Model for Translation-Related Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17733","snapshot_observed_at":"2026-08-07T10:31:58.366539Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.366539Z"},"links":{"cited_paper":"/paper/2402.17733","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:547f874e44f39dbbe93f94d5c5634e744b3e9128014fdd0eeb49937266f8aba3","observation_id":"c495aa36-a0a6-4e35-897b-b39e32dacadb","resolution":{"observed_at":"2026-08-07T10:31:58.366539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-07T10:31:58.377706Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.377706Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:0ff10d7227d743ff748b340519c5f529cce3c5d83e38b5982464ee340eed45e2","observation_id":"e808fdcb-b6c2-4d25-bb7d-d73c297dc441","resolution":{"observed_at":"2026-08-07T10:31:58.377706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T10:31:58.382769Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.382769Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:474cc38b120aced1db28ef88ae623c1c1a117ba46ec0835eeefe8e208ac1725a","observation_id":"fe80d579-e51f-41e1-96b1-0655ba1804a0","resolution":{"observed_at":"2026-08-07T10:31:58.382769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03748","last_updated":"2018-03-14T21:09:49Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:59:41Z","title":"Emergent Complexity via Multi-Agent Competition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03748","snapshot_observed_at":"2026-08-07T10:31:58.387429Z","title":"Pachocki, Szymon Sidor, Ilya Sutskever, and Igor Mordatch","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.387429Z"},"links":{"cited_paper":"/paper/1710.03748","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:392a7590d49127bc5d439e354ee3c5e20cb9d6fc82a04bcd42458663ba8e2e48","observation_id":"dc428be4-0dc3-4508-900e-89bd237f8020","resolution":{"observed_at":"2026-08-07T10:31:58.387429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.711918Z","title":null,"venue":null,"work_id":"e41d23c0-2f2f-49f2-aedf-7dbbdbc6b1e3","year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.396487Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:d3079336a6fd96306aaaa9bea1b4b2cf4ba99c8f0397fdfc9047c277ff7bc824","observation_id":"cb90f93b-66ae-418b-9270-a838e25382b9","resolution":{"observed_at":"2026-08-07T10:32:00.716563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.694443Z","title":null,"venue":null,"work_id":"de23f11a-33b4-4a6f-a3c8-bc32a3888dba","year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.414533Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:79b00fa4eaa1772fa9cc97539427c9c61db1d6f691fd618981118b2ce9995ac0","observation_id":"33556244-a5fb-4791-ae68-32141301413a","resolution":{"observed_at":"2026-08-07T10:32:00.699664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.671024Z","title":null,"venue":null,"work_id":"ace312de-1b24-4c48-aac1-6bfb76feab75","year":1995},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.425470Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:1324957ca58b1f4eb9ff3016f58cfc618e2483f7c693fc2a0eec20a581e29dfd","observation_id":"0845b035-c6e9-4ef5-b840-5557464b2c83","resolution":{"observed_at":"2026-08-07T10:32:00.678724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.432600Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.432600Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:274ca1b599a265bacf665f999800f90fa092f9efee4826c77d60e7238480d3b6","observation_id":"56e3d274-f9a2-4493-9e26-90213e9bc965","resolution":{"observed_at":"2026-08-07T10:31:58.432600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.655902Z","title":null,"venue":null,"work_id":"a64c1178-f9ef-4be6-8f95-98d34ccad372","year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.438800Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:fda9b606279fc277b4cb9c884ab8eb35e54fbd72e56509df4f013d03213b4af0","observation_id":"31b62ac5-511a-400e-8239-fa51a5c12ace","resolution":{"observed_at":"2026-08-07T10:32:00.660012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.640656Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":"3db9a052-9938-468e-9a50-210c5831a7db","year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.448565Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:51d37a16d2c0e73c980c9e24dd8d19125ed1b772238283afa055d70e23cc65b4","observation_id":"53cc20fb-ca4b-4433-9ce8-119417ded970","resolution":{"observed_at":"2026-08-07T10:32:00.645154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.620928Z","title":null,"venue":null,"work_id":"a32e3882-2907-4310-90ba-23e3270a7f00","year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.456237Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:e275fa33c3d55e93f1501db34c7fd7cd5c6bb2ec0cbc849e3cd2f181db295bd9","observation_id":"b807f088-fd29-4a3c-88ff-08690762dcc7","resolution":{"observed_at":"2026-08-07T10:32:00.628423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T10:31:58.473720Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.473720Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:59b4170205a8d7d318156579c88d13d13839003c3ce76fb303548af2d6ea44dc","observation_id":"f6b9c1cb-0d09-459e-b7fe-5221d89fd310","resolution":{"observed_at":"2026-08-07T10:31:58.473720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10162","snapshot_observed_at":"2026-08-07T10:31:58.481403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.481403Z"},"links":{"cited_paper":"/paper/2406.10162","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:74990d52ebf79fff1412dcfd33c94b04ddea03cffacd63250714f07bcd738ce2","observation_id":"d2cdc9af-7ef8-41d7-850b-0726031690e7","resolution":{"observed_at":"2026-08-07T10:31:58.481403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.591866Z","title":null,"venue":null,"work_id":"6e49f067-6487-405a-935f-bb4c87e8fb02","year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.492488Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:73559257312662688adab2db0786bcf54d23a69484407fde275525c112f17bed","observation_id":"806d647f-eff4-49d1-b43c-f88187e4ae0c","resolution":{"observed_at":"2026-08-07T10:32:00.603929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.567356Z","title":"Sharkey, Jacob Pfau, and David Krueger","venue":null,"work_id":"4772bf8c-a710-475c-bf47-7763a9458569","year":2021},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.503016Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:45f6f8be4436ff2ad082d075eb204703e4bee39b338be1f87d3feed5977e0c21","observation_id":"37f8064f-43b1-4588-80f6-b4f8e37ecb1f","resolution":{"observed_at":"2026-08-07T10:32:00.573914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.511170Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.511170Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:8ff42085f50f9f15ec5d50e4c7065ffb96eab546d45648eab140e35d19733c2b","observation_id":"e21614d8-da94-49b4-a126-d7340da0b202","resolution":{"observed_at":"2026-08-07T10:31:58.511170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04734","last_updated":"2021-03-26T11:13:59Z","snapshot_observed_at":"2026-08-09T22:09:25.054646Z","submitted_at":"2019-08-13T16:50:00Z","title":"Reward Tampering Problems and Solutions in Reinforcement Learning: A Causal Influence Diagram Perspective","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04734","snapshot_observed_at":"2026-08-07T10:31:58.520812Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.520812Z"},"links":{"cited_paper":"/paper/1908.04734","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:7f9039891e8722fbf131aa36f11929d901e00ea6c453d688ab3be8ebcb6ef4d5","observation_id":"7f8677c2-5b30-41ac-a233-fa9c0bdc1e58","resolution":{"observed_at":"2026-08-07T10:31:58.520812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.540434Z","title":null,"venue":null,"work_id":"12c935f3-91ca-4987-85f3-f7dd07662e2b","year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.527197Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:d7bbd41b2179a47f6cf41c16723381505d26dcf2eaa843976967c807dede8575","observation_id":"71103d20-cb28-43c6-8e79-6262c0ce05c4","resolution":{"observed_at":"2026-08-07T10:32:00.552490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10160","last_updated":"2025-04-14T12:14:18Z","snapshot_observed_at":"2026-08-07T16:05:55.084744Z","submitted_at":"2025-04-14T12:14:18Z","title":"MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10160","snapshot_observed_at":"2026-08-07T10:31:58.538085Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.538085Z"},"links":{"cited_paper":"/paper/2504.10160","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:d3c32ea447e47a96d49cc7ccc610734354718854b2d216808c2dfee043759a7f","observation_id":"44331071-acc5-481f-9936-d2f72986b32e","resolution":{"observed_at":"2026-08-07T10:31:58.538085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.860","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:59.017969Z","title":null,"venue":null,"work_id":"4618f2f7-00c4-445c-93a5-921953df36b6","year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.547197Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:f998ace9f0f2629ee54f72a55f4c2565cd3586d4d700c2c82acbd196eadab626","observation_id":"334c0700-d8a3-47ae-8f5d-f2d957034ff9","resolution":{"observed_at":"2026-08-07T10:31:59.022555Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-04T07:21:33.793111Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-07T10:31:58.552488Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.552488Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:4859aead7ac7d4611cc6ca744b3649161cae2fbdf97ed0b40b700ca3affbefc1","observation_id":"6a3ba601-d6c1-4ce7-aef7-cc5dab0bda08","resolution":{"observed_at":"2026-08-07T10:31:58.552488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.512857Z","title":null,"venue":null,"work_id":"d58a3c3a-6153-4e83-ab9d-fbef3b04e2c8","year":2014},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.558415Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:2b859d4484fa4a3b06f3b8b2c6558528aace2bda4b0f933049ccccc12098d889","observation_id":"cbef659f-1911-4505-b718-a40d9cc3ad60","resolution":{"observed_at":"2026-08-07T10:32:00.524308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2019/331","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.997235Z","title":null,"venue":null,"work_id":"b0418327-48aa-441f-92e6-a2639e4680cb","year":2019},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.563586Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:84d3a601fd3134b557838f114f13f1f1dac03172691c20e76ffa2b0ad277adf6","observation_id":"32586a40-4472-4f8b-9681-debe3d640808","resolution":{"observed_at":"2026-08-07T10:31:59.005534Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:31:58.569830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.569830Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:847fb466b961bbe81ee00b7421a7e09a84408f589f931798f74ade84b6820ea6","observation_id":"8c8e82d1-5f1e-4856-a566-c97b63036b82","resolution":{"observed_at":"2026-08-07T10:31:58.569830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19735","last_updated":"2025-05-26T10:07:21Z","snapshot_observed_at":"2026-08-07T17:44:14.954368Z","submitted_at":"2025-02-27T03:57:00Z","title":"R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19735","snapshot_observed_at":"2026-08-07T10:31:58.579714Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.579714Z"},"links":{"cited_paper":"/paper/2502.19735","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:3340eb17a34f08878a27fe1a03906ea25c668ed3cc4d32d34cada600ed353541","observation_id":"3523feee-8ce4-4f6e-85b7-074511019571","resolution":{"observed_at":"2026-08-07T10:31:58.579714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.585982Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.585982Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:aefe8647e79b393bdfc13d7237b99246a84b6918c135e2749ad189203d4088d4","observation_id":"a0995178-3ee5-4158-934c-53e7407fa2ca","resolution":{"observed_at":"2026-08-07T10:31:58.585982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.592766Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.592766Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:1a1f7880338baa87deaa71b5a747b5bff6379de6b9dc560561de887ffb96c2c0","observation_id":"bfef10d8-d7b7-4db8-8025-09de6bd6f92d","resolution":{"observed_at":"2026-08-07T10:31:58.592766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06004","last_updated":"2024-06-10T03:57:39Z","snapshot_observed_at":"2026-08-04T20:09:33.779406Z","submitted_at":"2024-06-10T03:57:39Z","title":"FLEUR: An Explainable Reference-Free Evaluation Metric for Image Captioning Using a Large Multimodal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06004","snapshot_observed_at":"2026-08-07T10:31:58.602250Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.602250Z"},"links":{"cited_paper":"/paper/2406.06004","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:03e42d23882ebcded110fbd7a7257c5f02724f73fa337d76b9fa8e769d246b74","observation_id":"649b3153-4ee3-47b6-99a6-77e1b68a46c2","resolution":{"observed_at":"2026-08-07T10:31:58.602250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.486011Z","title":null,"venue":null,"work_id":"da9fe7c7-041f-44d9-a533-f9d097e8a55b","year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.607897Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:1fb827d23fb38998cec9680d4a866989aa1ba47b08922ed3da39ab8246a61941","observation_id":"d9760982-7134-4d01-88d6-9f33f48e48e6","resolution":{"observed_at":"2026-08-07T10:32:00.492138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.616272Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.616272Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:8cdd2877f419909df53a279cbb358a5bc5602177361a2c50db1f52e93e143623","observation_id":"1498e946-3515-4cf7-a44f-80a8c60823e6","resolution":{"observed_at":"2026-08-07T10:31:58.616272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13867","last_updated":"2022-03-25T19:08:30Z","snapshot_observed_at":"2026-08-04T17:06:07.147028Z","submitted_at":"2022-03-25T19:08:30Z","title":"Data Selection Curriculum for Neural Machine Translation","version":1},"cited_work":{"arxiv_id":"2203.13867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.13867","snapshot_observed_at":"2026-08-07T10:31:59.576672Z","title":"Data Selection Curriculum for Neural Machine Translation","venue":"cs.CL","work_id":"899cca2d-14d8-4111-b159-373163cd9bdd","year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.624070Z"},"links":{"cited_paper":"/paper/2203.13867","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:d6f416202c59591ccd8fa8f6dbcda3306488879ff24adbae92197a346a0a1e36","observation_id":"3f2dc168-26ff-42c7-9480-3cc7297b2e88","resolution":{"observed_at":"2026-08-07T10:31:59.584675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.631752Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.631752Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:e06fa651edd0c81b0d60e72008373148fda3f9df45cda26bd43c60718e1478c1","observation_id":"c76aba47-09a2-417d-9cbd-2353896b00d0","resolution":{"observed_at":"2026-08-07T10:31:58.631752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T10:31:58.636142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.636142Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:05ff3f2644492bda5363c7b959a5db7dc64b21577c8bd444592027348acb42ee","observation_id":"de183fdf-da0d-405a-9522-aa91a473317c","resolution":{"observed_at":"2026-08-07T10:31:58.636142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.642529Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.642529Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:5a2c33b5ec454130587eaf190b731cae40661a1ef329351e9d36384ea629a89f","observation_id":"81dbe7df-1593-4f49-8999-e9be208fac69","resolution":{"observed_at":"2026-08-07T10:31:58.642529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-07T10:31:58.649510Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.649510Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:a87a4e336725a8e0aa27d43131606c0d6e5843cb8051cf4b7e9a6e8309bbe95c","observation_id":"ba0f3cae-cacc-4523-ae81-b2088667c66a","resolution":{"observed_at":"2026-08-07T10:31:58.649510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.658846Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.658846Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:b546facc04e2d10000a53b8a7aa8ae915a21fa7dd390f621025d0d77fcf239d5","observation_id":"6ff6da39-141a-4f59-892b-45aec30628e4","resolution":{"observed_at":"2026-08-07T10:31:58.658846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04304","last_updated":"2017-11-13T20:11:26Z","snapshot_observed_at":"2026-08-09T04:03:30.544666Z","submitted_at":"2017-05-11T17:39:35Z","title":"A Deep Reinforced Model for Abstractive Summarization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04304","snapshot_observed_at":"2026-08-07T10:31:58.667226Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.667226Z"},"links":{"cited_paper":"/paper/1705.04304","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:16ca2b52f772e14737d5cf764e78e86dfbf421665a8c0515b1b7b54bb35208a0","observation_id":"72c4d4ec-207c-4e44-af5a-22c86d951f6e","resolution":{"observed_at":"2026-08-07T10:31:58.667226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.674801Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.674801Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:d4832d852cb0ea4b94bb0825c6a07593adb5a901bab2957dc8df931231f93fa7","observation_id":"634703e7-9912-421d-99fa-4981135fea13","resolution":{"observed_at":"2026-08-07T10:31:58.674801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06732","last_updated":"2016-05-06T21:18:46Z","snapshot_observed_at":"2026-07-31T03:58:50.695173Z","submitted_at":"2015-11-20T19:25:54Z","title":"Sequence Level Training with Recurrent Neural Networks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06732","snapshot_observed_at":"2026-08-07T10:31:58.686521Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.686521Z"},"links":{"cited_paper":"/paper/1511.06732","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:0647bf737757404f03dfde6b86f65a9c158bdc4ab40d2dece9edc790b074df36","observation_id":"7546240a-fe56-49ee-9a50-cb308bc9dcce","resolution":{"observed_at":"2026-08-07T10:31:58.686521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06243","last_updated":"2022-09-13T18:05:12Z","snapshot_observed_at":"2026-08-05T03:06:38.187055Z","submitted_at":"2022-09-13T18:05:12Z","title":"CometKiwi: IST-Unbabel 2022 Submission for the Quality Estimation Shared Task","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06243","snapshot_observed_at":"2026-08-07T10:31:58.695659Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.695659Z"},"links":{"cited_paper":"/paper/2209.06243","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:9a32ad2390c579cf0cf9a54de382ebbe5e0eb0b523c2a8e747365048e2164ed0","observation_id":"de7414d2-0c46-47b5-a8cd-bdd307e1ccbd","resolution":{"observed_at":"2026-08-07T10:31:58.695659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.421620Z","title":null,"venue":null,"work_id":"cdeeb63d-05d4-4367-b371-e23d708e97e4","year":2025},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.708564Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:c0b24496c348261e37a5e23087137044035e310adc4dacc345bc022dd0b9b011","observation_id":"f6b07334-fa51-48c8-93af-475f9dd68877","resolution":{"observed_at":"2026-08-07T10:32:00.428159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T10:31:58.718462Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.718462Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:355b52533477017bfa8eedee0cabe51171508d48705e0014a6c84f81fd014af8","observation_id":"3fbde2c5-7427-45d4-b5ff-54aeb36988ba","resolution":{"observed_at":"2026-08-07T10:31:58.718462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T10:31:58.726456Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.726456Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:3ccc6385b7f37ecf931f4481608d79cd7d9cd07f6a834953aae4f458dd2310e6","observation_id":"7146a338-e57b-45a4-b569-ff02429e57e1","resolution":{"observed_at":"2026-08-07T10:31:58.726456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T10:31:58.732799Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.732799Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:c5af278019df7d0cb7844c98215a62c690066b849ddbe05b45df273cb8391d92","observation_id":"db15dab3-617d-45c3-9bc5-5c2e30ac7a59","resolution":{"observed_at":"2026-08-07T10:31:58.732799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T10:31:58.745477Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.745477Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:ce0cab9bb6271bb1ac5eb667a59050af6cffc5fd5015938666e373ed651085f5","observation_id":"9025b613-d158-4572-a2cf-f3a101bd963c","resolution":{"observed_at":"2026-08-07T10:31:58.745477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-07T10:31:58.756060Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.756060Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:77a2929561705d6a51e053e9173bf150b3dd627275d3832b7427d6b0e242301e","observation_id":"9947951e-4a71-4b89-b52c-05bb67fd4854","resolution":{"observed_at":"2026-08-07T10:31:58.756060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.399035Z","title":null,"venue":null,"work_id":"33bf50fa-bc7b-4910-a82d-2e3b7c1c6d3b","year":2016},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.765145Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:e1f1f95e9ca76bb28277f28b6ea346624ce897ac67d54665f93b87432ac6bde9","observation_id":"2f3e331b-e8ef-4e76-b81d-f74935f5872e","resolution":{"observed_at":"2026-08-07T10:32:00.404365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.771678Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.771678Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:606a7e9593e0af88ce6edc4dd052a52bfb175e667602deb76c34e15ac873add3","observation_id":"8a9f80ef-f7d5-49e6-980f-6ae046fda1ad","resolution":{"observed_at":"2026-08-07T10:31:58.771678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13630","last_updated":"2025-04-18T11:11:14Z","snapshot_observed_at":"2026-08-07T16:01:09.985596Z","submitted_at":"2025-04-18T11:11:14Z","title":"Remedy: Learning Machine Translation Evaluation from Human Preferences with Reward Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13630","snapshot_observed_at":"2026-08-07T10:31:58.777646Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.777646Z"},"links":{"cited_paper":"/paper/2504.13630","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:70e613851b2ba08284edea1d67dac29d99e6b76772c4ec070622d483f5ba6d72","observation_id":"33e343d7-4346-4f97-b0a4-f8318d52c449","resolution":{"observed_at":"2026-08-07T10:31:58.777646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T10:31:58.786233Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.786233Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:bbd88026403772b517783cc87c9f8c45a85d7f2b52c40b41536201fbd6e49184","observation_id":"63f20127-0258-40f2-ae54-3a42bcec1421","resolution":{"observed_at":"2026-08-07T10:31:58.786233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.08827","last_updated":"2020-11-17T18:48:59Z","snapshot_observed_at":"2026-08-09T10:45:55.444208Z","submitted_at":"2020-11-17T18:48:59Z","title":"Avoiding Tampering Incentives in Deep RL via Decoupled Approval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.08827","snapshot_observed_at":"2026-08-07T10:31:58.792853Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.792853Z"},"links":{"cited_paper":"/paper/2011.08827","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:8450f1796316ca1363b891a9f86fb3c24c134fab069d6edc503b010ff7b1569b","observation_id":"b2132ac7-0138-43b4-9e8b-6ed0322c2619","resolution":{"observed_at":"2026-08-07T10:31:58.792853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.798141Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.798141Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:0c97bdb72214e4a26d37b7f4d12fdd9ea85792d0e79033fa2e0fded7a61e3f0e","observation_id":"bc1bbd2b-cabe-4d28-9688-5e48e084313d","resolution":{"observed_at":"2026-08-07T10:31:58.798141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.354729Z","title":null,"venue":null,"work_id":"cf5a4dc2-12be-41c8-80b9-3f013c2fcd34","year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.806096Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:0cf8cea32ed8860b1576369c86a10a4a658bc2f15d55ead248fcb871da088e15","observation_id":"b456d0f2-4452-4108-b873-bff66967c961","resolution":{"observed_at":"2026-08-07T10:32:00.364386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-08T23:00:32.885841Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-07T10:31:58.811397Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.811397Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:c500321de52a3313f3d6fe082e3cde6182cc81f94e14fff5ef2bb3810887a421","observation_id":"7db21fb0-8274-483a-855a-770646a5f354","resolution":{"observed_at":"2026-08-07T10:31:58.811397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.822218Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.822218Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:eace5f1bb46c117149d821d6adc748071f49b738e02407afea0fe820d7d88a10","observation_id":"4f4a20ab-a61a-4ed7-a2f4-e9030f44c884","resolution":{"observed_at":"2026-08-07T10:31:58.822218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.827925Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.827925Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:c5290cd9b7be030bfd0f8ebfdacbb2b73b464e2595316b35d419d117e2665e2e","observation_id":"3dba0183-55ae-4acf-8082-250d94d7ab31","resolution":{"observed_at":"2026-08-07T10:31:58.827925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:31:58.837869Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.837869Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:1f30c23910d6bb8160ddb46314762c29cef7d61d31301493bdfa7a0d3d432599","observation_id":"8b9d0a21-403c-4f8c-b44b-a0a6dc4c42d8","resolution":{"observed_at":"2026-08-07T10:31:58.837869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11674","last_updated":"2024-02-06T08:03:27Z","snapshot_observed_at":"2026-08-08T14:40:34.532170Z","submitted_at":"2023-09-20T22:53:15Z","title":"A Paradigm Shift in Machine Translation: Boosting Translation Performance of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11674","snapshot_observed_at":"2026-08-07T10:31:58.843811Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.843811Z"},"links":{"cited_paper":"/paper/2309.11674","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:78ff42e23f3b380e1506beefcd1c9f77eb25ce64c4aedf6c4715b1925567efa1","observation_id":"bdadc1b5-c4b4-4594-b592-672929e0f370","resolution":{"observed_at":"2026-08-07T10:31:58.843811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:32:00.311700Z","title":null,"venue":null,"work_id":"0f4f12d1-3191-4ae5-bf20-50d136de317c","year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.850713Z"},"links":{"citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:02e7370d9be85447595ae4df3c9a74c4f984cbb742f6c4e15e1b0cbd14c48b5c","observation_id":"74720cda-6b79-43b4-9a2f-e39f780edf78","resolution":{"observed_at":"2026-08-07T10:32:00.318317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08417","last_updated":"2024-06-03T01:28:06Z","snapshot_observed_at":"2026-07-06T17:16:13.055978Z","submitted_at":"2024-01-16T15:04:51Z","title":"Contrastive Preference Optimization: Pushing the Boundaries of LLM Performance in Machine Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08417","snapshot_observed_at":"2026-08-07T10:31:58.854906Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.854906Z"},"links":{"cited_paper":"/paper/2401.08417","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:cdcbad36c6f60c50421651e94b29d3c22aa1bc224f7e92037202435f693b26de","observation_id":"39ece709-7d17-4acd-a95f-5c97499f6594","resolution":{"observed_at":"2026-08-07T10:31:58.854906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T20:19:40.200696Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 1 inbound Pith citation observation for arXiv:2506.05070."}