{"as_of":"2026-08-15T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3411721e409fe59671c5f5111480c10c2dba2ba5e9253b78ff85f86204e9e45f","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:49:49.180444Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:38:50.313305Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:46:14.342643Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"cited_work":{"arxiv_id":"2506.16024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16024","snapshot_observed_at":"2026-07-01T20:46:14.342643Z","title":"From general to targeted rewards: Surpassing gpt-4 in open-ended long-context generation","venue":null,"work_id":"caf06441-d279-4310-b2b9-8064bda8ddc5","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":176,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2506.16024","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:883a6c7fc05c7ecfd6a49f197def5bbd414427dddd637650493d4bc88a3032de","observation_id":"30c3a4b0-31ad-41ca-941c-9751ccf1f351","resolution":{"observed_at":"2026-05-18T00:05:31.664012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"cited_work":{"arxiv_id":"2506.16024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16024","snapshot_observed_at":"2026-07-01T20:46:14.342643Z","title":"From general to targeted rewards: Surpassing gpt-4 in open-ended long-context generation","venue":null,"work_id":"caf06441-d279-4310-b2b9-8064bda8ddc5","year":2025},"citing_paper":{"arxiv_id":"2605.07465","last_updated":"2026-05-08T09:13:12Z","snapshot_observed_at":"2026-08-14T15:00:23.907012Z","submitted_at":"2026-05-08T09:13:12Z","title":"SEIF: Self-Evolving Reinforcement Learning for Instruction Following","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:51:09.514927Z"},"links":{"cited_paper":"/paper/2506.16024","citing_paper":"/paper/2605.07465"},"observation_digest":"sha256:9422efb4abed12b85113ddd24e897899bf6e1cefa0b6d920072a377696acd382","observation_id":"2130b475-363d-4d1c-8fd9-220de7dafc4d","resolution":{"observed_at":"2026-05-11T04:20:55.949246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"cited_work":{"arxiv_id":"2506.16024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16024","snapshot_observed_at":"2026-07-01T20:46:14.342643Z","title":"From general to targeted rewards: Surpassing gpt-4 in open-ended long-context generation","venue":null,"work_id":"caf06441-d279-4310-b2b9-8064bda8ddc5","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-08-12T03:28:30.781632Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2506.16024","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:a58efe2198da25bdc313a067d3ff6c8469800ffdad71b7ab05dc00fcd44c5b5f","observation_id":"6c6922a7-4223-4a49-87bf-676531d8ee2e","resolution":{"observed_at":"2026-07-01T20:46:14.343964Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16024/citation-record","integrity":"/paper/2506.16024/integrity","json":"/paper/2506.16024/citation-record.json","paper":"/paper/2506.16024"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.324850Z","title":null,"venue":null,"work_id":"2a0ca6f6-429b-45a2-beb2-9c3be9495233","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.699129Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:de2de0106f79533ad38f94cfa78f9cd8c824ef15c2d520c9a2dc27f6f5125ec2","observation_id":"b9f414b3-ef0a-4c8a-b75f-41f8bef65d7d","resolution":{"observed_at":"2026-08-06T23:49:54.408301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-12T12:34:50.226758Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-06T23:49:43.738491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.738491Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:cd1b96c0571570c19617a0c564c4b48921e06bda0719e988ac0f38a05147b269","observation_id":"8cef63ee-899a-4c2a-a768-7c7e7237abcf","resolution":{"observed_at":"2026-08-06T23:49:43.738491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.128295Z","title":null,"venue":null,"work_id":"f740d991-afc7-43a7-a6a2-76811c8723c0","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.814403Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9358dd642668d8e68e669e9d52bbffc3eb747657090550d3dc76ba83732f11b4","observation_id":"2e556eaf-749a-4e32-bb5e-5633c28f2cb8","resolution":{"observed_at":"2026-08-06T23:49:54.237578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07055","last_updated":"2024-08-13T17:46:12Z","snapshot_observed_at":"2026-08-12T23:04:08.269970Z","submitted_at":"2024-08-13T17:46:12Z","title":"LongWriter: Unleashing 10,000+ Word Generation from Long Context LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07055","snapshot_observed_at":"2026-08-06T23:49:43.860165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.860165Z"},"links":{"cited_paper":"/paper/2408.07055","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:06445c010ba16ab967c380db86b418d6c86d1b4c047961a27c83e64faf456abd","observation_id":"2c265f62-e1ab-424a-ae77-ee52b5c3ca48","resolution":{"observed_at":"2026-08-06T23:49:43.860165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.006395Z","title":null,"venue":null,"work_id":"773a6ec9-52d8-43bf-abdc-deebded9c447","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:43.907794Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:d493734b05af10bc208584a9f124c8b0c4faa0fea5d403d48268b37007cd8676","observation_id":"236c8de7-949f-42ca-afef-dbfbce19af36","resolution":{"observed_at":"2026-08-06T23:49:54.052816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.022270Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.022270Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:a2a0b2116123ee1319bb1f62b7fecfd1a09023f08f7bd3614e384a2917964fe8","observation_id":"4d36f76e-7a00-4171-a2b9-2da1305902de","resolution":{"observed_at":"2026-08-06T23:49:44.022270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.120598Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.120598Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:1d87994ca12cf86c6e4a72a7a3fa5572505fdd35004cb874f0956874d525110f","observation_id":"5f8acf18-99c1-4c75-817f-aa49b9edf5f5","resolution":{"observed_at":"2026-08-06T23:49:44.120598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.272093Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.272093Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:3e812b17e5c0fc93379c937c6212aaa9477f51e0c7f647fd7c77511b13682cd0","observation_id":"5f68243e-48e3-4e26-b3b3-ef1c2eeadc7c","resolution":{"observed_at":"2026-08-06T23:49:44.272093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-06T23:49:44.314588Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.314588Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:4e332afb5337935a523f08f3585cab7b2328c83cf913b03e61b00e74248f9d9a","observation_id":"5f09216f-3f4f-4346-8399-c217cdace7bf","resolution":{"observed_at":"2026-08-06T23:49:44.314588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.809291Z","title":null,"venue":null,"work_id":"e2394ca6-0530-48a6-a15a-20936bca497e","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.329946Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:421c5eaa2ffb4ad82c636bd3f1513d3a9db874bb31172633da55926f8ed07a26","observation_id":"4417de2c-c90c-4496-8e18-b2eb200b88d8","resolution":{"observed_at":"2026-08-06T23:49:53.894572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.633630Z","title":null,"venue":null,"work_id":"ec303062-bed2-4f9e-9c8e-9e7ef2a948fc","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.396554Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ec654ced6c06d9885d1218874b94e39f2105c1ba4f5c8fe2263223d5766db559","observation_id":"5974bde4-aca8-44c4-92c9-6f0a835ffd91","resolution":{"observed_at":"2026-08-06T23:49:53.735912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.474187Z","title":null,"venue":null,"work_id":"8de52d57-16c4-407d-8c95-5c88146a2102","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.479076Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:231c06546bef7e4c1b46ced421e2a3aa3270d1353057f2fedc47ea27088fff94","observation_id":"12cae417-0717-4ead-9967-196f7ce980de","resolution":{"observed_at":"2026-08-06T23:49:53.562496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02554","last_updated":"2023-04-05T16:17:32Z","snapshot_observed_at":"2026-08-13T12:08:38.240705Z","submitted_at":"2023-04-05T16:17:32Z","title":"Human-like Summarization Evaluation with ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02554","snapshot_observed_at":"2026-08-06T23:49:44.575596Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.575596Z"},"links":{"cited_paper":"/paper/2304.02554","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:574fe37e1ee6824f6714063845f67a53a378e2a20a7f6ebf4cba12f4a23252fd","observation_id":"6d4cbf06-a589-4f36-8b55-fe83b1168291","resolution":{"observed_at":"2026-08-06T23:49:44.575596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:49:44.657266Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.657266Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:3d36543526bd2a4bb6760c4514adb38465ff27db8ae021026f68c93985311263","observation_id":"ee2d02a8-d372-4b79-83ea-5b07b22a068b","resolution":{"observed_at":"2026-08-06T23:49:44.657266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-06T23:49:44.770766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.770766Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:b2917939a72904afb1dcfcfaa7a09cee212191270630d9c8a9d78dd47e887773","observation_id":"d7fb7a6a-2efb-44d7-b6cd-fb0a866d80fa","resolution":{"observed_at":"2026-08-06T23:49:44.770766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-06T23:49:44.861710Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.861710Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c59acb9b5470992f7b740b64c43e73c4e09b21619a7396404885def0147f23ee","observation_id":"7477ff42-3194-405c-b262-185315e163df","resolution":{"observed_at":"2026-08-06T23:49:44.861710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:49:44.944982Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:44.944982Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:0ea07e33d2ea9a7ce1b46e7be8ecd4f8ab8fab35252cac895e1d85924001894c","observation_id":"7042a2e3-5ddb-4d6c-8f2a-26fb77cc0a4a","resolution":{"observed_at":"2026-08-06T23:49:44.944982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02490","last_updated":"2024-10-30T14:53:22Z","snapshot_observed_at":"2026-08-12T23:30:11.201041Z","submitted_at":"2024-07-02T17:59:56Z","title":"MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02490","snapshot_observed_at":"2026-08-06T23:49:45.021883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.021883Z"},"links":{"cited_paper":"/paper/2407.02490","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:3b765dc8f4f3cd208b192376d06c96212061a6e841021ef4917be9fdddb52d70","observation_id":"c35b17de-6ccc-4761-af96-722dbe43503c","resolution":{"observed_at":"2026-08-06T23:49:45.021883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-08-15T13:17:00.526689Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T23:49:45.103956Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.103956Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:55a32866c9016505e98b258fac4d057816bbb51794266d6aae183f146870fd51","observation_id":"529850c2-aedf-4374-af1a-c1af52d8c8fd","resolution":{"observed_at":"2026-08-06T23:49:45.103956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08460","last_updated":"2024-10-03T15:46:13Z","snapshot_observed_at":"2026-08-14T22:18:19.372081Z","submitted_at":"2023-04-17T17:36:35Z","title":"LongForm: Effective Instruction Tuning with Reverse Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08460","snapshot_observed_at":"2026-08-06T23:49:45.194684Z","title":"o ksal, Timo Schick, Anna Korhonen, and Hinrich Sch \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.194684Z"},"links":{"cited_paper":"/paper/2304.08460","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ae1c40deac35b98f7205fe4315b0e9a9be1c4effa0374a08529e197fc6e38a02","observation_id":"34d087a0-cd4a-4e21-b2f9-d566fe2f35c2","resolution":{"observed_at":"2026-08-06T23:49:45.194684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.318152Z","title":null,"venue":null,"work_id":"d5b21bb4-a3a5-47a4-8306-fb33ab88cec2","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.242809Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:dde239f201f8a26b3e4b21444b0e92b3866dd8466d02d484b910b43482e7e566","observation_id":"a5f31b34-4056-49a4-8c61-6cf39760e3e5","resolution":{"observed_at":"2026-08-06T23:49:53.402762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11016","last_updated":"2024-10-15T03:24:47Z","snapshot_observed_at":"2026-08-12T23:34:02.141359Z","submitted_at":"2024-06-27T01:52:05Z","title":"LongLaMP: A Benchmark for Personalized Long-form Text Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11016","snapshot_observed_at":"2026-08-06T23:49:45.315741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.315741Z"},"links":{"cited_paper":"/paper/2407.11016","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:25812a0e8f5c147d4cbd6bb92599d3f1c607d7c1a7db5b3a68bc4aae6d8d2c0f","observation_id":"0d698436-d03b-4e13-a145-6c37421a7044","resolution":{"observed_at":"2026-08-06T23:49:45.315741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.149785Z","title":null,"venue":null,"work_id":"727f3f6b-bff1-493b-b66e-6d2d64289609","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.393122Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:7153f0d61fb8e7880aac1c415aa699d4cb2640a85ea5baa47f9a4ddab838efb2","observation_id":"c3c620a6-2120-4b1c-a9c2-a7dcadeb3e73","resolution":{"observed_at":"2026-08-06T23:49:53.216011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.961378Z","title":null,"venue":null,"work_id":"64f34224-117f-4c67-9749-f0059b66e8a5","year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.467796Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:81d8df1cb8f18eae4fafd2737ad0fbe86c024b5ce5c00aabfafa5e2f97b9845f","observation_id":"0179e988-ab6e-43f0-92ac-1d417b699cf5","resolution":{"observed_at":"2026-08-06T23:49:53.054656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.826790Z","title":null,"venue":null,"work_id":"d481fcbc-9a52-44ef-8481-80891784834e","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.539371Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:75a17f30c44362e346ef6ae5c2e783cf58cef72d57d41f53fb7840bafdb214b4","observation_id":"a4d8107f-edb6-4c45-b171-df8fd309b3d6","resolution":{"observed_at":"2026-08-06T23:49:52.915515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02060","last_updated":"2024-06-12T02:46:16Z","snapshot_observed_at":"2026-08-15T14:57:42.705501Z","submitted_at":"2024-04-02T15:59:11Z","title":"Long-context LLMs Struggle with Long In-context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02060","snapshot_observed_at":"2026-08-06T23:49:45.617067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.617067Z"},"links":{"cited_paper":"/paper/2404.02060","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c43a683490ff957c1c1cbfa09ca4c266e5b6235740a63451eb9498255660bcbc","observation_id":"dfa0033a-f9b9-48e1-b771-49d7b24b3522","resolution":{"observed_at":"2026-08-06T23:49:45.617067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.642494Z","title":null,"venue":null,"work_id":"d1667959-fd51-4592-98f7-9a7f2a7db714","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.687633Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9d61eb02a63fb425fa6ece10e0065d5ae9648540e0ac2b7c38d43a892e1f754a","observation_id":"5c469c74-a5be-4097-ac07-bf4a99c668c9","resolution":{"observed_at":"2026-08-06T23:49:52.753067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.453704Z","title":null,"venue":null,"work_id":"03d596a3-13db-4354-b801-94cdd79f4f9a","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.739551Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:e9d814a58f7a88b744406871d65da2765f1ecf12dafc797138dfe80c3074553d","observation_id":"88c43ae2-e0bf-4f22-a362-20ad6e67b8e9","resolution":{"observed_at":"2026-08-06T23:49:52.520620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:45.792936Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.792936Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:62eb35170bc9bcdb3363553b8782a2b1b6930369a61f91c11c3e91d089a3a9d6","observation_id":"13afb7af-db6b-4057-8a33-5dd80c6b2a6e","resolution":{"observed_at":"2026-08-06T23:49:45.792936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:49:45.880835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.880835Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:b393c0cd18c421daeea40d36dfd2e169197312e48a2d31909386b34ce8a95f3f","observation_id":"a6fe5f2d-6df3-4d70-a985-0738b2b35da9","resolution":{"observed_at":"2026-08-06T23:49:45.880835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:45.941061Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.941061Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:4c43ba3f24d6054c14c003e7a5a38d7be509cbdee04263a532981bbf166a4ced","observation_id":"830307c8-b165-4305-bbf1-ec2a4ef09ced","resolution":{"observed_at":"2026-08-06T23:49:45.941061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04199","last_updated":"2024-10-24T14:43:22Z","snapshot_observed_at":"2026-08-13T06:43:39.996414Z","submitted_at":"2024-10-05T15:33:25Z","title":"LongGenBench: Long-context Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04199","snapshot_observed_at":"2026-08-06T23:49:45.997697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:45.997697Z"},"links":{"cited_paper":"/paper/2410.04199","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:370bea2c636404fd7bc1bc659978953d5f36107619081a7e115f9462270724eb","observation_id":"086c634b-f677-4d9c-8c9a-9cef0dbeb295","resolution":{"observed_at":"2026-08-06T23:49:45.997697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.307551Z","title":null,"venue":null,"work_id":"6f3f0096-a70e-4fb7-9548-6261fe5fcd71","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.093389Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:40df4ae40198a6e95ca3a33803591583578fbb6b728937387e4a16ec98de92fe","observation_id":"a592615a-3980-41cd-aced-ef607163ab2d","resolution":{"observed_at":"2026-08-06T23:49:52.378599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12630","last_updated":"2024-08-09T00:01:58Z","snapshot_observed_at":"2026-08-14T02:10:47.884788Z","submitted_at":"2024-05-21T09:33:31Z","title":"Exploration of Masked and Causal Language Modelling for Text Generation","version":2},"cited_work":{"arxiv_id":"2405.12630","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12630","snapshot_observed_at":"2026-08-06T23:49:49.670750Z","title":"Exploration of Masked and Causal Language Modelling for Text Generation","venue":"cs.CL","work_id":"3612a61f-abac-475b-abc0-201b7b98b6d8","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.175021Z"},"links":{"cited_paper":"/paper/2405.12630","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c706ab6d3b249cf10b470e36e777723c1278c456a5e8334fcf180158dd9a54bb","observation_id":"a32eb9f3-2544-4fb3-8e49-00b627fadd6e","resolution":{"observed_at":"2026-08-06T23:49:49.759678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.164167Z","title":null,"venue":null,"work_id":"aebe3b45-6014-44e0-916e-f88ee363dff9","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.255452Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:6f76f3842ec93cc9ff4e3ecb324821043df56bafee0cd39f5dc8f09e38cb21d8","observation_id":"10dafc76-c9c9-4275-8617-cbff01502816","resolution":{"observed_at":"2026-08-06T23:49:52.222337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.041783Z","title":null,"venue":null,"work_id":"e24fe567-214d-4815-90a4-a9a5933d74da","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.319450Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:5049343b15aecf7ff6bb8b4444617a98a77fb669344c9d8da6e95139e28ac913","observation_id":"f888ce7a-2b12-49b9-9897-b8e67fc92e8f","resolution":{"observed_at":"2026-08-06T23:49:52.074672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.383781Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.383781Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:238abc7d3442b7d123657c1bc96c863755484685b412ee72c84fb6d115e22ded","observation_id":"d63995fc-019c-46d9-9870-002206de8f2a","resolution":{"observed_at":"2026-08-06T23:49:46.383781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.451664Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.451664Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:03436f0da475bb0670e258c026eb08809e32e4e566d4bcaa291b81e9c4f0ce4b","observation_id":"d42f8e59-0122-4261-9780-078650f3b807","resolution":{"observed_at":"2026-08-06T23:49:46.451664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.900473Z","title":null,"venue":null,"work_id":"e3a250d3-803d-4a53-9fe9-545560fd987f","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.512069Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:dce0839d461a38b91e330f0153fd3c71cf69401a469e80d5b28446aaeb8a3473","observation_id":"92eb86ef-20e4-4d99-af77-27d2cbf87aca","resolution":{"observed_at":"2026-08-06T23:49:51.955371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19371","last_updated":"2024-10-02T01:01:57Z","snapshot_observed_at":"2026-08-14T11:13:20.839498Z","submitted_at":"2024-06-27T17:50:35Z","title":"Suri: Multi-constraint Instruction Following for Long-form Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19371","snapshot_observed_at":"2026-08-06T23:49:46.578703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.578703Z"},"links":{"cited_paper":"/paper/2406.19371","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:e32d0e5ce2f01528dd8b849719677cb89e3936f8939797f4a2f9eb16f42500f5","observation_id":"12605ee8-c6ba-4fd6-9164-6c7aac2cafc5","resolution":{"observed_at":"2026-08-06T23:49:46.578703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.802626Z","title":null,"venue":null,"work_id":"bb343693-89eb-4d69-b4f8-30a4d009a267","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.677908Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:0458f755d288126ac5a9bfd35739c2f74fbdbecbfead6f3d076f6df9b4211d66","observation_id":"51abed4d-7cb7-4fb6-b823-3491463ad441","resolution":{"observed_at":"2026-08-06T23:49:51.856072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16191","last_updated":"2024-09-24T15:38:11Z","snapshot_observed_at":"2026-08-12T22:38:31.274535Z","submitted_at":"2024-09-24T15:38:11Z","title":"HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16191","snapshot_observed_at":"2026-08-06T23:49:46.777966Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.777966Z"},"links":{"cited_paper":"/paper/2409.16191","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ebb9a1c88fb5ceeab32e1552764494f2e193c1b34bf24380c83a15cc34627f0b","observation_id":"61142bbc-84ef-42df-8c1f-b9fea274b958","resolution":{"observed_at":"2026-08-06T23:49:46.777966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.874265Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.874265Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:cd7aed12a3c4bf79a350994ece20d9ff2d619ee852a40327c3d437f771ef5eb8","observation_id":"d6570b55-f2a4-4d3a-86ad-9cac1299f8aa","resolution":{"observed_at":"2026-08-06T23:49:46.874265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.570230Z","title":null,"venue":null,"work_id":"34492f2a-af97-4a6c-888d-095c1ffa6d5a","year":2017},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:46.997928Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:aeff0ea0f990fcf7d2883497e9a88b34077ae6e6684ec215d9ec258a3c5e8e96","observation_id":"9eed7ccb-e89a-4efb-9ae5-7a14134382ce","resolution":{"observed_at":"2026-08-06T23:49:51.683561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:47.087005Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.087005Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ef9bbd9ae96efc1a88621588990201ca02a0063365fb6456e0a0861e75dab77a","observation_id":"40630c9e-4032-4943-8cbe-acfa5b8f5174","resolution":{"observed_at":"2026-08-06T23:49:47.087005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17492","last_updated":"2024-02-27T18:42:42Z","snapshot_observed_at":"2026-08-13T11:05:29.065463Z","submitted_at":"2023-06-30T09:07:37Z","title":"Preference Ranking Optimization for Human Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17492","snapshot_observed_at":"2026-08-06T23:49:47.131971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.131971Z"},"links":{"cited_paper":"/paper/2306.17492","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:f62c7d3a2d2b10c709b151940b4b8947613359189c037267eaab91985352995b","observation_id":"5879515a-38ee-40e5-bfec-08e0afebe51f","resolution":{"observed_at":"2026-08-06T23:49:47.131971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.330646Z","title":null,"venue":null,"work_id":"e15162f4-2e6c-43e1-8e34-3f8f607a5026","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.192922Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:b3246c624cb7af82d68ee19094f2eebd36652795d41a08197e8178e876895e4e","observation_id":"d61cef29-e34b-401a-896f-fe36f61d1391","resolution":{"observed_at":"2026-08-06T23:49:51.412239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15042","last_updated":"2024-06-04T12:46:47Z","snapshot_observed_at":"2026-08-15T13:23:26.565561Z","submitted_at":"2024-01-26T18:12:25Z","title":"PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models","version":4},"cited_work":{"arxiv_id":"2401.15042","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15042","snapshot_observed_at":"2026-08-06T23:49:49.372111Z","title":"PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models","venue":"cs.CL","work_id":"8117887d-9c79-49c3-a204-e8a5f24e8881","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.284775Z"},"links":{"cited_paper":"/paper/2401.15042","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:704a1a3b2d883fe32587cb6b1eb131423440bb8ec43e687ead059bb0fe4ad6d4","observation_id":"c63adc82-6224-4d5b-9678-88897cd54dfe","resolution":{"observed_at":"2026-08-06T23:49:49.444103Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04006","last_updated":"2020-11-08T15:53:56Z","snapshot_observed_at":"2026-08-09T15:12:21.086848Z","submitted_at":"2020-11-08T15:53:56Z","title":"Long Range Arena: A Benchmark for Efficient Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.04006","snapshot_observed_at":"2026-08-06T23:49:47.407269Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.407269Z"},"links":{"cited_paper":"/paper/2011.04006","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:1d255626f2ef39118356de4e8aa994a4a372667c5629633dee49fb90074d5a04","observation_id":"6272fee1-3493-4ae4-a8b7-0fe84e220959","resolution":{"observed_at":"2026-08-06T23:49:47.407269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.092742Z","title":null,"venue":null,"work_id":"38fc0fe2-4604-4d23-a498-a2f9c2b889a8","year":2022},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.467394Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c7d15f0c32d75898995a03fe39e3aca3253a0c2450d19c41d7ecce58a58dc9e7","observation_id":"b233dbd9-8c9d-474e-a345-722c41b0d59b","resolution":{"observed_at":"2026-08-06T23:49:51.205623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.916856Z","title":null,"venue":null,"work_id":"936b9645-cb3f-4e15-8b71-17b40c15aaf0","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.581044Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:c58cc18fac3d78795e8f9efdfd7eff2aa49ec87fbfd50b657137c69072cb7297","observation_id":"0883774c-4db3-4d91-a393-76b9d3224910","resolution":{"observed_at":"2026-08-06T23:49:51.006117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:49:47.732683Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.732683Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:fd001936fb6419cb5c86e426e55551cba087a56dddab9104262df31aa24de6c1","observation_id":"16eff6a0-1561-4ddd-9491-e91ea99aa61c","resolution":{"observed_at":"2026-08-06T23:49:47.732683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-12T23:08:15.634578Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-06T23:49:47.837626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.837626Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:9eaffa74e908f729c702c4d0a715061184b4fe9fdee8fe0605623dd81739a532","observation_id":"164df63e-321b-459d-a263-6131ebd555aa","resolution":{"observed_at":"2026-08-06T23:49:47.837626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-08-14T14:27:39.592405Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-06T23:49:47.916012Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.916012Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:00a45e2e3c8c43dc4a98e88bfdc1b010eefe06b8cd664f866fb3bf92c4506c02","observation_id":"95be38fa-aece-4e88-8109-e4c96cdb5f47","resolution":{"observed_at":"2026-08-06T23:49:47.916012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13766","last_updated":"2025-03-11T17:31:27Z","snapshot_observed_at":"2026-08-12T23:19:12.915065Z","submitted_at":"2024-07-18T17:59:30Z","title":"Visual Haystacks: A Vision-Centric Needle-In-A-Haystack Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13766","snapshot_observed_at":"2026-08-06T23:49:48.044179Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.044179Z"},"links":{"cited_paper":"/paper/2407.13766","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:31ea3141401cdaeb302f73c1e21d29769fdbea0efba0a5c1ce6da5947df8ba4e","observation_id":"1d64bf2a-1c1b-4886-bc56-f5b34b402675","resolution":{"observed_at":"2026-08-06T23:49:48.044179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16039","last_updated":"2023-11-14T01:40:13Z","snapshot_observed_at":"2026-08-13T10:03:35.150854Z","submitted_at":"2023-09-27T21:41:49Z","title":"Effective Long-Context Scaling of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16039","snapshot_observed_at":"2026-08-06T23:49:48.167491Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.167491Z"},"links":{"cited_paper":"/paper/2309.16039","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:e48dc5fd9d82d15547ba0055ed20ef1f946d7a37eed003fe527b88d154175c15","observation_id":"1af95218-cebe-4276-b85b-922499cfaf73","resolution":{"observed_at":"2026-08-06T23:49:48.167491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.684860Z","title":null,"venue":null,"work_id":"0dad43e1-87ee-48ce-8641-f4bd2cbd0250","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.262762Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:0183f26caa0301a4b8bb44616fe4ad13936e9ed90755f2f1bfef00d12f42c683","observation_id":"94a2298e-0f4d-4ee8-ac87-a8499243abc1","resolution":{"observed_at":"2026-08-06T23:49:50.776994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.498704Z","title":null,"venue":null,"work_id":"b622a6a7-de9d-498a-bd3a-a33e9cb17d4a","year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.378006Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:96d1316d66e64d636afd3b8524922459aa9971fabeb0332104f2b9fdb1543b09","observation_id":"43cd9b3f-4865-4c7d-8ad1-16fd701443bd","resolution":{"observed_at":"2026-08-06T23:49:50.613756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.317135Z","title":null,"venue":null,"work_id":"1f88ec0d-0033-4ea8-b5ae-5b3140cab65f","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.477481Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:d4bc623f84c2c40c4d5bd1813d9ecd7e93b4e09ffdef0aa1f0087595612488a8","observation_id":"a6f978f5-fece-457e-b9b1-eb2383e21ca4","resolution":{"observed_at":"2026-08-06T23:49:50.390405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.139320Z","title":null,"venue":null,"work_id":"ea437717-9c8c-4420-ab7a-e0aa56abba32","year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.564204Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:ac18f9b145f5d8f5f202979609e7e53a28b8d7128a24ec3587d11c87626029aa","observation_id":"835d83dc-d79c-49c9-9398-323753002d8e","resolution":{"observed_at":"2026-08-06T23:49:50.209143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-13T20:00:16.671415Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-06T23:49:48.654069Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.654069Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:92525c14a7b7c0ec4de06cda913f335e729a89364690e64396934a928f50ce23","observation_id":"a45831ae-3018-49f0-b5f9-0c5dc3b00652","resolution":{"observed_at":"2026-08-06T23:49:48.654069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:48.826479Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.826479Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:af704f275bd57d91ca45f4349c0934106b593ab9d488afa6022a8036f388772d","observation_id":"5c289b82-76f9-485d-9729-a6e8826b1212","resolution":{"observed_at":"2026-08-06T23:49:48.826479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21252","last_updated":"2024-10-28T17:50:42Z","snapshot_observed_at":"2026-08-13T21:26:48.731524Z","submitted_at":"2024-10-28T17:50:42Z","title":"LongReward: Improving Long-context Large Language Models with AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21252","snapshot_observed_at":"2026-08-06T23:49:48.916548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:48.916548Z"},"links":{"cited_paper":"/paper/2410.21252","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:be9e8f18927743e1bc61934189f720f76f9641a6e47964030abb7df5cbe20418","observation_id":"3fe594dc-d118-4ddf-9c68-3c4e21e6461c","resolution":{"observed_at":"2026-08-06T23:49:48.916548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:49.024302Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:49.024302Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:34dd3f1bbc98ef15d07ec51bd3368f26497bc119c6d697697fd1baa6554bb53e","observation_id":"3e0be4d5-c228-4e61-a556-972f360edc0e","resolution":{"observed_at":"2026-08-06T23:49:49.024302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:49.180444Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:49.180444Z"},"links":{"citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:276eae24855db2afd7138df87d9a3ee59d78025f686e2ba33176ad9309af86f6","observation_id":"3fd049d2-2af4-4dbb-8589-4f3b74950240","resolution":{"observed_at":"2026-08-06T23:49:49.180444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T15:36:17.287746Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 3 inbound Pith citation observations for arXiv:2506.16024."}