{"as_of":"2026-08-11T09:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec36a3c52454936b63a291a07909cbdfdc8ebe3ad9c7e5b7ac4c5d720742a5f7","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:31:23.873113Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07641/citation-record","integrity":"/paper/2608.07641/integrity","json":"/paper/2608.07641/citation-record.json","paper":"/paper/2608.07641"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.530690Z","title":null,"venue":null,"work_id":"deb78349-fbcb-474e-b4f6-8e4faf11ff5e","year":2008},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.749154Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:28d37befac66e472ae4f95595f1762237cd11cd2aaf633b6c7de690b9ce52b80","observation_id":"3924a3d8-451f-42af-9fc3-6f389f4c4b62","resolution":{"observed_at":"2026-08-11T00:31:24.533957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.753461Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.753461Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:12913dbcb064ceed4c43d9e4c76d4e0bc6acffdafb0620e5322cafe315b462c2","observation_id":"a713f248-510f-487b-bc75-cd7ceecc5264","resolution":{"observed_at":"2026-08-11T00:31:23.753461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.520925Z","title":null,"venue":null,"work_id":"6453f2d0-2612-4004-aeac-b4f5cc2656d8","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.757079Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:b8e8b6827986b8862eadd8be2c99830eaf7c2b67db0d55bfe604c133d36e7904","observation_id":"09b53882-0be5-4673-95d4-c4a0a4bea4d4","resolution":{"observed_at":"2026-08-11T00:31:24.524000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14317","last_updated":"2025-08-20T00:03:46Z","snapshot_observed_at":"2026-08-11T02:37:51.251369Z","submitted_at":"2025-08-20T00:03:46Z","title":"SurveyGen-I: Consistent Scientific Survey Generation with Evolving Plans and Memory-Guided Writing","version":1},"cited_work":{"arxiv_id":"2508.14317","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.14317","snapshot_observed_at":"2026-08-11T00:31:24.361568Z","title":"SurveyGen-I: Consistent Scientific Survey Generation with Evolving Plans and Memory-Guided Writing","venue":"cs.CL","work_id":"66e0e642-fba4-47dd-8954-5587dd703464","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.760399Z"},"links":{"cited_paper":"/paper/2508.14317","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:e50c975e74e2c4ef3ee5d64b686432bc643304541b9dca2077c6bca74e75899f","observation_id":"5e4b0217-9082-419f-a3c2-3d51716fff63","resolution":{"observed_at":"2026-08-11T00:31:24.365738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-11T00:31:23.764103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.764103Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:a93f51676e7a6c365d0a99b7b339f44d7c3a49973401e31fd469a3290a2ad1c2","observation_id":"d4076298-feec-464a-81ea-808811e11447","resolution":{"observed_at":"2026-08-11T00:31:23.764103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11763","last_updated":"2025-06-13T13:17:32Z","snapshot_observed_at":"2026-08-07T14:15:18.269910Z","submitted_at":"2025-06-13T13:17:32Z","title":"DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11763","snapshot_observed_at":"2026-08-11T00:31:23.767656Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.767656Z"},"links":{"cited_paper":"/paper/2506.11763","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:476a4f10516554a79057919493b321c0151a3b1e7eda25f683a9cfb233f77ff8","observation_id":"790f2f3c-7659-4145-9c24-78d43e9f6e4e","resolution":{"observed_at":"2026-08-11T00:31:23.767656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08008","last_updated":"2025-05-29T13:16:05Z","snapshot_observed_at":"2026-08-04T13:03:20.610282Z","submitted_at":"2024-04-10T01:26:24Z","title":"Sample-Efficient Human Evaluation of Large Language Models via Maximum Discrepancy Competition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08008","snapshot_observed_at":"2026-08-11T00:31:23.771435Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.771435Z"},"links":{"cited_paper":"/paper/2404.08008","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:d7128768e903e9c5b6c1b6b4ccb61ebb80f15cbdee71b96eaf73d8e2138978d1","observation_id":"73fa287c-4ea7-4f00-8d38-4fb7a4ee4c4a","resolution":{"observed_at":"2026-08-11T00:31:23.771435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.512611Z","title":null,"venue":null,"work_id":"7c43d411-d424-44e0-bd2b-dfb77b302cab","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.774909Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:8fbd73a57f92987511d9ed449fe8fb257ce508db15f0da47cc827fc2b08fb992","observation_id":"94f0ffaa-eac1-4b24-ab06-0643baf753df","resolution":{"observed_at":"2026-08-11T00:31:24.515481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T00:31:23.778032Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.778032Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:47c4e703a4ee0dcd7cec14a5af3714119879f1848e69860c88d39329dd42888f","observation_id":"7b7dc261-6b9d-40c2-8bbf-684e6225d3d7","resolution":{"observed_at":"2026-08-11T00:31:23.778032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.06708","last_updated":"2026-04-17T05:08:56Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-08T06:59:23Z","title":"AISysRev -- LLM-based Tool for Title-abstract Screening","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.06708","snapshot_observed_at":"2026-08-11T00:31:23.781493Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.781493Z"},"links":{"cited_paper":"/paper/2510.06708","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:6ed1d9c3d0b2f42c38719c86594905c3260d5bf6cb1a50c773425ddbcce62101","observation_id":"a961bc0e-c835-4177-b8aa-8617c15eef7f","resolution":{"observed_at":"2026-08-11T00:31:23.781493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-11T00:31:23.785317Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.785317Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:66bf3e049afa025736324556269d640fdd7afb41f30dea67c5e1256001deafe1","observation_id":"7af85fb0-70f3-422c-855f-4d0a9a5d2e88","resolution":{"observed_at":"2026-08-11T00:31:23.785317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14776","last_updated":"2025-02-27T06:30:11Z","snapshot_observed_at":"2026-08-07T18:01:14.512854Z","submitted_at":"2025-02-20T17:59:45Z","title":"SurveyX: Academic Survey Automation via Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14776","snapshot_observed_at":"2026-08-11T00:31:23.788693Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.788693Z"},"links":{"cited_paper":"/paper/2502.14776","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:c3b39279f793ad383bf8f57d13a6c8093b59e1ff4323f5b847502629787e1618","observation_id":"bdb46811-2fc9-4f22-b013-768041583a23","resolution":{"observed_at":"2026-08-11T00:31:23.788693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.791995Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.791995Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:9c6354c13ce42f3266fb4a1754838f34d9be333503547bc23494e260128af8f4","observation_id":"cc0d2034-d044-4b48-9c2d-a070513434c8","resolution":{"observed_at":"2026-08-11T00:31:23.791995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.795143Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.795143Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:5f3992fabdff9f8d9ff3cc90bd0f1a8a2bdd9e1872e9c5be35587eed1b684b2c","observation_id":"7b870f55-38d2-4aeb-80b6-639602bc4523","resolution":{"observed_at":"2026-08-11T00:31:23.795143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.494911Z","title":null,"venue":null,"work_id":"9ceb73d9-6df5-46bb-8d3d-c4de22b7ee17","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.797905Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:95cba0aa189aa00029d843b2c4868d8b24bfb24e722a3655e08da8eb254381a4","observation_id":"79eaf0f7-7057-452b-829c-70b36bf0cbe8","resolution":{"observed_at":"2026-08-11T00:31:24.499214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.800478Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.800478Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:80928aa883aae1b52851469f515c36e6e06569c7c3eaccff82341da0caad0a29","observation_id":"819e9d4c-8bd3-460f-b6fe-caf5eeb5976c","resolution":{"observed_at":"2026-08-11T00:31:23.800478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.484031Z","title":null,"venue":null,"work_id":"5cff7bbf-dfe6-4407-b4d0-9518541bdb22","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.803189Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:8916244de05f5f5461b7eaf60de369965478b904e81b107c54772db4f337ed03","observation_id":"e692909d-9f6b-4740-911a-a4bd1f623555","resolution":{"observed_at":"2026-08-11T00:31:24.487919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-11T00:31:23.805873Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.805873Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:96f01a5fb645d20f769c94c90eef962ab05d29182e385c6308ff35a9a556e78b","observation_id":"8a5ed21f-0bc2-4660-9ec8-b122d69382fa","resolution":{"observed_at":"2026-08-11T00:31:23.805873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.473592Z","title":"Howcroft, Ondřej Plátek, and Adarsa Sivaprasad","venue":null,"work_id":"87e69623-5022-4e18-9881-812bc9767ad9","year":null},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.808941Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:55f6a34302e7446c7d77e556203616fe1ffdc8b8cb603670f786b313453e5747","observation_id":"2028d1a5-979c-4dda-b75b-5cfafa1cd86a","resolution":{"observed_at":"2026-08-11T00:31:24.477452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12689","last_updated":"2025-07-21T03:49:38Z","snapshot_observed_at":"2026-08-07T21:58:25.001847Z","submitted_at":"2025-06-15T02:23:47Z","title":"SciSage: A Multi-Agent Framework for High-Quality Scientific Survey Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12689","snapshot_observed_at":"2026-08-11T00:31:23.816102Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.816102Z"},"links":{"cited_paper":"/paper/2506.12689","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:78db17acd167c3b22218a2cc2a38cf5bf32a8b05df65204fe15608009fe69a51","observation_id":"c0f0c7a2-0c72-4bb1-a593-625530128592","resolution":{"observed_at":"2026-08-11T00:31:23.816102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15658","last_updated":"2026-05-02T18:02:31Z","snapshot_observed_at":"2026-07-06T22:16:15.447310Z","submitted_at":"2025-08-21T15:45:10Z","title":"SurGE: A Benchmark and Evaluation Framework for Scientific Survey Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15658","snapshot_observed_at":"2026-08-11T00:31:23.819644Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.819644Z"},"links":{"cited_paper":"/paper/2508.15658","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:119f7980dfe623d69b2d44c387b4282b565d917a92e9e1ef742b014aa45052d6","observation_id":"bc363558-9a3c-4b7f-a0c3-03abdb0efcc4","resolution":{"observed_at":"2026-08-11T00:31:23.819644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21537","last_updated":"2025-05-24T09:07:13Z","snapshot_observed_at":"2026-08-08T02:37:32.325481Z","submitted_at":"2025-05-24T09:07:13Z","title":"OpenReview Should be Protected and Leveraged as a Community Asset for Research in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21537","snapshot_observed_at":"2026-08-11T00:31:23.822952Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.822952Z"},"links":{"cited_paper":"/paper/2505.21537","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:b942b2b1c7beca796103998677898ddce5d509ef648c19a8e9bc1ef393ea0e71","observation_id":"179b090c-4dcc-4733-856d-c1847557fa41","resolution":{"observed_at":"2026-08-11T00:31:23.822952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.826470Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.826470Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:6e926f2f44012e9a5f0a8983363ad4f0986d78efc4ff6f8196873981811f9ac0","observation_id":"841d9628-a6ae-48ea-ad47-a99da211c31c","resolution":{"observed_at":"2026-08-11T00:31:23.826470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.829615Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.829615Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:0ffaf5e692f680f9cc6d30fc1a37f67bfed6606d61f21be62454bdd4e20f16cb","observation_id":"b94c7428-d8ae-4fd9-b4e0-5765ae142366","resolution":{"observed_at":"2026-08-11T00:31:23.829615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03379","last_updated":"2019-11-08T16:59:50Z","snapshot_observed_at":"2026-07-06T08:35:36.927327Z","submitted_at":"2019-11-08T16:59:50Z","title":"Does the use of open, non-anonymous peer review in scholarly publishing introduce bias? Evidence from the F1000 post-publication open peer review publishing model","version":1},"cited_work":{"arxiv_id":"1911.03379","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.03379","snapshot_observed_at":"2026-08-11T00:31:23.979202Z","title":"Does the use of open, non-anonymous peer review in scholarly publishing introduce bias? Evidence from the F1000 post-publication open peer review publishing model","venue":"cs.DL","work_id":"62f6e368-448d-496e-97ff-d929c4c4286f","year":2019},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.832554Z"},"links":{"cited_paper":"/paper/1911.03379","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:eda9c3177fcbab5b46b1f401171ba89e6c1a7611f14d4edee68aba77384cb936","observation_id":"7a8ba177-7172-45de-81a9-9066a89a3da2","resolution":{"observed_at":"2026-08-11T00:31:23.983666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05732","last_updated":"2025-04-15T03:28:58Z","snapshot_observed_at":"2026-08-07T16:07:39.794751Z","submitted_at":"2025-04-08T07:03:48Z","title":"LLM$\\times$MapReduce-V2: Entropy-Driven Convolutional Test-Time Scaling for Generating Long-Form Articles from Extremely Long Resources","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05732","snapshot_observed_at":"2026-08-11T00:31:23.836183Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.836183Z"},"links":{"cited_paper":"/paper/2504.05732","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:91a4a5f6bffa5d98340fce6eff4f79296454b35a45feecef200200556242515a","observation_id":"4a14c638-8bfa-4522-9383-736cadac34e3","resolution":{"observed_at":"2026-08-11T00:31:23.836183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10252","last_updated":"2024-06-18T02:11:31Z","snapshot_observed_at":"2026-07-06T18:31:13.039726Z","submitted_at":"2024-06-10T12:56:06Z","title":"AutoSurvey: Large Language Models Can Automatically Write Surveys","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10252","snapshot_observed_at":"2026-08-11T00:31:23.839626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.839626Z"},"links":{"cited_paper":"/paper/2406.10252","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:f95a20674505a6b931da70e90b91a149accbbcbf8b0220274d295533c296f34e","observation_id":"ee84d0dc-7ab3-4c76-adf5-0dc89c0b699f","resolution":{"observed_at":"2026-08-11T00:31:23.839626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00816","last_updated":"2025-03-08T14:01:34Z","snapshot_observed_at":"2026-08-06T21:05:17.245196Z","submitted_at":"2024-10-28T08:10:21Z","title":"CycleResearcher: Improving Automated Research via Automated Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00816","snapshot_observed_at":"2026-08-11T00:31:23.842997Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.842997Z"},"links":{"cited_paper":"/paper/2411.00816","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:66c246bd187f4e2aa0fd6fc9d9c81a00cc10c0094e54f69a397aca9ef998790d","observation_id":"e0792c6b-2ed6-4ea2-9844-2837232c965f","resolution":{"observed_at":"2026-08-11T00:31:23.842997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-11T00:31:23.846328Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.846328Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:85f60e3633117856bb6813eaa0983a8e0c04b6cc260b453aad691e9e7fc8e18e","observation_id":"4ac32d02-660f-4817-83fe-fe2c10f08a68","resolution":{"observed_at":"2026-08-11T00:31:23.846328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.463514Z","title":null,"venue":null,"work_id":"d93fd5bb-6b30-4d3d-97cb-bf1f4c69ebfc","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.849666Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:beaca6c32ab7f843fc7539e50a981cd540407070f65d7081b3942b8c42407173","observation_id":"3089d24e-488a-4c47-a715-17111e0f2b79","resolution":{"observed_at":"2026-08-11T00:31:24.466798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.852835Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.852835Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:729c0a5af65c7835a9bbdc2826411c0e05cfc6ebf50e0ebc1c5583bfd410172b","observation_id":"20f101cd-94b9-4bc8-8962-0b85c08f6c15","resolution":{"observed_at":"2026-08-11T00:31:23.852835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.448147Z","title":null,"venue":null,"work_id":"72035ddb-d4be-4c01-9d48-18a7847cd3af","year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.855988Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:52f0bb93b20ccede609c9ad4f7e682bc108213d82aacf232b0e1b24365aa8379","observation_id":"ececf2d1-3e5b-437a-9409-518e298f06a2","resolution":{"observed_at":"2026-08-11T00:31:24.451662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15307","last_updated":"2026-08-01T09:50:18Z","snapshot_observed_at":"2026-08-08T13:46:06.471776Z","submitted_at":"2026-01-13T14:42:56Z","title":"DeepSurvey-Bench: Evaluating Academic Value of Automatically Generated Scientific Surveys","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15307","snapshot_observed_at":"2026-08-11T00:31:23.859081Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.859081Z"},"links":{"cited_paper":"/paper/2601.15307","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:debb99124b4e4e31dc527ae7f6458607f6e22a6e65f46cd3041603907bae1e32","observation_id":"0e2e5183-96f3-4dcd-b257-9457e5d7b728","resolution":{"observed_at":"2026-08-11T00:31:23.859081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-11T00:31:23.863168Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.863168Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:72e2ca3e49d286b279d7c7d53f47f95988d6943f04bc2176b6dd3db8547557b7","observation_id":"83583933-90ab-45ac-a456-917e71ca0574","resolution":{"observed_at":"2026-08-11T00:31:23.863168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-11T00:31:23.866507Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.866507Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:8bdbb2e07fc043f13b71dd12ff1e71211288ebd640f307cc6be392d053b29c62","observation_id":"2bf889b1-fe36-4fe9-a1d7-8b44ecf4a99d","resolution":{"observed_at":"2026-08-11T00:31:23.866507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.439157Z","title":null,"venue":null,"work_id":"f1a7f2dd-ba2c-4cc1-a250-50ca51e96e13","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.869926Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:2a1e58f73d6a63c0310e9848ff2f5aec30ebff6da1814e124f28da3eb70a2599","observation_id":"11df19f6-a40a-4e77-94b4-12588f20959b","resolution":{"observed_at":"2026-08-11T00:31:24.442149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10409","last_updated":"2024-02-16T02:21:59Z","snapshot_observed_at":"2026-07-06T17:30:56.216307Z","submitted_at":"2024-02-16T02:21:59Z","title":"Understanding Survey Paper Taxonomy about Large Language Models via Graph Representation Learning","version":1},"cited_work":{"arxiv_id":"2402.10409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10409","snapshot_observed_at":"2026-08-11T00:31:23.906683Z","title":"Understanding Survey Paper Taxonomy about Large Language Models via Graph Representation Learning","venue":"cs.CL","work_id":"3b2750da-4525-4626-92de-4ae5255d8f3d","year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.873113Z"},"links":{"cited_paper":"/paper/2402.10409","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:6082e9fca1a56aa78fcee63641d0b2ebab654a473fc15efc3617db79930e2b03","observation_id":"0ba0a00f-db43-4584-a42d-df36841f118f","resolution":{"observed_at":"2026-08-11T00:31:23.911769Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09169","last_updated":"2024-08-17T11:13:10Z","snapshot_observed_at":"2026-08-10T02:41:11.109796Z","submitted_at":"2024-08-17T11:13:10Z","title":"Automatic Metrics in Natural Language Generation: A Survey of Current Evaluation Practices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09169","snapshot_observed_at":"2026-08-11T00:31:23.812295Z","title":"arXiv:2408.09169 [cs.CL] https://arxiv.org/abs/2408.09169","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.812295Z"},"links":{"cited_paper":"/paper/2408.09169","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:401096c0f3e14387279ca9539a45a8059cc32895dd06e712c394370814ae91c8","observation_id":"f475ab8c-f16a-4625-9b92-a97ad6b153b7","resolution":{"observed_at":"2026-08-11T00:31:23.812295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T09:13:51.763247Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.07641."}