{"as_of":"2026-08-22T20:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0988b8e74db783e813ea58f7a8a3fe91d7f62ce9f70bbeb4cb5531b46737719e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:15:04.585634Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T11:56:55.182171Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02170","last_updated":"2025-09-03T10:39:50Z","snapshot_observed_at":"2026-08-12T22:56:39.509645Z","submitted_at":"2025-09-02T10:22:46Z","title":"Avoidance Decoding for Diverse Multi-Branch Story Generation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T11:56:55.182171Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2509.02170"},"observation_digest":"sha256:47008f4de7949cb458d8777535132729b1903c0e48b15d6cdd41007e7f72868c","observation_id":"0ed3dc4b-ab78-4ac8-bf22-3eb0be8c7ff9","resolution":{"observed_at":"2026-08-05T11:56:55.182171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2509.25424","last_updated":"2026-05-03T20:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T19:32:11Z","title":"Polychromic Objectives for Reinforcement Learning","version":6},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T11:54:29.955833Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2509.25424"},"observation_digest":"sha256:6512fd5d0784b5472a768eeeda8477a37c47d26ae800d0d8ad8468134ad39971","observation_id":"41e0bbe0-176c-4be0-b935-3b4d5c574488","resolution":{"observed_at":"2026-05-18T11:56:19.942452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2604.02686","last_updated":"2026-04-03T03:30:34Z","snapshot_observed_at":"2026-08-14T01:40:46.552765Z","submitted_at":"2026-04-03T03:30:34Z","title":"Beyond Semantic Manipulation: Token-Space Attacks on Reward Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T20:29:31.354743Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2604.02686"},"observation_digest":"sha256:592b09e1d07e27193520714f6993334cab775294f0bf532bb1e10a8e589b8756","observation_id":"b8cfa137-d169-4d5c-ae94-65c69850c69c","resolution":{"observed_at":"2026-05-13T20:33:16.890777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2604.18724","last_updated":"2026-07-31T23:42:40Z","snapshot_observed_at":"2026-08-20T20:11:56.090623Z","submitted_at":"2026-04-20T18:22:31Z","title":"Beyond One Output: Visualizing and Comparing Distributions of Language Model Generations","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T04:05:37.447023Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2604.18724"},"observation_digest":"sha256:c682cfe864bc4b29206e93236f5b61ad8adc41ca122900c02dc852b6fbe14a3e","observation_id":"905e3790-6f3c-4f3f-88a2-5549622611e8","resolution":{"observed_at":"2026-05-10T04:09:57.103042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-04T05:28:01.297854Z","title":"Zhang, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.18724","last_updated":"2026-07-31T23:42:40Z","snapshot_observed_at":"2026-08-20T20:11:56.090623Z","submitted_at":"2026-04-20T18:22:31Z","title":"Beyond One Output: Visualizing and Comparing Distributions of Language Model Generations","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T05:28:01.297854Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2604.18724"},"observation_digest":"sha256:444106370c904450d0dda7ee981a6932469fd7fcdbc0543e7a43a99d82943091","observation_id":"1e0680c2-bf83-4c14-a7ad-e05373e37085","resolution":{"observed_at":"2026-08-04T05:28:01.297854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2605.00195","last_updated":"2026-05-11T12:48:16Z","snapshot_observed_at":"2026-07-31T18:51:54.041588Z","submitted_at":"2026-04-30T20:20:59Z","title":"Diversity in Large Language Models under Supervised Fine-Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-09T20:32:37.788283Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2605.00195"},"observation_digest":"sha256:fbdb955c572f8654ed7129577fa8cec568a003c8e54544d5ccb232269da4f28b","observation_id":"2b10123e-694f-49a5-9aea-e07e89e48ffd","resolution":{"observed_at":"2026-05-09T20:37:32.132735Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2605.00195","last_updated":"2026-05-11T12:48:16Z","snapshot_observed_at":"2026-07-31T18:51:54.041588Z","submitted_at":"2026-04-30T20:20:59Z","title":"Diversity in Large Language Models under Supervised Fine-Tuning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-12T03:10:22.314719Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2605.00195"},"observation_digest":"sha256:8f9d921be28ad79762fe5fd591be1b689bdbe5d22851681c7e65399bec4833eb","observation_id":"6ac08124-4c92-4e4c-bfe6-56a8e2779122","resolution":{"observed_at":"2026-05-12T03:11:18.186726Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2605.06540","last_updated":"2026-05-07T16:38:17Z","snapshot_observed_at":"2026-08-14T23:34:56.821489Z","submitted_at":"2026-05-07T16:38:17Z","title":"Ex Ante Evaluation of AI-Induced Idea Diversity Collapse","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T09:49:57.122084Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2605.06540"},"observation_digest":"sha256:deb20ea3683e0ba4dd464d2a0f57b7cf07ece898225330ebc0555941c42669f4","observation_id":"f7225068-720f-42d0-8397-4cc7d60f5805","resolution":{"observed_at":"2026-05-11T20:16:09.484270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2605.09995","last_updated":"2026-05-11T05:11:04Z","snapshot_observed_at":"2026-08-10T20:47:41.204946Z","submitted_at":"2026-05-11T05:11:04Z","title":"Annotations Mitigate Post-Training Mode Collapse","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T03:58:11.179607Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2605.09995"},"observation_digest":"sha256:ae083a8412d0dc8321106358774e2c951a8f9db37ce68c1693bbae515744f67d","observation_id":"6f5d2ecf-c661-4bff-ba64-02597be182f6","resolution":{"observed_at":"2026-05-12T06:46:51.414237Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2605.11240","last_updated":"2026-05-11T20:58:09Z","snapshot_observed_at":"2026-08-21T03:38:08.344614Z","submitted_at":"2026-05-11T20:58:09Z","title":"When to Ask a Question: Understanding Communication Strategies in Generative AI Tools","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T01:12:50.314892Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2605.11240"},"observation_digest":"sha256:4d8b676107bcdf46f2e0be61c0edd573ebba6bd7d70021669e4dada86f9f30e1","observation_id":"2704aad1-20cd-4a77-b328-56c8806bcb01","resolution":{"observed_at":"2026-05-13T01:17:02.601609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2605.13450","last_updated":"2026-05-13T12:46:05Z","snapshot_observed_at":"2026-07-06T23:25:01.951546Z","submitted_at":"2026-05-13T12:46:05Z","title":"Assessing the Creativity of Large Language Models: Testing, Limits, and New Frontiers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T19:11:07.615149Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2605.13450"},"observation_digest":"sha256:3be2441a9f040990d3aa65b665d0aeae2aaae0cccad4a98d1ee9db9e3ed626b7","observation_id":"50aef6d6-b0ae-472f-99e7-7ec3dcea4d36","resolution":{"observed_at":"2026-05-14T19:12:50.830173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2606.01811","last_updated":"2026-06-01T07:27:43Z","snapshot_observed_at":"2026-08-01T23:50:35.081089Z","submitted_at":"2026-06-01T07:27:43Z","title":"\"I've Seen How This Goes\": Characterizing Diversity via Progressive Conditional Surprise","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:06.448678Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2606.01811"},"observation_digest":"sha256:20f8998d6daf34cce7f1fb8bbe35c42dd562d5a18260b158485faf9b335c9822","observation_id":"a7a8196a-df54-4be0-a7b5-c5cf303262b8","resolution":{"observed_at":"2026-07-01T22:56:20.791428Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2606.02293","last_updated":"2026-06-01T14:16:13Z","snapshot_observed_at":"2026-07-06T23:42:44.661608Z","submitted_at":"2026-06-01T14:16:13Z","title":"AI as a Tool for Simulation-Based Experiments in Literary Studies","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-28T14:54:14.909995Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2606.02293"},"observation_digest":"sha256:fae2f122804228cf6aa4b7aa6e0d83b2e13d042c682714a35ec4b57039e5d7e3","observation_id":"02ca02fd-5f87-4ae0-bf3c-53235ec9b36f","resolution":{"observed_at":"2026-06-28T15:02:19.020822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2606.05985","last_updated":"2026-06-04T10:26:33Z","snapshot_observed_at":"2026-08-17T18:46:13.155881Z","submitted_at":"2026-06-04T10:26:33Z","title":"Beyond Alignment: Value Diversity as a Collective Property in Multicultural Agent Systems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-28T01:56:56.127785Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2606.05985"},"observation_digest":"sha256:ef8db39b5384c3c035fa4caa7fb98022f2267675a1a15dcd7f4bf91b49bbd0ff","observation_id":"01148e74-d189-469f-8dcb-32bf37b814ea","resolution":{"observed_at":"2026-06-28T02:01:28.966868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2606.10949","last_updated":"2026-06-09T14:53:32Z","snapshot_observed_at":"2026-08-02T23:45:38.545352Z","submitted_at":"2026-06-09T14:53:32Z","title":"Recalling Too Well: Sycophancy Evaluation and Mitigation in Memory-Augmented Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:17.696736Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2606.10949"},"observation_digest":"sha256:9575c9607e18d9f3cdccad5420f929a9f00cb9c8d363a93e5287fd5671bae707","observation_id":"f05f7d33-f232-4777-a65f-774d4bb87a30","resolution":{"observed_at":"2026-07-03T05:57:41.835632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2606.11456","last_updated":"2026-06-09T21:16:31Z","snapshot_observed_at":"2026-08-11T16:19:42.267579Z","submitted_at":"2026-06-09T21:16:31Z","title":"AI Coding Agents in Social Science: Methodologically Diverse, Empirically Consistent, Interpretively Vulnerable","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T13:04:40.640910Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2606.11456"},"observation_digest":"sha256:5d8082de68f64b9c93577a3c0c45568e75078104fdfa22eb26a0c876b2368d09","observation_id":"a8e0c06b-6bce-4c85-abfe-37b259b4dd44","resolution":{"observed_at":"2026-07-03T05:47:41.538163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":"2504.05228","doi":"10.48550/arxiv.2504.05228","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noveltybench: Evaluating language models for humanlike diver- sity","venue":"ArXiv.org","work_id":"aba32c56-61d8-4972-9c8b-b852f95b11b0","year":2025},"citing_paper":{"arxiv_id":"2606.26091","last_updated":"2026-06-24T17:59:02Z","snapshot_observed_at":"2026-08-10T18:32:18.583804Z","submitted_at":"2026-06-24T17:59:02Z","title":"On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-25T19:23:56.452083Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2606.26091"},"observation_digest":"sha256:d2a5d3085f5947aaf4b2ec11421792e09fc60b85873ecafeeaf239025ea4c9a1","observation_id":"b5411bf4-8fe2-41b2-9662-c41298b9e127","resolution":{"observed_at":"2026-07-04T21:00:08.478945Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-07-12T07:52:00.900202Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02668","last_updated":"2026-07-02T18:00:39Z","snapshot_observed_at":"2026-08-11T02:21:09.075566Z","submitted_at":"2026-07-02T18:00:39Z","title":"Improving LLMs via Validator-to-Generator Alignment","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-07-12T07:52:00.900202Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2607.02668"},"observation_digest":"sha256:25876f01c5f69c99fba11473ea5e09f6b0111c17866bb44421a5428f09f2ed60","observation_id":"3b594db5-f635-4e9f-9f5f-9657aff90f0f","resolution":{"observed_at":"2026-07-12T07:52:00.900202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-02T06:23:48.955749Z","title":"NoveltyBench: Evaluating language models for humanlike diversity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12796","last_updated":"2026-07-25T18:18:32Z","snapshot_observed_at":"2026-08-17T08:01:30.011945Z","submitted_at":"2026-07-14T14:12:05Z","title":"The One-Word Census: Answer-Choice Conformity Across 44 Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T06:23:48.955749Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2607.12796"},"observation_digest":"sha256:efc1a6645eace8c0190324add157da6e1929e992bf5cf5eb2c5377defbf715cd","observation_id":"936bca94-5995-49a8-9678-86debf1c3588","resolution":{"observed_at":"2026-08-02T06:23:48.955749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-01T15:23:45.409510Z","title":"Name a[n]X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18476","last_updated":"2026-07-20T19:47:16Z","snapshot_observed_at":"2026-08-12T15:06:32.786296Z","submitted_at":"2026-07-20T19:47:16Z","title":"Structured Output Collapses Answer Diversity Across 44 Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:23:45.409510Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2607.18476"},"observation_digest":"sha256:40da860fa133bac2ec57be4c86054ba51a8036ff240d3dadcebeb46ae3a55b1a","observation_id":"dc70fbbe-a51f-4f8e-8210-1de44999d0fb","resolution":{"observed_at":"2026-08-01T15:23:45.409510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05228","snapshot_observed_at":"2026-08-16T00:15:04.585634Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12253","last_updated":"2026-08-17T17:48:56Z","snapshot_observed_at":"2026-08-22T20:40:24.965573Z","submitted_at":"2026-08-12T16:55:50Z","title":"One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:04.585634Z"},"links":{"cited_paper":"/paper/2504.05228","citing_paper":"/paper/2608.12253"},"observation_digest":"sha256:f5228e25f9251c30f9e7c7839a8aeb44347a6e8687e1d3401bcba14900affa36","observation_id":"c524adc3-b61f-4a28-ad18-499a4ec70cbd","resolution":{"observed_at":"2026-08-16T00:15:04.585634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.05228/citation-record","integrity":"/paper/2504.05228/integrity","json":"/paper/2504.05228/citation-record.json","paper":"/paper/2504.05228"},"outbound":[],"paper":{"arxiv_id":"2504.05228","last_updated":"2025-08-09T18:33:13Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T12:43:18.364897Z","submitted_at":"2025-04-07T16:14:23Z","title":"NoveltyBench: Evaluating Language Models for Humanlike Diversity"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2504.05228."}