{"as_of":"2026-08-23T03:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:883c51edef505bd582cfb7c8aac6bd1a48785455e3f10a841f9df3f5462f4b45","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:37:35.044086Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:55:22.643993Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-09T21:53:35.156634Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.18948","last_updated":"2025-04-16T20:24:22Z","snapshot_observed_at":"2026-08-18T20:45:29.630230Z","submitted_at":"2025-01-31T08:13:39Z","title":"AI, Jobs, and the Automation Trap: Where Is HCI?","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T21:53:35.156634Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2501.18948"},"observation_digest":"sha256:09062c4b01ceb94230394ebb631f473f1dc76e3a64c5e71842a99266d0fedc47","observation_id":"217ffa83-ae6a-410d-9b76-3623634a1317","resolution":{"observed_at":"2026-08-09T21:53:35.156634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-09T14:03:44.621750Z","title":"Feder Cooper, Angelina Wang, Chad Atalla, Solon Barocas, Su Lin Blodgett, Alexandra Chouldechova, Emily Corvi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.01926","last_updated":"2025-08-11T14:37:48Z","snapshot_observed_at":"2026-08-18T18:30:51.635072Z","submitted_at":"2025-02-04T01:56:28Z","title":"Fairness through Difference Awareness: Measuring Desired Group Discrimination in LLMs","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-09T14:03:44.621750Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2502.01926"},"observation_digest":"sha256:7269a52573889339277ad75601feee966a3a1159ca7742d4594f2e1616c7ca9f","observation_id":"340fdeae-2f50-444b-a453-d2f97bd837fc","resolution":{"observed_at":"2026-08-09T14:03:44.621750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-07T14:26:35.180337Z","title":"Feder Cooper, Angelina Wang, Chad Atalla, Solon Baro- cas, Su Lin Blodgett, Alexandra Chouldechova, Emily Corvi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18893","last_updated":"2025-05-30T14:09:51Z","snapshot_observed_at":"2026-08-21T18:52:52.747065Z","submitted_at":"2025-05-24T22:35:32Z","title":"Reality Check: A New Evaluation Ecosystem Is Necessary to Understand AI's Real World Effects","version":4},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T14:26:35.180337Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2505.18893"},"observation_digest":"sha256:2fe051374c74825cf3035949bff40c157c504c29582364717954b097018c38d6","observation_id":"3a680a5c-61f8-4fb4-bc0a-890748ccd3c8","resolution":{"observed_at":"2026-08-07T14:26:35.180337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-07T10:45:03.085054Z","title":"Feder Cooper, Angelina Wang, Chad Atalla, Solon Barocas, Su Lin Blodgett, Alexandra Chouldechova, Emily Corvi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04482","last_updated":"2025-06-04T22:01:31Z","snapshot_observed_at":"2026-08-17T03:06:47.524414Z","submitted_at":"2025-06-04T22:01:31Z","title":"Understanding and Meeting Practitioner Needs When Measuring Representational Harms Caused by LLM-Based Systems","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T10:45:03.085054Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2506.04482"},"observation_digest":"sha256:03944bfe4c0335029bbb4bc6e765b3b05d8725acab6f9196ead7433467d82b1f","observation_id":"8757af9d-2f7e-40ff-80ce-9462a93d6221","resolution":{"observed_at":"2026-08-07T10:45:03.085054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-06T21:56:03.057445Z","title":"Feder Cooper, Angelina Wang, Chad Atalla, Solon Barocas, Su Lin Blodgett, Alexandra Chouldechova, Emily Corvi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22968","last_updated":"2025-07-01T10:45:21Z","snapshot_observed_at":"2026-08-17T22:57:15.406880Z","submitted_at":"2025-06-28T17:59:17Z","title":"Against 'softmaxing' culture","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T21:56:03.057445Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2506.22968"},"observation_digest":"sha256:01b854b71c348e7fb13ab5e18ac7efc5e2106a100787e3bf41aa92c18d689bc7","observation_id":"cab93fa3-9b77-49b4-947e-f7162d8d95a8","resolution":{"observed_at":"2026-08-06T21:56:03.057445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-06T19:47:49.516194Z","title":"F.; Wang, A.; Atalla, C.; Barocas, S.; Blodgett, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04641","last_updated":"2025-07-07T03:49:58Z","snapshot_observed_at":"2026-08-15T03:03:43.349501Z","submitted_at":"2025-07-07T03:49:58Z","title":"Toward Valid Measurement Of (Un)fairness For Generative AI: A Proposal For Systematization Through The Lens Of Fair Equality of Chances","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T19:47:49.516194Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2507.04641"},"observation_digest":"sha256:858d2442a110fd85c78304b0292a6c71c9f9b4de9e411307476ecdcf753ac2a7","observation_id":"2c97c0cc-c696-4c0b-b594-a0669ea2943a","resolution":{"observed_at":"2026-08-06T19:47:49.516194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2509.14528","last_updated":"2026-05-03T23:02:14Z","snapshot_observed_at":"2026-08-15T04:45:03.106412Z","submitted_at":"2025-09-18T01:51:29Z","title":"Why Johnny Can't Use Agents: Industry Aspirations vs. User Realities with AI Agents","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-18T16:55:47.922639Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2509.14528"},"observation_digest":"sha256:a89817685f485b17d120cbf383620ac99604fd5ebdcdd43e07fa6e9bb3cdba37","observation_id":"c69343e9-7ea8-4ff1-ba37-df93a101e6d9","resolution":{"observed_at":"2026-05-18T16:56:38.062223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2602.00065","last_updated":"2026-04-28T08:46:23Z","snapshot_observed_at":"2026-08-06T10:24:27.916413Z","submitted_at":"2026-01-20T12:55:10Z","title":"Responsible Evaluation of AI for Mental Health","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T12:50:33.070425Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2602.00065"},"observation_digest":"sha256:1399099f8473e341ba3c504bad02c8751922ff86eead163be5e05ffaad3c0851","observation_id":"3a33c585-df94-4a14-a6c2-f96c21ae8e7d","resolution":{"observed_at":"2026-05-16T12:50:54.931535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2603.06811","last_updated":"2026-05-08T14:52:11Z","snapshot_observed_at":"2026-08-18T12:43:27.943121Z","submitted_at":"2026-03-06T19:17:50Z","title":"Making AI Evaluation Deployment Relevant Through Context Specification","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T14:46:09.944168Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2603.06811"},"observation_digest":"sha256:f5b0623425a3e5912d5af0539795e8d022c1c5a0e012b11af8b17a8a5e1a5518","observation_id":"729587ef-4445-41e6-a3ae-e208359ae64a","resolution":{"observed_at":"2026-05-15T14:50:05.159501Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-07-13T21:26:43.149095Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20510","last_updated":"2026-06-23T04:29:10Z","snapshot_observed_at":"2026-08-14T07:48:27.768509Z","submitted_at":"2026-03-20T21:24:28Z","title":"Grounded Chess Reasoning in Language Models via Master Distillation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T21:26:43.149095Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2603.20510"},"observation_digest":"sha256:cf4f194e76c3884c8023985bfc009495c725318c761211e2df2379e8d243bb4c","observation_id":"70749d48-bbd7-4928-bf76-ad85e797bbcd","resolution":{"observed_at":"2026-07-13T21:26:43.149095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2604.03238","last_updated":"2026-05-29T23:39:37Z","snapshot_observed_at":"2026-08-18T01:23:34.171780Z","submitted_at":"2026-01-31T21:51:17Z","title":"RLHF May Not Reflect Genuine Preferences","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T08:39:08.880486Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2604.03238"},"observation_digest":"sha256:c99630aab6f49b633d23bd2fa503eb3f250ace1e2f03da2346feb308a05197e4","observation_id":"0191584d-4385-4212-ae50-19f6e3560e0f","resolution":{"observed_at":"2026-05-16T08:40:46.318423Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2604.07591","last_updated":"2026-04-08T20:49:03Z","snapshot_observed_at":"2026-08-12T19:34:10.919589Z","submitted_at":"2026-04-08T20:49:03Z","title":"From Ground Truth to Measurement: A Statistical Framework for Human Labeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T17:09:43.892161Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2604.07591"},"observation_digest":"sha256:48923722a20e027ac58c62fbd7c6385c79897dd152c34fb06658b4cf8e043f5b","observation_id":"e1116046-03f9-40e2-9144-9a0d98caa63a","resolution":{"observed_at":"2026-05-11T07:30:58.092181Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2604.14266","last_updated":"2026-04-15T17:21:56Z","snapshot_observed_at":"2026-08-17T11:10:39.353550Z","submitted_at":"2026-04-15T17:21:56Z","title":"\"I Just Don't Want My Work Being Fed Into The AI Blender\": Queer Artists on Refusing and Resisting Generative AI","version":1},"reference_index":138,"source":"pdf_text","source_observed_at":"2026-05-10T12:21:20.533180Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2604.14266"},"observation_digest":"sha256:e5546dee9fe101ef8be420c6b96adadc6f56876073710b92ed3657f7330d6c4c","observation_id":"88589ab5-5cf6-4cf8-a6b4-3a499773718a","resolution":{"observed_at":"2026-05-10T12:25:22.668278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2605.07986","last_updated":"2026-05-08T16:44:55Z","snapshot_observed_at":"2026-08-15T01:53:59.811523Z","submitted_at":"2026-05-08T16:44:55Z","title":"Towards Apples to Apples for AI Evaluations: From Real-World Use Cases to Evaluation Scenarios","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T02:54:52.984994Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2605.07986"},"observation_digest":"sha256:5d09921fa2fe2a0cd41562b2cdce724b22e64e7ff4d60b8d2d252ec6257debe5","observation_id":"fd24ef72-532d-402a-bfae-f5c653595ac9","resolution":{"observed_at":"2026-05-11T02:55:53.066086Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2606.02293","last_updated":"2026-06-01T14:16:13Z","snapshot_observed_at":"2026-07-06T23:42:44.661608Z","submitted_at":"2026-06-01T14:16:13Z","title":"AI as a Tool for Simulation-Based Experiments in Literary Studies","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-28T14:54:14.909995Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2606.02293"},"observation_digest":"sha256:d0dcbfac1d2e21a39448e2c9d85474419b0f952e47c660aed33f4bea7fc367ce","observation_id":"a1357ba7-1d60-473f-bc96-e9f837330683","resolution":{"observed_at":"2026-06-28T15:02:18.979706Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2606.11018","last_updated":"2026-07-29T19:31:42Z","snapshot_observed_at":"2026-08-18T12:46:29.246829Z","submitted_at":"2026-06-09T15:55:55Z","title":"Measuring Human Value Expression in Social Media Texts: Calibrated LLM Annotation and Encoder Transfer","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T13:13:19.690367Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2606.11018"},"observation_digest":"sha256:efaa62b2effbab4f4dfac017d12bea5dd2a057cb82fba57198bae66d98478a4f","observation_id":"9562a4fc-d8f1-4cda-ba93-c52ece092f06","resolution":{"observed_at":"2026-07-03T05:27:40.352337Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":"2502.00561","doi":"10.48550/arxiv.2502.00561","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ACM Transactions on Computer-Human Interaction, 27(5)","venue":"ArXiv.org","work_id":"1079b5c0-2a24-4af7-982f-03e9cd0441fe","year":2025},"citing_paper":{"arxiv_id":"2606.17799","last_updated":"2026-07-18T22:14:13Z","snapshot_observed_at":"2026-08-02T11:05:59.500924Z","submitted_at":"2026-06-16T11:21:01Z","title":"Position: Coding Benchmarks Are Misaligned with Agentic Software Engineering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T23:48:58.497927Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2606.17799"},"observation_digest":"sha256:c01e2b150f8b6e6977355977838877842ded690664fe6ed36a4c6a8787fd3d36","observation_id":"7948401f-e3a0-43b7-9be0-a9cd98d0453b","resolution":{"observed_at":"2026-07-03T22:08:58.949519Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-02T11:06:03.560871Z","title":"Feder Cooper, Angelina Wang, Chad Atalla, Solon Barocas, Su Lin Blodgett, Alexandra Chouldechova, Emily Corvi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17799","last_updated":"2026-07-18T22:14:13Z","snapshot_observed_at":"2026-08-02T11:05:59.500924Z","submitted_at":"2026-06-16T11:21:01Z","title":"Position: Coding Benchmarks Are Misaligned with Agentic Software Engineering","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T11:06:03.560871Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2606.17799"},"observation_digest":"sha256:e981210a6895b9fb6b92d85fad34b2bf8d0cb6be1d3cd8f33c159805fbe51f22","observation_id":"2f29de4b-0b44-496a-8c61-ed0646ca3c24","resolution":{"observed_at":"2026-08-02T11:06:03.560871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-02T07:44:03.248723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09306","last_updated":"2026-07-30T11:40:45Z","snapshot_observed_at":"2026-08-14T10:58:50.041021Z","submitted_at":"2026-07-10T11:39:40Z","title":"Exposure is not manifestation: measurement target and output resolution jointly determine which behavioural-faithfulness evaluator wins","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T07:44:03.248723Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2607.09306"},"observation_digest":"sha256:a4bc0cb2942d472f7d5b15d311eb7c507aed2dd5f896aaeb4fda2b0f4ac1b2e3","observation_id":"13e8e9b3-298f-419d-a664-93ccfc27f6f8","resolution":{"observed_at":"2026-08-02T07:44:03.248723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-07-31T01:29:53.636089Z","title":"Feder Cooper, Angelina Wang, Chad Atalla, Solon Barocas, Su Lin Blodgett, Alexandra Chouldechova, Emily Corvi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25097","last_updated":"2026-07-27T21:54:19Z","snapshot_observed_at":"2026-08-18T20:45:31.209379Z","submitted_at":"2026-07-27T21:54:19Z","title":"On the Convergent Validity of Offline Evaluation Designs for Recommender Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T01:29:53.636089Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2607.25097"},"observation_digest":"sha256:a440075507c9a18d04fdf7e30a668cb82e350a0ef36686adf53cae91b0d58eab","observation_id":"077493da-6a1e-4c2a-a038-729646409e34","resolution":{"observed_at":"2026-07-31T01:29:53.636089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-04T06:17:17.719091Z","title":"Health and Quality of Life Outcomes, 5(63)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.02491","last_updated":"2026-08-05T04:54:08Z","snapshot_observed_at":"2026-08-14T06:48:04.847609Z","submitted_at":"2026-08-03T16:55:50Z","title":"Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions","version":1},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-04T06:17:17.719091Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2608.02491"},"observation_digest":"sha256:b9cf2171e568702460f87be4d1a1a3b18ad9276462837fc667ab7d0bd783bc23","observation_id":"eab46b33-0a67-4492-931c-1842b1c368b1","resolution":{"observed_at":"2026-08-04T06:17:17.719091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-07T00:11:20.211326Z","title":"Health and Quality of Life Outcomes, 5(63)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.02491","last_updated":"2026-08-05T04:54:08Z","snapshot_observed_at":"2026-08-14T06:48:04.847609Z","submitted_at":"2026-08-03T16:55:50Z","title":"Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions","version":2},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-07T00:11:20.211326Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2608.02491"},"observation_digest":"sha256:44fe4f20afef333662b79a32d86aab5bff01b2d64962388cc373152bc22311bb","observation_id":"432b5be4-cf3e-45a9-a420-d93609dc875e","resolution":{"observed_at":"2026-08-07T00:11:20.211326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-08T01:01:58.715300Z","title":"arXiv preprint arXiv:2502.00561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03044","last_updated":"2026-08-04T02:51:38Z","snapshot_observed_at":"2026-08-18T20:45:30.173543Z","submitted_at":"2026-08-04T02:51:38Z","title":"Emulate or Estimate? The Divergent Strengths of Base and Post-Trained Language Models for Opinion Simulation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T01:01:58.715300Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2608.03044"},"observation_digest":"sha256:b2270d5fe7331dcbeefd3ef5ac016e04ae0ffa992e36f5a32ea3e1f25d3fc0c0","observation_id":"5b18ed79-9a45-4921-9b95-d578a6f61c52","resolution":{"observed_at":"2026-08-08T01:01:58.715300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-07T12:44:35.707630Z","title":"arXiv preprint arXiv:2502.00561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06202","last_updated":"2026-08-06T15:58:32Z","snapshot_observed_at":"2026-08-15T15:04:39.740009Z","submitted_at":"2026-08-06T15:58:32Z","title":"What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implications (for Safety Evaluations)","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:35.707630Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2608.06202"},"observation_digest":"sha256:08ef71601887b505b922604c644cb10a3344c82496d0cb239a060c7b270407de","observation_id":"90fdb2a7-d6a1-4bdf-a364-b147057f1c14","resolution":{"observed_at":"2026-08-07T12:44:35.707630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00561","snapshot_observed_at":"2026-08-14T10:55:22.643993Z","title":"arXiv preprint arXiv:2502.00561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13444","last_updated":"2026-08-13T16:30:47Z","snapshot_observed_at":"2026-08-17T17:38:40.161912Z","submitted_at":"2026-08-13T16:30:47Z","title":"Algorithmic Gender Prediction Is Illegitimate, But Gender Imputation Can Yield Valid Measurements","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-14T10:55:22.643993Z"},"links":{"cited_paper":"/paper/2502.00561","citing_paper":"/paper/2608.13444"},"observation_digest":"sha256:b59aac8ab7fb5aa028c943ae338b1e879a8a058e7cc617af53be4c6124baae63","observation_id":"679ee3a9-e744-4422-9a33-857f86bfc0f3","resolution":{"observed_at":"2026-08-14T10:55:22.643993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00561/citation-record","integrity":"/paper/2502.00561/integrity","json":"/paper/2502.00561/citation-record.json","paper":"/paper/2502.00561"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.334756Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.334756Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:afddfacf8f4f6683057b35de166aa9ea59e515b3a4123a2a509cf1711204773a","observation_id":"af360f01-f194-42f0-a655-21296375d600","resolution":{"observed_at":"2026-08-09T18:37:34.334756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.310455Z","title":null,"venue":null,"work_id":"c45ac82c-523f-4bb9-9d8e-7a43bd37169a","year":2020},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.366575Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:984d0b699cf10850214b684ea9f86404ec88d5ea8a7f3490102d58e19bcd0dce","observation_id":"c3a72428-0c5a-45db-9d35-367cb535f16f","resolution":{"observed_at":"2026-08-09T18:37:36.313238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.302702Z","title":"and Collier, D","venue":null,"work_id":"90b64105-d9a6-4f13-8bc2-b381c1080194","year":2001},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.376133Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:3244eb88f6be4cb639e158249c13e8bdc2c9f41baa0a8ce84c20ddac18d78b48","observation_id":"0c520125-24c9-4a83-b453-0c65b3e0cf3b","resolution":{"observed_at":"2026-08-09T18:37:36.305529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.294526Z","title":"M., Blaauw, G","venue":null,"work_id":"9a0081ab-9853-4bb3-92b7-a69a72322800","year":1964},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.392459Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:8d72d461be21245cae16ebdfd38402f85317c14c1a172fff6eb352db37bd47b2","observation_id":"c61fc32b-79d0-4d41-9eba-95e3b2bce4f5","resolution":{"observed_at":"2026-08-09T18:37:36.297384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.286630Z","title":"Content Analysis in Communication Research","venue":null,"work_id":"d3075fea-b476-49a0-a1be-44dc1e9faef8","year":1952},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.414744Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:e19fac28a582a8da0fb7c7031d9a7ba52e7f7fc94c5626000482fe68da43792d","observation_id":"39527063-c915-45a4-8539-6c0a09fc0642","resolution":{"observed_at":"2026-08-09T18:37:36.289599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.092557Z","title":"and Hancox-Li, L","venue":null,"work_id":"f9134c3b-2344-43d5-84a6-5f8487ccd644","year":2023},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.464749Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:577b7e462533c7f178efa60696a2f2e0bc599faded376fa3c2ab10837032d304","observation_id":"ce85ba0e-1412-42af-9494-c3869d47e314","resolution":{"observed_at":"2026-08-09T18:37:36.095316Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.493955Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.493955Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:72642af04a92efd4be64a3b0968bee1d267356b5510a35aaafec44b720019170","observation_id":"84ee5103-17e9-4a37-a368-65f16d3d0b4f","resolution":{"observed_at":"2026-08-09T18:37:34.493955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.554747Z","title":"L., Barocas, S., Daum \\'e III, H., and Wallach, H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.554747Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:9680c00ae87712e3edc5024c826a87b141ef1ccde4e2e033f1a05847810b8289","observation_id":"961ef34c-c694-4c8d-9628-df68d30a99b9","resolution":{"observed_at":"2026-08-09T18:37:34.554747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.278124Z","title":"L., Lopez, G., Olteanu, A., Sim, R., and Wallach, H","venue":null,"work_id":"a3998d5a-fcbd-4994-a060-989da289b078","year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.588034Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:473d11f34645bc6e0b19151a004d2a190491c3fdcb18c2f05fefcb45ab2e2499","observation_id":"826776d4-29a0-4e1e-90e3-8894b7e9db1e","resolution":{"observed_at":"2026-08-09T18:37:36.280942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.270470Z","title":"Quantifying Memorization Across Neural Language Models","venue":null,"work_id":"f94b6b36-2d01-40f3-a5c3-2561971dd66b","year":2023},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.624753Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:3c35386c63899ba2f6287df0c320e00facc363a76fdf2f91fb4aebc29b1fe3e4","observation_id":"b02377aa-91dc-49f3-abb1-f9f2bfeea3a1","resolution":{"observed_at":"2026-08-09T18:37:36.273013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01934","last_updated":"2024-12-02T19:50:00Z","snapshot_observed_at":"2026-08-18T20:43:08.623950Z","submitted_at":"2024-12-02T19:50:00Z","title":"A Shared Standard for Valid Measurement of Generative AI Systems' Capabilities, Risks, and Impacts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01934","snapshot_observed_at":"2026-08-09T18:37:34.652479Z","title":"F., Corvi, E., Dow, P., Garcia-Gathright, J., Pangakis, N., Reed, S., Sheng, E., Vann, D., Vogel, M., Washington, H., and Wallach, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.652479Z"},"links":{"cited_paper":"/paper/2412.01934","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:db48c985a71ea3f7c041ef9e3e0d8b7350d93be56112b1db55f8b02874f6c843","observation_id":"6337746e-a493-41dc-894d-2499a7b1b4f3","resolution":{"observed_at":"2026-08-09T18:37:34.652479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T18:37:34.671148Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.671148Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:4678471b43c841b7060f6790e5f1c33c3e54f6d2439453fcc9efc810d45323a1","observation_id":"ba1dd32b-79b3-45eb-a9e2-76fd3688f3ca","resolution":{"observed_at":"2026-08-09T18:37:34.671148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12590","last_updated":"2025-09-01T10:08:37Z","snapshot_observed_at":"2026-08-21T10:34:40.194065Z","submitted_at":"2024-04-19T02:37:09Z","title":"The Files are in the Computer: On Copyright, Memorization, and Generative AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12590","snapshot_observed_at":"2026-08-09T18:37:34.714751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.714751Z"},"links":{"cited_paper":"/paper/2404.12590","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:db0294a05a45f18b1ca4cf53c463a8e2230725f0ee29a03aeb522476fb63722c","observation_id":"99c724f1-2cae-449c-b891-88601cc55c1c","resolution":{"observed_at":"2026-08-09T18:37:34.714751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:35.907530Z","title":"F., Abrams, E., and NA, N","venue":null,"work_id":"786cd102-9d08-4d3f-b59a-626b9a466a69","year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.741941Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:8b20af088e97e5f042bd72b970a5fc7f5c6fdd8179c9e111603b68702437dffa","observation_id":"38e4f769-2792-4351-bd31-64e837d6975f","resolution":{"observed_at":"2026-08-09T18:37:35.910047Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06477","last_updated":"2023-12-03T03:09:16Z","snapshot_observed_at":"2026-08-16T14:44:12.147413Z","submitted_at":"2023-11-11T04:13:37Z","title":"Report of the 1st Workshop on Generative AI and Law","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06477","snapshot_observed_at":"2026-08-09T18:37:34.744625Z","title":"F., Lee, K., Grimmelmann, J., Ippolito, D., Callison-Burch, C., Choquette-Choo, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.744625Z"},"links":{"cited_paper":"/paper/2311.06477","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:1ec70c23c4e7db3b8979b645de566c8a4fba994976a3b816ac80521ec8031b2f","observation_id":"3f3a0b43-c517-40a4-bcfc-43eb0bd17c61","resolution":{"observed_at":"2026-08-09T18:37:34.744625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.764744Z","title":"F., Choquette-Choo, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.764744Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:166973b4f043f9c29943c49b31e3355f54d3e4340b8ae5b0ef9d297fdd3b21e8","observation_id":"658e6011-7732-4d6a-acc7-e889b657d432","resolution":{"observed_at":"2026-08-09T18:37:34.764744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.263094Z","title":"Representational Harms through the Lens of Speech Act Theory , 2024","venue":null,"work_id":"dcf9b684-f1f8-4d0f-88a2-965d5ca2e46d","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.795120Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:244963e173dde1bd7491c08c9f6793e982265b344e2c4104caf733b7a06e1059","observation_id":"2de9b6f7-da44-4db5-83b0-9ed3461d381b","resolution":{"observed_at":"2026-08-09T18:37:36.265664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.813953Z","title":null,"venue":null,"work_id":null,"year":1955},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.813953Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:3773d3528088b85d9f6d66e6da1270012a72bb9d6b92f76cbc7dd8cb21a2d001","observation_id":"575ef757-7849-446b-8724-3d0ff34abbef","resolution":{"observed_at":"2026-08-09T18:37:34.813953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.255607Z","title":null,"venue":null,"work_id":"d63c3c6f-d8f1-4c30-9ef9-e1c9fffc8ddb","year":2013},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.834743Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:1fd8cebee58b26452555b89324552d5c9e191c9ce508d92fefa3c78341fad63d","observation_id":"404b3271-5f3e-4a39-a6c8-9ae5f194edb7","resolution":{"observed_at":"2026-08-09T18:37:36.258551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04872","last_updated":"2025-12-23T02:23:47Z","snapshot_observed_at":"2026-08-13T13:45:44.430193Z","submitted_at":"2024-11-07T17:07:35Z","title":"FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04872","snapshot_observed_at":"2026-08-09T18:37:34.857548Z","title":"F., Denain, J.-S., Ho, A., Santos, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.857548Z"},"links":{"cited_paper":"/paper/2411.04872","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:479f9df72c13b7f94833348a706df3fe6968c7b7d17366fe40b653cca2ab409b","observation_id":"02db8153-78d2-4c3d-a026-77c3dbe5cb33","resolution":{"observed_at":"2026-08-09T18:37:34.857548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.248620Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":null,"work_id":"74d63a84-b6d3-47a2-a3d9-e5dc24fe43a9","year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.904753Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:9c2466ea915f53b2212ccccacb3f0e0ad2ede2df987436e940d94bcd1ac6ad67","observation_id":"dd7a6bd3-4f26-4e26-9241-cc0068f82a2f","resolution":{"observed_at":"2026-08-09T18:37:36.251091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.240182Z","title":"Evaluation gaps in machine learning practice","venue":null,"work_id":"2c189f28-dc71-4da8-b710-7c0f7063611d","year":2022},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.916078Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:42f53f6ffc6630fbcfab715ae49efb15120ce86dbef8db8afa88697a8bb45d4e","observation_id":"e10e8f16-f5ad-4c24-ac75-6ffade724942","resolution":{"observed_at":"2026-08-09T18:37:36.243144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.232196Z","title":null,"venue":null,"work_id":"7d50cdd9-c325-4d77-b0b8-fca2133b04dd","year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.919196Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:7a0abd7d8db3da57e328f141406be3db6f812325670f94343f134015c12df1e0","observation_id":"18deee14-b6ec-4f9e-bb1f-69152923759e","resolution":{"observed_at":"2026-08-09T18:37:36.235017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.224588Z","title":"and Kieran, C","venue":null,"work_id":"e325be7c-721f-4775-aed4-73893ca25012","year":2017},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.922662Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:9c091bdd8668eaba92efdc227f734d7fa97aed42e0058188516869a9e42a722b","observation_id":"ed758256-a1eb-451a-ac4f-6e6e0cab1395","resolution":{"observed_at":"2026-08-09T18:37:36.227355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.216822Z","title":null,"venue":null,"work_id":"7beaa994-ed62-447b-bc13-5181df00ff37","year":2025},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.934758Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:1ade94507f5f11dacfa757d4749789d8e96707dff51e1a2ce08b12cdb12d039d","observation_id":"24f98484-80c8-4eea-871a-b0108718f39a","resolution":{"observed_at":"2026-08-09T18:37:36.219671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.209026Z","title":"Algorithm = Logic + Control","venue":null,"work_id":"e1e9b451-ac20-43c0-b990-61e8bd1d8d78","year":1979},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.938084Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:e5b7ccf1ebe739ccee97b34c61acb0f7fac8ffb09168696560c9d151020d9d64","observation_id":"21ac5ce4-37d8-4860-a76a-22adfac29cd3","resolution":{"observed_at":"2026-08-09T18:37:36.211802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08133","last_updated":"2024-03-01T20:28:59Z","snapshot_observed_at":"2026-08-20T20:51:15.790869Z","submitted_at":"2023-09-15T04:02:48Z","title":"Talkin' 'Bout AI Generation: Copyright and the Generative-AI Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08133","snapshot_observed_at":"2026-08-09T18:37:34.941234Z","title":"F., and Grimmelmann, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.941234Z"},"links":{"cited_paper":"/paper/2309.08133","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:5548c829db9ace16a87bef5d58e276e2fbc78618ec8f0b3dc3e0118192ba919a","observation_id":"c0610033-aafd-407e-91e4-d5e702fcea9a","resolution":{"observed_at":"2026-08-09T18:37:34.941234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.201123Z","title":"IQA-EVAL: Automatic Evaluation of Human-Model Interactive Question Answering","venue":null,"work_id":"089a2e95-52a4-4084-8acd-d02314ea0729","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.944139Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:162e97ff37fc4a83ee683fd0b17a7a3974f5fa658ac50e9cacc53abb8142db14","observation_id":"7dbb41d7-a389-4598-a98c-075fd6eec3c5","resolution":{"observed_at":"2026-08-09T18:37:36.204138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.193257Z","title":"L., Blodgett, S","venue":null,"work_id":"65d26b20-e4eb-4ddd-8b7d-85ba64dd941f","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.955891Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:a4c9ef5e63dbbd7b2151ad9ca598b151a6d0837bd3bb1eafb3c93371651741ad","observation_id":"03b7621a-3feb-4b76-b4f6-415f0c21f577","resolution":{"observed_at":"2026-08-09T18:37:36.196239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.185394Z","title":"C., Shoham, Y., Wald, R., and Clark, J","venue":null,"work_id":"f263250b-ea5f-4ae4-bf6a-135e27cf2503","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.958473Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:945e5dd74972aa3065277a571a0d5a0eb0f5e6dd6076049cd7826c1ff7a65437","observation_id":"244fdae9-00bb-40ad-b6dc-2520ae733768","resolution":{"observed_at":"2026-08-09T18:37:36.188290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:35.558450Z","title":"Validity","venue":null,"work_id":"888d9e10-1f56-46ca-9286-5d87c21c1dd0","year":1987},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.960900Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:9dc315972852b911bf00affce322aea497358b5dbc8e08147061c97f3983ea8d","observation_id":"ffd0c4f9-3f0f-473f-b074-081f813becc6","resolution":{"observed_at":"2026-08-09T18:37:35.561608Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.177185Z","title":"Validity and washback in language testing","venue":null,"work_id":"a74968fd-62f3-4af0-b90e-8e9abb669fc3","year":1996},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.966776Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:9dbb3c154640306d14a6294cec6a4c94665563dacb89d57bcf90a9f14910f9b6","observation_id":"721c0e54-0bf0-480a-a5aa-31a32d060307","resolution":{"observed_at":"2026-08-09T18:37:36.180240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.169117Z","title":"K., Koopman, C., and Doty, N","venue":null,"work_id":"f896604c-3a49-48a3-8e7e-b6b6806ffcc8","year":2016},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.969708Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:f5755053ae417fa391aa2c8ebb440b6ba0ce2e4a403cb184fe477523b6a3e88b","observation_id":"0bc8f29e-77e0-4a01-8b5f-43967daa8284","resolution":{"observed_at":"2026-08-09T18:37:36.171951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.161822Z","title":"K., Kroll, J","venue":null,"work_id":"1637fbf2-a54d-4be0-bf9e-5764664d07f7","year":2019},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.972247Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:66d72e04ce9b0f998c231ada7f614fe37f5ab4aec3a41de654c4572c0c68d5f9","observation_id":"344c7471-839e-4ea2-8c4f-1c15538d3559","resolution":{"observed_at":"2026-08-09T18:37:36.164417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.974821Z","title":"S tereo S et: Measuring stereotypical bias in pretrained language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.974821Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:da744020084e23e59fdf4656d93b5d87aa3523309f83261d9af661b574f46d05","observation_id":"83e9b15e-a9a3-47a9-ab88-503bfa2821e0","resolution":{"observed_at":"2026-08-09T18:37:34.974821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.979147Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.979147Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:5df280fb2d34ce237c37131273a6b9a7c6736b21410d69456bb5b89999a45732","observation_id":"10219736-ab27-4493-9b88-dfea96510fa0","resolution":{"observed_at":"2026-08-09T18:37:34.979147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-09T18:37:34.981842Z","title":"F., Ippolito, D., Choquette-Choo, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.981842Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:5cf725499504334ebdf7b56bd393d0873461c215bfa96ae264ecafefc6030b15","observation_id":"148f9c7c-d07f-469d-a0b8-d5a20ca2c6dd","resolution":{"observed_at":"2026-08-09T18:37:34.981842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.985743Z","title":"Artificial intelligence Risk Management Framework: Generative Artificial Intelligence Profile , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.985743Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:ea6e6243f90b4382a3410d0ec298522eafda15b7449d36ebc94003afc5de7da3","observation_id":"7310aeb2-4b35-4655-9145-f52c6d08b9ba","resolution":{"observed_at":"2026-08-09T18:37:34.985743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.153742Z","title":"Learning to Reason with LLM s , 2024","venue":null,"work_id":"c2f6c060-2f79-4cab-9585-945a5034dc9a","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.989173Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:c4bb4e7e9190f4eed5f073eadef235c485abd2cdbea50a5150b7df3532a98e06","observation_id":"225cc190-4abc-4f3f-ab94-291330f67773","resolution":{"observed_at":"2026-08-09T18:37:36.156633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:34.992794Z","title":"Red Teaming Language Models with Language Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.992794Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:dc1b13c3e2a09357c5b113cc1b0cf94ca2c6af5144e4515ef57c1819452918dc","observation_id":"c886a326-5968-44f6-ba75-5e2112710404","resolution":{"observed_at":"2026-08-09T18:37:34.992794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.145265Z","title":null,"venue":null,"work_id":"7dc0b269-1f6e-401b-a6e1-60c5836d2e3d","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:34.998973Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:97c7b28dc9c1c557d67b1a7b8fe1ad50d2a95d2fbd8b6be18b18f345975aa3d1","observation_id":"a17f79a7-4018-43c4-84ee-18b6a3e75a8f","resolution":{"observed_at":"2026-08-09T18:37:36.148281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17746","last_updated":"2025-05-07T18:36:12Z","snapshot_observed_at":"2026-08-21T15:53:08.156514Z","submitted_at":"2024-06-25T17:32:16Z","title":"Recite, Reconstruct, Recollect: Memorization in LMs as a Multifaceted Phenomenon","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17746","snapshot_observed_at":"2026-08-09T18:37:35.001891Z","title":"S., Deng, A., O'Brien, K., au2, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.001891Z"},"links":{"cited_paper":"/paper/2406.17746","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:e2f94c9c31be73583973abe188536079405f15d5b6ce7cb16d630aa9332fe25a","observation_id":"903acbaa-441f-4a98-984a-0248a8204015","resolution":{"observed_at":"2026-08-09T18:37:35.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.136781Z","title":"D., Bender, E","venue":null,"work_id":"1db99569-6098-445e-a368-6bf94d74658a","year":2021},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.014742Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:e9cc831ba43d6f1548bf8f00e47136cf07df0e35f164ee98dacc162f73099f1e","observation_id":"0434809c-7011-4eef-8db9-fb274e6d6e80","resolution":{"observed_at":"2026-08-09T18:37:36.139712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.128228Z","title":"A., Comanescu, R., Akbulut, C., Stepleton, T., Mateos-Garcia, J., Bergman, S., Kay, J., Griffin, C., Bariach, B., Gabriel, I., Rieser, V., Isaac, W., and Weidinger, L","venue":null,"work_id":"7187183b-2b12-455e-90ff-518ba78e3a93","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.017831Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:21ead202870c1140cb6fbed77e5f30ca49c2b5a45df8e500a2ba453cf9848574","observation_id":"72d475a8-8b21-47d9-8acf-91b8957dc12e","resolution":{"observed_at":"2026-08-09T18:37:36.131519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:35.020661Z","title":"L., Gardner, M., and Singh, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.020661Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:9f8dc329dac044f13c4022f36be7f528c26337de0d1e3af0936ddd38f2fc2f0a","observation_id":"cf79d6bf-9d3d-46c6-b054-33008fe256b9","resolution":{"observed_at":"2026-08-09T18:37:35.020661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.119581Z","title":null,"venue":null,"work_id":"48392d19-ee05-4ddd-b705-9613429f52d8","year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.024293Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:a2e9ed4d91cabd300cef0d4feb0517838907759f49dc2bc36c73f6bc27018ecc","observation_id":"89f36e89-4f16-4c1d-99e6-413403b33433","resolution":{"observed_at":"2026-08-09T18:37:36.122583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:35.387901Z","title":"H., Reed, D","venue":null,"work_id":"30091bac-3626-4988-987f-6fd5601aeade","year":1984},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.027380Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:ae4a3f7c9672445353ce5290eb9c3dfa5820eb75dee5f35c0cb8cf651708dda8","observation_id":"7ae7e0de-d88a-4109-8241-eddd2975649b","resolution":{"observed_at":"2026-08-09T18:37:35.391628Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16379","last_updated":"2023-12-29T05:42:07Z","snapshot_observed_at":"2026-08-17T22:11:37.761830Z","submitted_at":"2023-10-25T05:38:38Z","title":"Evaluating General-Purpose AI with Psychometrics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16379","snapshot_observed_at":"2026-08-09T18:37:35.029933Z","title":"Evaluating general-purpose AI with psychometrics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.029933Z"},"links":{"cited_paper":"/paper/2310.16379","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:39bb9b0cb70230aa8175d45405aef985818d3c5a5c29c6d511e0025216e3b0d8","observation_id":"98797b12-7942-4d4c-bfed-81d607f38ec6","resolution":{"observed_at":"2026-08-09T18:37:35.029933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11986","last_updated":"2023-10-31T18:23:32Z","snapshot_observed_at":"2026-08-16T14:51:02.975570Z","submitted_at":"2023-10-18T14:13:58Z","title":"Sociotechnical Safety Evaluation of Generative AI Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11986","snapshot_observed_at":"2026-08-09T18:37:35.032673Z","title":"A., Mateos-Garcia, J., Bergman, S., Kay, J., Griffin, C., Bariach, B., Gabriel, I., Rieser, V., and Isaac, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.032673Z"},"links":{"cited_paper":"/paper/2310.11986","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:1cc842b314ab358e143144c9a5f926c65c2d206bf2846ad050bc95650961a2af","observation_id":"ff236a4b-d7c0-4b55-93af-de8f18809acf","resolution":{"observed_at":"2026-08-09T18:37:35.032673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.110809Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","venue":null,"work_id":"d2197470-3506-42f7-b2e7-a1f781a2d215","year":2025},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.038652Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:e8bd0e3d717eda12e2eb7aa01be0f989771ba4ea059367eee6e1c12b53c1292d","observation_id":"4c7fdeb2-04d4-4476-8641-764a7d9fc553","resolution":{"observed_at":"2026-08-09T18:37:36.114024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:37:36.100611Z","title":"The nature and origins of mass opinion","venue":null,"work_id":"dd4c4dad-bc96-45f0-9466-f4a83cc6ae80","year":1992},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.041282Z"},"links":{"citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:d70040d401609c8dcea4312f2b7b17e03ce39fff74d5d1d77fae7c2f226b8e6c","observation_id":"b04728b6-67b8-49c0-b678-3d8a12626f31","resolution":{"observed_at":"2026-08-09T18:37:36.104441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16427","last_updated":"2025-08-30T18:01:52Z","snapshot_observed_at":"2026-08-18T22:03:20.617880Z","submitted_at":"2024-09-24T19:47:21Z","title":"HAICOSYSTEM: An Ecosystem for Sandboxing Safety Risks in Human-AI Interactions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16427","snapshot_observed_at":"2026-08-09T18:37:35.044086Z","title":"Y., Choi, Y., Mireshghallah, N., Le Bras, R., and Sap, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T18:37:35.044086Z"},"links":{"cited_paper":"/paper/2409.16427","citing_paper":"/paper/2502.00561"},"observation_digest":"sha256:393aeabab7cec4c7f0023dae21ee2997238518cb37cafa0d3d4ec0d447c096ae","observation_id":"4ac29549-4631-46cc-9990-bbdd755c6763","resolution":{"observed_at":"2026-08-09T18:37:35.044086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00561","last_updated":"2025-06-06T22:15:14Z","latest_version":2,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-19T22:52:59.112058Z","submitted_at":"2025-02-01T21:09:51Z","title":"Position: Evaluating Generative AI Systems Is a Social Science Measurement Challenge"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":4,"verified_fuzzy":21},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 25 inbound Pith citation observations for arXiv:2502.00561."}