{"as_of":"2026-08-14T13:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a4ea0dd04a6c20e5f53d89d2c00c167207b22139949632bd742c5c60154f909","coverage":[{"denominator":166,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:19:39.174139Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06609/citation-record","integrity":"/paper/2608.06609/integrity","json":"/paper/2608.06609/citation-record.json","paper":"/paper/2608.06609"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.749951Z","title":"International Journal of Research in Marketing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.749951Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:1866eeacc2b4d098fdc74a42eff85356544a924ea39c5f226f4112c359425f66","observation_id":"6b5ed6e5-0d31-48d3-b45b-f36311b11a1b","resolution":{"observed_at":"2026-08-11T04:19:38.749951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.754509Z","title":"Proceedings of the 2024 AAAI Conference on Artificial Intelligence , series =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.754509Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ae1e043fea1937ef5cd6afa46ec96a5ac7134ec6d75ac5097140933677646ea1","observation_id":"dddab206-5c4c-428a-b542-bcb00f99bd7f","resolution":{"observed_at":"2026-08-11T04:19:38.754509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.759581Z","title":"Educational Measurement: Issues and Practice , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.759581Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:c6c01326b22c38da704a03d0e628fa42ac3ca72c937967580ac1bea6c4f3eda2","observation_id":"9dd5a534-1cc4-42c4-ba74-1e1e2bb05ff3","resolution":{"observed_at":"2026-08-11T04:19:38.759581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.763974Z","title":"and Pashley, Peter J","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.763974Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:3cea8dd20060469013383172435b1c26f7d0624683b55702689e4db3491da9eb","observation_id":"9ecaa5a8-966f-4cc8-a861-e5875aefc209","resolution":{"observed_at":"2026-08-11T04:19:38.763974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.769290Z","title":"2020 , doi =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.769290Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8a0b2c6131a9a7169f8d452cefaa8cfa8cc1eb711d38dba8a439e73889bdee9e","observation_id":"f622ee43-87f2-449b-b1cc-be00c408949b","resolution":{"observed_at":"2026-08-11T04:19:38.769290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24827","last_updated":"2026-07-05T14:51:01Z","snapshot_observed_at":"2026-08-09T18:00:15.187880Z","submitted_at":"2026-04-27T15:46:23Z","title":"Incompressible Knowledge Probes: Estimating Black-Box LLM Parameter Counts via Factual Capacity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24827","snapshot_observed_at":"2026-08-11T04:19:38.773298Z","title":"Incompressible Knowledge Probes: Estimating Black-Box","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.773298Z"},"links":{"cited_paper":"/paper/2604.24827","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ab7b218fda626a38ae82ad9a1b6f9e833ab7edb46ef2d853fd95a78eaa207f2c","observation_id":"5ed95530-3dc2-4c08-8fb3-fe4048076d6b","resolution":{"observed_at":"2026-08-11T04:19:38.773298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.778456Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.778456Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ea1e844ad0f1dd9bfbe805a3f5f9ddac45a7c582a7ee6d0adda03fe0fcc02a7b","observation_id":"ba8c7748-e01a-4a2a-a35e-49ef2df14793","resolution":{"observed_at":"2026-08-11T04:19:38.778456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.782619Z","title":"Journal of Educational Data Mining , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.782619Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5801d5630aa57c6dc52704da438ab7ec0e393fff3f1b35c64349e9f23a88f5a5","observation_id":"beecc8a3-24f9-4e1b-bce5-0df5a8b6b0f7","resolution":{"observed_at":"2026-08-11T04:19:38.782619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.787728Z","title":"The Routledge International Handbook of Automated Essay Evaluation , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.787728Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:145518131eba00e9815e53099ce1cec9ddbd344c283cec99278399183b0960a3","observation_id":"a5257445-6ae4-47c7-b346-ce84dbbeac9b","resolution":{"observed_at":"2026-08-11T04:19:38.787728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.791893Z","title":"Using generated rubrics to provide a window into item evaluation with multi-agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.791893Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7088bea3ed5a544fd0ea16653ab9f2dd6b64069e7938c849cb371122cf7f8503","observation_id":"5754e72e-78d7-4fe0-96dc-7ed6c74aabb0","resolution":{"observed_at":"2026-08-11T04:19:38.791893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.796503Z","title":"Automatic Item Generation, Evaluation, and Scale Construction of Non-Cognitive Measures with Generative Language Models , booktitle =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.796503Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5b9b6f7685a4f54d039cf4509494b0b17f942c5b1f32874951016bf75e5e39ab","observation_id":"96bcd9e4-f473-49cf-9892-fe6c6897914e","resolution":{"observed_at":"2026-08-11T04:19:38.796503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.802049Z","title":"Electronics , VOLUME =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.802049Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ccd057d622fa9d96aa034f00265fd3006958aec0f278a2893226db9b6d811617","observation_id":"7261c23f-c8a8-4260-ac2a-a92d74c10b28","resolution":{"observed_at":"2026-08-11T04:19:38.802049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.806747Z","title":"and Monday, Onoja Abah , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.806747Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:01cb0809430af170c6a7ddf12d68ada4b9fdf20318f51ac94a2691fc152ee42c","observation_id":"3adc9a7f-e26b-4ecc-ad67-f834dd97702d","resolution":{"observed_at":"2026-08-11T04:19:38.806747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.812028Z","title":"International Journal of Assessment Tools in Education , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.812028Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b109badca0f7f5338986c22db7f981a4e8b195a7de955b81711e687d5c33523a","observation_id":"3b48be7c-4a76-42c7-854c-5a82b5376244","resolution":{"observed_at":"2026-08-11T04:19:38.812028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.816368Z","title":"Advances in Health Sciences Education , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.816368Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7f20da274d424781c390504366e62bfc28c2b11dff06ac992d494eb6cca491ef","observation_id":"de53271d-95b6-4ac0-a72e-d60b1d3d2b41","resolution":{"observed_at":"2026-08-11T04:19:38.816368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-11T04:19:38.825107Z","title":"arXiv preprint arXiv:2410.21276 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.825107Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:2db023313ae4363d03f34cbb827faa55b00288990a39e2aa8ef70758db98eadb","observation_id":"5fb7e133-1ddd-46e9-8858-61665abf1dbd","resolution":{"observed_at":"2026-08-11T04:19:38.825107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.830012Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.830012Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a7b9ab0fb737d7e150bcc5a1cff9a01308b11de7ee48a94fcff00f4706a4889e","observation_id":"641d4f90-b869-4dac-b86a-54975fe58684","resolution":{"observed_at":"2026-08-11T04:19:38.830012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.834058Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.834058Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:016ca1594ed853b3eb5f7f43eaf67d9708c2b7fe6722e78400d73a4b4043a2d4","observation_id":"1d3f1685-91af-44c7-a12e-9093e163f35e","resolution":{"observed_at":"2026-08-11T04:19:38.834058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00214","last_updated":"2025-06-30T19:34:57Z","snapshot_observed_at":"2026-08-06T21:19:06.340648Z","submitted_at":"2025-06-30T19:34:57Z","title":"Two-Stage Reasoning-Infused Learning: Improving Classification with LLM-Generated Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00214","snapshot_observed_at":"2026-08-11T04:19:38.838228Z","title":"Two-Stage Reasoning-Infused Learning: Improving Classification with","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.838228Z"},"links":{"cited_paper":"/paper/2507.00214","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:96afcf3f6077b68deaef95ce9dc7f42b69ad1c0e8d0a6bdd83d7d2a984a857f6","observation_id":"875fdb2c-3ae5-4bed-9f40-11169a2a50a6","resolution":{"observed_at":"2026-08-11T04:19:38.838228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08551","last_updated":"2025-03-11T15:39:43Z","snapshot_observed_at":"2026-08-07T17:12:36.923428Z","submitted_at":"2025-03-11T15:39:43Z","title":"Reasoning and Sampling-Augmented MCQ Difficulty Prediction via LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08551","snapshot_observed_at":"2026-08-11T04:19:38.843433Z","title":"Reasoning and Sampling-Augmented MCQ Difficulty Prediction via","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.843433Z"},"links":{"cited_paper":"/paper/2503.08551","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:65c928117d2a99b5b3d4ec81588ace04ad224c6f4a1f57f82bb6567750405179","observation_id":"c815bad0-4c4a-45bc-b613-872a3e36c03e","resolution":{"observed_at":"2026-08-11T04:19:38.843433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.848588Z","title":"2025 , howpublished =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.848588Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7a00094ba04eb2fe97bded1c28c7f35c358141561edc16e3c001b5a15ce01986","observation_id":"ffad893c-2c32-4995-b123-1ed79ca89c2d","resolution":{"observed_at":"2026-08-11T04:19:38.848588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.852439Z","title":"2026 , journal=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.852439Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e29fb6b72b04bbe7c31af1c49e383c12231b2a23e4280d9ce8ab449f3122cc23","observation_id":"7e08c8e7-4fe5-406e-9790-5e42d8beb1ef","resolution":{"observed_at":"2026-08-11T04:19:38.852439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.856089Z","title":"2024 , journal=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.856089Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b0325eb3acfcc957dd54fd2ac034e940cdb3e4368e4b622923ee67d8cab928d3","observation_id":"49c16337-2f01-4b7f-a730-c78a9e886405","resolution":{"observed_at":"2026-08-11T04:19:38.856089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.860240Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.860240Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:f8a7bbbd7ab8c930868b220a774dad42be3e2c7ef30f4249507e030f7d60bad8","observation_id":"17cdfeb7-ca34-476b-a730-d7e9b6828d54","resolution":{"observed_at":"2026-08-11T04:19:38.860240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.864657Z","title":"arXiv preprint arXiv:2605.18562 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.864657Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d87745237034203a180c81522c36435756be4ce94ff34f8745f92c6399a98037","observation_id":"56c64218-bea6-41d1-8a72-1614d3b1857c","resolution":{"observed_at":"2026-08-11T04:19:38.864657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.870075Z","title":"Review of educational research , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.870075Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a01292340fe8bc31e2955d28a5b492854dc7a618743fed32842310e6f9f7f9b1","observation_id":"af621101-321e-4703-8429-7191ee5e9c69","resolution":{"observed_at":"2026-08-11T04:19:38.870075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.873873Z","title":"educational measurement: issues and practice , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.873873Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:48dbab89d2af3d36123279f3e9e832803b72fa30af2e229338b92a2554aef3e7","observation_id":"a8092a8f-a951-4fe4-8b8c-d289fb43d9e0","resolution":{"observed_at":"2026-08-11T04:19:38.873873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.878570Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.878570Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:597633c6602d9adb7ae92f298970929592361d2315e4367ddb15b208a1b04d75","observation_id":"1a756c2c-635c-4781-aeb7-98a64cdd39e8","resolution":{"observed_at":"2026-08-11T04:19:38.878570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.882359Z","title":"Humanities and Social Sciences Communications , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.882359Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:3ca2c797cd08c9b6969ffddc78f0d2adf2a5c9715fc316ef4515d2cdfdec0b4c","observation_id":"26add0a5-57a4-4486-a916-01c0d2a4aee4","resolution":{"observed_at":"2026-08-11T04:19:38.882359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.886354Z","title":"Journal of Development and Social Sciences , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.886354Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:6631330e019e5fd8aa47adec6c946047e85093f649a7c407db4708ed2ddcbe92","observation_id":"4305762d-2852-4542-9562-1660e6e22e14","resolution":{"observed_at":"2026-08-11T04:19:38.886354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.890431Z","title":"Haladyna and Steven M","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.890431Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8382a25d3f7cfd078cba6d72af8916ddd37d0722455494a465c938bbf3ffb34e","observation_id":"9a83cb45-ee0c-4487-8842-f6409a7e762a","resolution":{"observed_at":"2026-08-11T04:19:38.890431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.895463Z","title":"Haladyna and Steven M","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.895463Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:cb5ce06cb4d799a93fc83a80d38fe1d59cecef71dba2530246f49304ad490865","observation_id":"86bb0fbe-9af3-4cbc-a96f-db2255b362d1","resolution":{"observed_at":"2026-08-11T04:19:38.895463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.900149Z","title":"Educational and Psychological Measurement , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.900149Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:3a501eac056698c34488ed29a2873ff993390c01e85874d350fd3c439970dcea","observation_id":"ceb9beab-f6eb-4ad1-b0f8-4ea0dc13b23c","resolution":{"observed_at":"2026-08-11T04:19:38.900149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.904158Z","title":"2026 , journal=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.904158Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:485f4256bae5a3fee93ebf7331227a89cb23594ef115d8a15ffd21f7b126b416","observation_id":"b65b2512-7d4b-47c3-85a5-db529511cdec","resolution":{"observed_at":"2026-08-11T04:19:38.904158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.907807Z","title":"Predicting Item Survival for Multiple Choice Questions in a High-Stakes Medical Exam","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.907807Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:344713b02d419f90ad01d37d08489b331964a8ce2b45df1452bd36a84cd17a2c","observation_id":"16da5d58-64bb-4bd6-9316-6b7d5bed8e3e","resolution":{"observed_at":"2026-08-11T04:19:38.907807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.913034Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.913034Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5439fdd7308b6121fbafe4bbe91724787c8c0a2fd6e0812f9577913e5f401099","observation_id":"dc6ed12f-91b7-45a2-8a9f-7dd69a8225c7","resolution":{"observed_at":"2026-08-11T04:19:38.913034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.916374Z","title":"Advances in Health Sciences Education , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.916374Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5dd795b941011b2117cd25aa0d55b48da726e5b82c967b509a83ab596b327bf0","observation_id":"dd3b5caf-8dd7-485f-aa65-f686533f3e2b","resolution":{"observed_at":"2026-08-11T04:19:38.916374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06465","last_updated":"2025-04-08T22:08:37Z","snapshot_observed_at":"2026-08-07T16:07:22.339147Z","submitted_at":"2025-04-08T22:08:37Z","title":"Analyzing Examinee Comments using DistilBERT and Machine Learning to Ensure Quality Control in Exam Content","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06465","snapshot_observed_at":"2026-08-11T04:19:38.920287Z","title":"arXiv preprint arXiv:2504.06465 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.920287Z"},"links":{"cited_paper":"/paper/2504.06465","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d9b771d2cd6401836f20343a71f51c88d572a234bbf13bf84bd213695ccc8a13","observation_id":"a9065c01-fbc5-486a-b1c9-6284e55a4a66","resolution":{"observed_at":"2026-08-11T04:19:38.920287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.924696Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.924696Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:adbe00950a7b0ce5e093aac2bb8a815d09dccd660f816e69d5e7e085dcf8a5dc","observation_id":"84ee0f05-1f59-40e8-83f8-18398681144a","resolution":{"observed_at":"2026-08-11T04:19:38.924696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.928745Z","title":"Journal of Educational Measurement , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.928745Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:57a29db0eace051879094d8b2577c664e4d64cd09196ac8316ab24c495fffcfc","observation_id":"9c2de93f-a166-45b3-a66c-a6faa06564c5","resolution":{"observed_at":"2026-08-11T04:19:38.928745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.932252Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.932252Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:88dcc081b087f2f564b728083cdabb15e51766de2076ae87ec2d5f712e6fd50c","observation_id":"7c75ce1c-5e1c-4afb-9b37-3ab0f7e95fd8","resolution":{"observed_at":"2026-08-11T04:19:38.932252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.936364Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.936364Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:fe45751c25262756c76a7f545906cf271d780f3cd63abb88d685a35258bec001","observation_id":"2bd50534-14a8-4264-8a4a-67156cd2d9b0","resolution":{"observed_at":"2026-08-11T04:19:38.936364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.940693Z","title":"Information Fusion , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.940693Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:c82080227181313751212b4c5e5da3f86ff67261c086d2f92ab011b9f291ca57","observation_id":"bf7f83ee-e02b-4fbf-ac9f-4d14c41bcbf2","resolution":{"observed_at":"2026-08-11T04:19:38.940693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.944688Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.944688Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:f887468b79da212a932a406c10b90c44f913c688a4ab9f97d1b3e982ce2e7e3c","observation_id":"b34b90ce-2ed7-4f37-9176-03376f82a885","resolution":{"observed_at":"2026-08-11T04:19:38.944688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.948888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.948888Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:58ae4d5898668dbd4288359296e745079898e846529fc4a17844c3f41dc1bec9","observation_id":"7fae69ab-205c-4eec-8f03-2945f6b29cae","resolution":{"observed_at":"2026-08-11T04:19:38.948888Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.952638Z","title":"Research and practice in technology enhanced learning , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.952638Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:54c9db0abd6d4b72c519effe5ab3d5ed66fc5768aa74f0735491b1b8b2f169ea","observation_id":"22679d4a-ab77-433d-a900-a47e96607e34","resolution":{"observed_at":"2026-08-11T04:19:38.952638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.956957Z","title":"International conference on artificial intelligence in education , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.956957Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:558081dd9742956d5f7bbd296241a5dded1defb68d35d8aff5620a09cf378fd6","observation_id":"eb7848c6-a0a0-4901-a391-0f7bf9a3bb27","resolution":{"observed_at":"2026-08-11T04:19:38.956957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.961213Z","title":"Proceedings of the 10th EAI International Conference on Mobile Multimedia Communications , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.961213Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:1800f80e62771c4d598820127af6ef6ab7611ff757fec8fa6c5c07ca1f4e6964","observation_id":"9b71122c-f9ae-4752-bc88-ce83a66b27b3","resolution":{"observed_at":"2026-08-11T04:19:38.961213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.965926Z","title":"2026 , booktitle=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.965926Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:fb3ef5998831426ce857b33c477ffe873196d055ae17a8ffd99377a7e99139b3","observation_id":"315d5eb4-2309-4931-93ab-8d6baf7ac254","resolution":{"observed_at":"2026-08-11T04:19:38.965926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.970410Z","title":"Statistical theories of mental test scores , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.970410Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:16cf80064662cb0443d69d3a80a1a563e2af455f629f3644ccf2c9642d8a83d6","observation_id":"7c8bf557-34da-44da-b877-36b98d843f73","resolution":{"observed_at":"2026-08-11T04:19:38.970410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.974201Z","title":"ETS Research Report Series , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.974201Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7ea5588d6208cc7352111af0354eb4b1fdbea909e270d29f7ae556a037bcb3e1","observation_id":"b64521ff-7047-4bde-8725-386cf8c71853","resolution":{"observed_at":"2026-08-11T04:19:38.974201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.978866Z","title":"IEEE transactions on pattern analysis and machine intelligence , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.978866Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:f5832a0df3de98348830da449aa9f393701203344a73a94cb8db0fbdbdee5aa2","observation_id":"853909eb-0972-42ea-b94b-6e6c003eb8b9","resolution":{"observed_at":"2026-08-11T04:19:38.978866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.982962Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.982962Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:c0fb85ea9ae335a2a9f87d377f24a9ecefce073ed9c64fbfba2a0356d24d4906","observation_id":"bb40426a-1652-4223-9dd7-aa9866361d3a","resolution":{"observed_at":"2026-08-11T04:19:38.982962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.987407Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.987407Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b232ef3ca90a680e82edcb436cb9bb9a5593def3fad030c8d08ed0202ffb9ec2","observation_id":"060acf48-86fb-4608-a906-b27e0de8386f","resolution":{"observed_at":"2026-08-11T04:19:38.987407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.991186Z","title":"Ninth international conference on document analysis and recognition (ICDAR 2007) , volume=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.991186Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:cd6f8b8e57d541b2e44d26bae1086f7aadd03e863dc2f9e59d25c250601db7b3","observation_id":"826961c8-44e7-44ec-9c0c-83a7e436d9c7","resolution":{"observed_at":"2026-08-11T04:19:38.991186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:38.995801Z","title":"The Cambridge handbook of multimedia learning , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:38.995801Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:70c701f3acc1d6748b540ba5a53a1acfbfb15d78ebd0a6d77bd7f74db3aced18","observation_id":"768ab6a0-6d51-45fa-aa02-c3cb5fbf2756","resolution":{"observed_at":"2026-08-11T04:19:38.995801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.000039Z","title":"Psychology of learning and motivation , volume=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.000039Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:809f5bc115661d3ecbb0b3b0d73fb859a797bee6838a6621ad5852f49595ca87","observation_id":"11f54341-d84e-4683-8d4d-ad469bc33708","resolution":{"observed_at":"2026-08-11T04:19:39.000039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.003944Z","title":"1990 , publisher=","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.003944Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:c0f5cc0f90bde3bef391d57dc846c0d0e4490e305bf9c100992f91d6648832d0","observation_id":"b7ab85e8-b29b-4881-b006-e068e79b48fe","resolution":{"observed_at":"2026-08-11T04:19:39.003944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.007787Z","title":"Proceedings of the tenth international conference on learning analytics & knowledge , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.007787Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:442feab57e539cb9ead51c5d5a3f812ff58d784235a7e2f736bc658eabd439cc","observation_id":"3a91cfde-fed6-4ae4-8517-2e175ec709cc","resolution":{"observed_at":"2026-08-11T04:19:39.007787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T04:19:39.011493Z","title":"arXiv preprint arXiv:2304.07193 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.011493Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a705f101d09bfca6a61e2c6107679a22db9678b0ccaae7bc6df0f68464619e96","observation_id":"bad9abba-4a23-4d78-9acd-e95fada05eb1","resolution":{"observed_at":"2026-08-11T04:19:39.011493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.015967Z","title":"Artificial Intelligence Review , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.015967Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:bd20018f28c448a6b9d9470bf9d5138b71997edd377455cf7902cdfef57d933b","observation_id":"df6c83c4-f04f-49d3-bcd1-02f9de5d4760","resolution":{"observed_at":"2026-08-11T04:19:39.015967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.019686Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.019686Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d8affc5382421bcac47698b5a6c6b12eda1464b0871ee98b5eb628169fecad52","observation_id":"f416b5b4-c1a8-4f99-8bf8-a2602ac6d934","resolution":{"observed_at":"2026-08-11T04:19:39.019686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.022959Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.022959Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d6df0fd7befa6376623896a5014ca3f09e37525c1add129dd6ede7af5e6c2ce3","observation_id":"42862a09-49ab-4351-af6d-096ca1be5312","resolution":{"observed_at":"2026-08-11T04:19:39.022959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.026583Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.026583Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:94dac6da8e320aaf11c894e749438ee890052478339abf533c9e77e70342a581","observation_id":"51faf0cf-eb27-4793-b503-4d23603788e0","resolution":{"observed_at":"2026-08-11T04:19:39.026583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.029925Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.029925Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:37900348e2d7499a109fc3af281483c4621fad827ac59ee6d24de94e1eadbdff","observation_id":"2c459cb9-4e8b-45c0-9602-ba6e1287f9e8","resolution":{"observed_at":"2026-08-11T04:19:39.029925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T04:19:39.033641Z","title":"arXiv preprint arXiv:1907.11692 , year=","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.033641Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5b87deb5af8bbf2636ed27bed1b233e725376e85a450ae209050db8f19c68909","observation_id":"e428d737-4470-4a88-90c4-6d3a385eb8ef","resolution":{"observed_at":"2026-08-11T04:19:39.033641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.038082Z","title":"Computers & Education , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.038082Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:022dd2575ae3c3128f1ae95185d1fd88ba9dc302943328896bd5462eaa406de6","observation_id":"12a8fa78-e733-4830-bbe3-ff41df1fd137","resolution":{"observed_at":"2026-08-11T04:19:39.038082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.042483Z","title":"Information Processing & Management , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.042483Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8042a3acc5ede7918bd208a665ed18ab356794212c2ac5411dc0a8101a153466","observation_id":"66a18b16-9124-4ab4-8c70-730b20997312","resolution":{"observed_at":"2026-08-11T04:19:39.042483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.046649Z","title":"Educational and Psychological Measurement , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.046649Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:890ef0ebee35466003ee87f529b3f4edcf03520c92e633bd74544a59b49c36de","observation_id":"16ad543b-8652-48b6-af9b-04d80fa1054e","resolution":{"observed_at":"2026-08-11T04:19:39.046649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.050786Z","title":"CBE—Life Sciences Education , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.050786Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:1cf356c36b67362655f928a3d814e57f51b15c715b222a7a861c84fa431035bf","observation_id":"b234e9ab-9eea-4eec-a464-f96865d33a75","resolution":{"observed_at":"2026-08-11T04:19:39.050786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.054360Z","title":"Journal of Microbiology and Biology Education , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.054360Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:fd6e828bacf28ea9c44bba530d7a2919614e23b26c4bc25e03de3bb5ca1d1893","observation_id":"277d610b-4a43-4619-9051-66d6f576d8ac","resolution":{"observed_at":"2026-08-11T04:19:39.054360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.058261Z","title":"The Curriculum Journal , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.058261Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5917d4a8e44d95b303738ef37ed9be35e91166d2d315f9b91756b00d97b5c396","observation_id":"2bf61af9-40b7-4ec1-aa29-cffd4bffe463","resolution":{"observed_at":"2026-08-11T04:19:39.058261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.062299Z","title":"Mathematics , VOLUME =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.062299Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b1766c3dd98168d5d269a9de95aab2055d065dac763bd2c8966d5b6a2fa3803a","observation_id":"85d9d306-d8de-4bb1-9bcd-bcd0d762e07c","resolution":{"observed_at":"2026-08-11T04:19:39.062299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.067135Z","title":"arXiv preprint arXiv:2509.23486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.067135Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:f5d841229a740eaad242566913c92efb3bdd9b4ffce3fc9a1fc6a9f9531f0e8f","observation_id":"17eb200c-53a9-41ce-8bf3-b458928a797c","resolution":{"observed_at":"2026-08-11T04:19:39.067135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.071102Z","title":"Information Sciences , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.071102Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ae96840b48e019c4ce9a6c0adef89c51ed37272512b1e9d66fcb7f6bd94c05ac","observation_id":"c9617d36-c2e2-4093-91e5-32428c579590","resolution":{"observed_at":"2026-08-11T04:19:39.071102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15698","last_updated":"2023-09-27T14:40:12Z","snapshot_observed_at":"2026-08-14T00:02:12.911882Z","submitted_at":"2023-09-27T14:40:12Z","title":"Deep Model Fusion: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15698","snapshot_observed_at":"2026-08-11T04:19:39.075390Z","title":"arXiv preprint arXiv:2309.15698 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.075390Z"},"links":{"cited_paper":"/paper/2309.15698","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b1d3c053895544053b2b1e1108c32d2f1df432ac6a06c69350204b98a2e2942b","observation_id":"36f3df5e-887a-4a47-aa24-840ff1c73dd6","resolution":{"observed_at":"2026-08-11T04:19:39.075390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.080182Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.080182Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:42c93fed5df93cacfdbf846783701dfbc8cdfa953b62540cb1b0248a93923203","observation_id":"50b8794c-a1fb-410f-bb5e-62a4c8495565","resolution":{"observed_at":"2026-08-11T04:19:39.080182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-08-13T10:44:26.934833Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-11T04:19:39.084107Z","title":"arXiv preprint arXiv:2508.10104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.084107Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:726f39e77a35946b74165970ec9d3b1275a2bb1d321132f3b015991c2b07e14c","observation_id":"4d2565a3-a366-4539-9ceb-783725099a1c","resolution":{"observed_at":"2026-08-11T04:19:39.084107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.088256Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.088256Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:6e07c60f1c54e75c68122db0b94616c04e6a462d1389395b3f146091542fd641","observation_id":"6875982c-0a46-4bd4-a986-3ceca20ab0c2","resolution":{"observed_at":"2026-08-11T04:19:39.088256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.092008Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.092008Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5fbffb81ef36e20ee7b34ca4d5d872ddd82182bf75a04655a2e0a4653ed70559","observation_id":"93af9091-02d7-4745-9385-630d16b1f055","resolution":{"observed_at":"2026-08-11T04:19:39.092008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.095976Z","title":"International Journal of Artificial Intelligence in Education , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.095976Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:557258904cb4fefe4d64e15fee5b5f057be042f747451737ea0121f54db39740","observation_id":"410eefa1-f9cb-42eb-8218-4b72aa79acc9","resolution":{"observed_at":"2026-08-11T04:19:39.095976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.099731Z","title":"Proceedings of the Artificial Intelligence in Measurement and Education Conference (AIME-Con): Full Papers , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.099731Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a2f411bb88bbe2b92c6da6d8e92ab9a85ba827bb03895a0e77c6916c4056d027","observation_id":"0fc79807-02f6-41b1-9b81-e0ac422949a1","resolution":{"observed_at":"2026-08-11T04:19:39.099731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.103302Z","title":"Discover Computing , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.103302Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b5c0340f1128c90feac44704de0d29c2b50d7c4e2df67ba24cb2bdaa104dc4bc","observation_id":"fa23754c-60cf-4dd5-90ed-e64003d050d7","resolution":{"observed_at":"2026-08-11T04:19:39.103302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.106866Z","title":"Science Progress , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.106866Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:271ba48e69bd8c5b4270a54cbae0abbb645a5fcc725ae26431012f7b9701a01d","observation_id":"71938367-62ce-43b7-aeff-25fd445141a3","resolution":{"observed_at":"2026-08-11T04:19:39.106866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.110493Z","title":"2015 , issn =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.110493Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:767dd0ed18f34ba32999f6c7fcd69d04682adbfd9c9995415be32ceba443b00f","observation_id":"fd5f8891-f1c6-4a89-a047-cbd60e796f19","resolution":{"observed_at":"2026-08-11T04:19:39.110493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.114742Z","title":"ETS Research Report Series , volume =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.114742Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ec4f1ac5a070f9747e422042cf26cfb89a999f7b106f6dfb3aee0ead68af180f","observation_id":"7733c219-9eba-4d48-9474-d675a1a68768","resolution":{"observed_at":"2026-08-11T04:19:39.114742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.119847Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.119847Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9ff4446e7de85df7bfd8eeb100e2a8731b5dc4c9f6258dbe9b9a006b9cb8df64","observation_id":"957052f6-8618-4341-b2ab-c2627720dfe9","resolution":{"observed_at":"2026-08-11T04:19:39.119847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.124458Z","title":"International Journal of Artificial Intelligence in Education , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.124458Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:67312b51bd3974afd6fe0430720f93d70658df0b49d7cb60e36a8415d06b28c6","observation_id":"784efa2a-a236-420e-a519-0166c09b8041","resolution":{"observed_at":"2026-08-11T04:19:39.124458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.127947Z","title":"Educational and Psychological Measurement , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.127947Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8466ddcf664571ffbaf41af54311978145fc891b2d4076f0b199b12e23d2f37b","observation_id":"127ec939-9c44-4cff-80d2-c7ce4a09e33f","resolution":{"observed_at":"2026-08-11T04:19:39.127947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.132252Z","title":"2020 , journal=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.132252Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7559ceccebbbcc2e806f982030e73ecb028714f7e45884b763dae6d85355760b","observation_id":"a4147e3e-9a52-4cf1-b77e-4bfa7e49d6d0","resolution":{"observed_at":"2026-08-11T04:19:39.132252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.136295Z","title":"Gierl and Hollis Lai and Simon R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.136295Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:11bbdf6d0b9d1c7aeb7bb451312d16af8872a62404f327fbd3f0d4a60681ddcc","observation_id":"2ac566f3-f1a9-4449-b23d-e11f548443ac","resolution":{"observed_at":"2026-08-11T04:19:39.136295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.140245Z","title":"Psychological Test and Assessment Modeling , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.140245Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:2ae48600e3c1095f0bf4e8c7b12634bad5f8b252cd450ac09747a74ebdfe6a79","observation_id":"330ac0bd-3daa-4731-b2a5-3d09844a5fcc","resolution":{"observed_at":"2026-08-11T04:19:39.140245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.144100Z","title":"2024 , journal=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.144100Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b8ccceb49cb6f919386e651038414386b52b539b85c0a21acb7b61dfaea7d5c4","observation_id":"626382d4-c760-4458-acd8-3e7f6ed89cc7","resolution":{"observed_at":"2026-08-11T04:19:39.144100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.148804Z","title":"Advancing natural language processing in educational assessment , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.148804Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:14a807fa43e9a9d60b2d8a0857851f0f3c05887373480bcc38f6e5ee050bc8bf","observation_id":"7b929980-dac1-4623-964f-8f22c654c31a","resolution":{"observed_at":"2026-08-11T04:19:39.148804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.152501Z","title":"and Yaneva, Victoria and Lottridge, Susan and von Davier, Matthias and Harris, Deborah J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.152501Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e81e3bfd54034654c2fd500fd3a8ee800bdca22d0b5c59f74328e4c06cfc837c","observation_id":"5ed9605e-6c43-49c0-9b9c-c596a640df9b","resolution":{"observed_at":"2026-08-11T04:19:39.152501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.156138Z","title":"Applied Psychological Measurement , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.156138Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8d9e05129df340d30aaa6a20f369e5a5a9fd3d1049275c3a27ab63b7ef3dd667","observation_id":"cff2200a-7e14-4db6-86e1-44463538051b","resolution":{"observed_at":"2026-08-11T04:19:39.156138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.160675Z","title":"Frontiers in Education , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.160675Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:104525ba3e987309678b27a2208950bc70b9c2e74fff33c21fb215c3083742c7","observation_id":"ccfed704-eeb2-4a37-8fa8-bef2e599cb0b","resolution":{"observed_at":"2026-08-11T04:19:39.160675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.164729Z","title":"British Journal of Psychology , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.164729Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b0ef235cedc6b8cb4153cf94ce4f32a9f7e2a00d7560d3bb624d19fe58602ad1","observation_id":"4d3d626e-1118-448f-86b7-897a0059c668","resolution":{"observed_at":"2026-08-11T04:19:39.164729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.169157Z","title":"Spearman , doi =","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.169157Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a9e5c4723de1349596ab7280ad5808b3d44db5d79c9ea9fb746b26dfabbb8be7","observation_id":"5d05af6d-e2a4-4ff4-a7c8-edee2213673a","resolution":{"observed_at":"2026-08-11T04:19:39.169157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:19:39.174139Z","title":"2021 , journal=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":2},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-11T04:19:39.174139Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:08da0dc24613080a44cf52dc001b787c1a441468e9873c5509a129cac1d02659","observation_id":"6c85f141-3a66-4155-abc6-2fdbe2bdc1e0","resolution":{"observed_at":"2026-08-11T04:19:39.174139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-10T10:47:12Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T23:40:51.501529Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":99,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":166},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 166 outbound references and 0 inbound Pith citation observations for arXiv:2608.06609."}