{"as_of":"2026-08-09T18:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:040dd391da4cf02d9658f507aa651b9079b2630dbd9ec917f51bd62666e6ea9c","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:14:43.862454Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04554/citation-record","integrity":"/paper/2608.04554/integrity","json":"/paper/2608.04554/citation-record.json","paper":"/paper/2608.04554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.18709","last_updated":"2026-08-05T07:41:17Z","snapshot_observed_at":"2026-08-08T23:10:24.057948Z","submitted_at":"2026-06-17T05:43:37Z","title":"LLMs Struggle to Measure What Distinguishes Students of Different Proficiency Levels: A Study of Item Discrimination in Reading Comprehension Assessment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.18709","snapshot_observed_at":"2026-08-06T22:14:41.784243Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.784243Z"},"links":{"cited_paper":"/paper/2606.18709","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:3e9fc6c7941b49c38e95bedb957e58ec7e9d26561456c336ea52096687c5f71d","observation_id":"4042e9c9-f6d4-4c71-b957-e8d44ce87d35","resolution":{"observed_at":"2026-08-06T22:14:41.784243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9420.5011","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.535837Z","title":"Blank-image predictions are constant within each image-only seed, so their Spearman correlation is undefined","venue":null,"work_id":"7d8a7d51-03e7-4715-848e-615d94c161f4","year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.695320Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a0e5da3fb501193c2f9a63565ad2135d8d37e0ecb76b7d754732964beab0bef4","observation_id":"a6332e64-bdbf-4d17-8ae2-44d2873e786b","resolution":{"observed_at":"2026-08-06T22:14:44.621129Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0320.5059","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.770415Z","title":"Qwen-VL and PaliGemma use their packaged image preprocessing; InternVL uses a448× 448image transform and the model’s image-context tokens","venue":null,"work_id":"2aaa281a-ae29-4f36-9dbf-261c5d19b9ce","year":2021},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.591827Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:c78004874b5efcaaf0a7c47371250980ef2a59ccb33fdef632cd3a2019bded68","observation_id":"933109e8-e99b-4bb6-be81-0ab93f9e4ec1","resolution":{"observed_at":"2026-08-06T22:14:44.833055Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T22:14:42.056734Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.056734Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:e68e8608c328ecf3d67bfe32f2e317ab990eae0bfde6419d03f007220c42bffd","observation_id":"50655e06-b89e-497d-ae9a-f9873f088bc8","resolution":{"observed_at":"2026-08-06T22:14:42.056734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.440957Z","title":"Jump-starting item parameters for adaptive language tests","venue":null,"work_id":"1a2d25d0-45e8-4fa8-86ec-04df2d1f1803","year":2021},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.239779Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:1d0dc167ff2a850e5c4bf761f5242b795ff9031b1fa7dfc8abac51f5ce6483f1","observation_id":"1e9bb733-7e0b-43f3-b23e-d9678e638fca","resolution":{"observed_at":"2026-08-06T22:14:46.571597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T22:14:42.480552Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.480552Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:ec49baeea13afee5ae03e2db210ab81a054713e48041b55fda6a44efb45afbb4","observation_id":"4a692e18-eb14-4d07-a3ab-9257d176d774","resolution":{"observed_at":"2026-08-06T22:14:42.480552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T22:14:42.532662Z","title":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.532662Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a6b26035e578d4682d69bc126b059ce193fbf67971f4999788b490726b882a8c","observation_id":"74348b13-8884-4c25-a219-332c13d771fb","resolution":{"observed_at":"2026-08-06T22:14:42.532662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.151837Z","title":"Unibucllm: Harnessing llms for automated prediction of item difficulty and response time for multiple-choice questions","venue":null,"work_id":"5b9206af-d524-48d2-aca1-c4d6bab20eb2","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.594467Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:71bc94d9ff7a2e3b30b68f117fae89a3f3b8b1267c04635f6d0017f60eb00d7f","observation_id":"9a63e776-51f4-48fc-a5b2-628d25d4e0b1","resolution":{"observed_at":"2026-08-06T22:14:46.240931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.055057Z","title":null,"venue":null,"work_id":"0cccae20-d07d-4a3a-9a15-005c4722a845","year":2025},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.664243Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:282d790ae9ee2bf621cbfbbd142ba985c81eb6863d0a953f5d168f417f51454a","observation_id":"ab5fa2c9-f0ff-4b99-92b8-b77ee8609d1a","resolution":{"observed_at":"2026-08-06T22:14:46.092650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-08-06T22:14:42.703573Z","title":"Paligemma 2: A family of versatile vlms for transfer.arXiv preprint arXiv:2412.03555,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.703573Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:d0b258e3f7cde4a2b7a992b5f647f45ca0b3ae6298a932fa04c75fc795679ba0","observation_id":"dedf64f9-f21f-4dbb-8a3d-57ea7704004f","resolution":{"observed_at":"2026-08-06T22:14:42.703573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.791275Z","title":"Large language model-based pipeline for item difficulty and response time estimation for educational assessments","venue":null,"work_id":"7f0d1ff0-4221-4dd9-9db4-fee57dc48b59","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.824243Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:2476d0852700530cb531fe4d881339cbcaac292df59d770cd96ee85e5eafef84","observation_id":"29481127-f033-41f9-8ccf-824b126e6213","resolution":{"observed_at":"2026-08-06T22:14:45.840147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.28186","last_updated":"2026-07-11T22:18:18Z","snapshot_observed_at":"2026-07-16T23:17:54.586391Z","submitted_at":"2026-06-26T15:32:17Z","title":"Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction","version":2},"cited_work":{"arxiv_id":"2606.28186","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.28186","snapshot_observed_at":"2026-08-06T22:14:45.065305Z","title":"Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction","venue":"cs.CL","work_id":"45f67259-41fe-4200-bb05-cfcf92ddf8aa","year":2026},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.879017Z"},"links":{"cited_paper":"/paper/2606.28186","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:78aa00f2ffa9cddfdecc0b2148c784fc1a03fa629da7013d610a167a76a9bdc1","observation_id":"61b6b596-afe7-4864-9bab-5ccfeca145cf","resolution":{"observed_at":"2026-08-06T22:14:45.108666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-06T22:14:42.928682Z","title":"Internvl3","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.928682Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:40e086cc99c74cd9620595c05295ff19beab865ff783fe64d426ee99bb9e3f5e","observation_id":"6ddbd1a3-fae9-4e1e-8107-e828b428a4f4","resolution":{"observed_at":"2026-08-06T22:14:42.928682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T22:14:43.143417Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.143417Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:daf8b57a75a92a7583d2ace25708da747626160632de24ab14682443ba4d97cd","observation_id":"4859f4c9-044b-4f07-9c06-408af74ef0c7","resolution":{"observed_at":"2026-08-06T22:14:43.143417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:43.204466Z","title":"Towards valid student simulation with large language models.arXiv preprint arXiv:2601.05473,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.204466Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:d7c36d7e1ba86a86cdcc74252d45b86551a2ebbe2377aa4b419d7f91710c62f2","observation_id":"8ec5f49b-827a-41e8-b580-090a63ba1648","resolution":{"observed_at":"2026-08-06T22:14:43.204466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T22:14:43.288809Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models.arXiv preprint arXiv:2504.10479,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.288809Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:67dd376bc8202c0d146b06423f10bdda42d62641168c3079767b443496dd845b","observation_id":"95409a96-ec0c-46c7-9479-43cf4cc02bda","resolution":{"observed_at":"2026-08-06T22:14:43.288809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.581415Z","title":"3 3.2 Difficulty Labels","venue":null,"work_id":"230609f4-3fbd-40c5-8a4e-c9bdbb13dfa1","year":1995},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.357568Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:b6f25b1dafd0f689ed90d881bfed9e3d842610989910ff2f2337261595689a98","observation_id":"dc2df163-b325-4164-b994-8d17164bcfbb","resolution":{"observed_at":"2026-08-06T22:14:45.629862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.462958Z","title":"Visual textualization and image-native modeling impose different representational bottlenecks","venue":null,"work_id":"1d103e39-2885-44d6-adde-b243197f6fc1","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.432073Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:14f710553a61bac5e6c19fdcc55372968590d5d18a1ef0dc9872b8fd795e6764","observation_id":"aa9a3b01-bb03-450a-99af-9d8a6774b9fb","resolution":{"observed_at":"2026-08-06T22:14:45.530690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.375622Z","title":"The first pass extracts the question and identifies any additional visual component; the second checks the extraction against the same source image","venue":null,"work_id":"cb3f5c64-7e03-4a0e-8cfb-0e675eb0daef","year":2026},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.510098Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:5d89f996ce6645b647ef0cd2a9fb251655a09b730c22c0a25098141f41a1e22a","observation_id":"ab27c39d-b6aa-4ebe-b7ec-8fa2a3cfa6c9","resolution":{"observed_at":"2026-08-06T22:14:45.409774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4820.3090","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.326780Z","title":"Their fixed equal-weight average requires no fitted fusion parameters and reaches 0.4780 RMSE, but its paired intervals relative to either component cross zero","venue":null,"work_id":"3e9c3d07-6901-4fe3-9bc9-a53a9c662bf1","year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.777152Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:0989c3d0e0fc516c8046ba220102ac6aacceb8d36a9a42965c0ad17439894762","observation_id":"90b2eeb5-5ce5-454c-b667-171a4c3629ab","resolution":{"observed_at":"2026-08-06T22:14:44.413204Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2220.1360","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.089152Z","title":"The complete group is shown in Table 21; withn= 4, its aggregate ordering is not a stable estimate of a population effect","venue":null,"work_id":"e9ae0d4d-59fe-43a3-b4b2-a43bc143a769","year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":227,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.862454Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:1ba6a401f25d78dbbb2690d13ed0d9105ea184b2646dc7ae43818ba9ce5bf2a7","observation_id":"50e53fcb-2e65-4ccd-a2bd-21fdb7002b07","resolution":{"observed_at":"2026-08-06T22:14:44.168609Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:42.425904Z","title":"Text-based approaches to item difficulty modeling in large-scale assessments: A systematic review.arXiv preprint arXiv:2509.23486,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.425904Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:c4a2660e163e4337c9ce25373bb0bf65933ed3fc826726a81df8a8210fa67ac1","observation_id":"bada4227-35fd-45f3-8f01-b32ab37598a2","resolution":{"observed_at":"2026-08-06T22:14:42.425904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.928587Z","title":"Upn-icc at bea 2024 shared task: Leveraging llms for multiple-choice questions difficulty prediction","venue":null,"work_id":"360dfb08-8aae-4451-89a0-c213c2850fc5","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.947120Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:8b20a570a2a43bcf18b9b9f3b6832c52566737a285bc4f75c23b7c5d4a915166","observation_id":"db0ccafa-0121-4b8c-8271-50e31ff37395","resolution":{"observed_at":"2026-08-06T22:14:46.984440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.923528Z","title":"Itec at bea 2024 shared task: Predicting difficulty and response time of medical exam questions with statistical, machine learning, and language models","venue":null,"work_id":"e0f39751-6131-4e2f-924b-5e4320398409","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.766515Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:bdb058a907fca17fb59a203f39a5e8f91465334206b64a3309fe0c3a2c9a0d13","observation_id":"06cfef41-6ed2-4ae9-a3f9-8a8918e138c0","resolution":{"observed_at":"2026-08-06T22:14:45.969488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.686935Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":"896bebb9-8965-4b38-85d6-ad563664e21d","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.154492Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:c198e0c9653eeab55e3988cc54b64323a92377e9fd4be8cc0e6b25955a561cea","observation_id":"dbe14f68-7146-471a-bdf7-6beb39fd66b5","resolution":{"observed_at":"2026-08-06T22:14:46.752576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18880","last_updated":"2026-05-10T20:55:34Z","snapshot_observed_at":"2026-07-06T22:39:43.359149Z","submitted_at":"2025-12-21T20:41:36Z","title":"Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficiency Simulation for Item Difficulty Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.18880","snapshot_observed_at":"2026-08-06T22:14:42.098999Z","title":"Can llms estimate student struggles? human- ai difficulty alignment with proficiency simulation for item difficulty prediction.arXiv preprint arXiv:2512.18880, 2025a","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.098999Z"},"links":{"cited_paper":"/paper/2512.18880","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a27b8feb06f4740bd871b4aacac8d646a5e8b346d4252c2931a33f90486ac8e3","observation_id":"1e35b22c-56f3-4ced-8e4e-2d405770b86d","resolution":{"observed_at":"2026-08-06T22:14:42.098999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.680777Z","title":"Findings from the first shared task on automated prediction of difficulty and response time for multiple-choice questions","venue":null,"work_id":"cd31080d-becf-4aba-8495-4829f4f7c415","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.061599Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a72a143b022c4d52040b1a4092f57cd42d5ecabc628da0797bc546d24b04fd84","observation_id":"50f12ec2-a5d3-4be4-8314-d03d8652eedf","resolution":{"observed_at":"2026-08-06T22:14:45.723412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18589","last_updated":"2025-05-13T06:32:02Z","snapshot_observed_at":"2026-08-09T12:06:25.126716Z","submitted_at":"2025-04-24T06:16:38Z","title":"Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18589","snapshot_observed_at":"2026-08-06T22:14:43.010301Z","title":"Benchmarking multimodal mathematical reasoning with explicit visual dependency.arXiv preprint arXiv:2504.18589, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.010301Z"},"links":{"cited_paper":"/paper/2504.18589","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:6837bd4bdaebc9cedb43f80613f65136210dac53d602b44cdfa243475b10c93b","observation_id":"6c60d004-d4e4-40e4-ba33-741b9556fb0e","resolution":{"observed_at":"2026-08-06T22:14:43.010301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T22:14:41.888312Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling.arXiv preprint arXiv:2412.05271,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.888312Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:01f04c9319ea0be3cfa62d874a21e41d07097a6996848b3c7592db10786a1203","observation_id":"edefa4ec-cb67-4ec7-8919-ee6a1ab7dcae","resolution":{"observed_at":"2026-08-06T22:14:41.888312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T22:14:42.314157Z","title":"GPT-5.5 System Card, 2026.https://openai.com/index/gpt-5-5-system-card/","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.314157Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:ef6e1b3ed8ba6953b1dce29468cb79b3ef1149d0880fa90a21e68bff269fff3d","observation_id":"3f79b8d6-8391-4e01-a64b-78c0565ce311","resolution":{"observed_at":"2026-08-06T22:14:42.314157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.330758Z","title":"Large language models are students at various levels: Zero-shot question difficulty estimation","venue":null,"work_id":"83583968-18be-4621-b2f5-e96a9374263f","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.372717Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:7ae6a22778ff37c2a5a56309b626c25c48c0d7546b40cc5ba15dfb9d17f32a2e","observation_id":"f775a61b-6148-4ee8-8ec8-5558b4a5a38d","resolution":{"observed_at":"2026-08-06T22:14:46.391100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T22:14:41.746790Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.746790Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:face70059eb7f2ea3df1a0efd8e0342ceacc065a0f26872b87a40833eb2c6313","observation_id":"9d261d2a-9061-44d3-a16c-074588c9455d","resolution":{"observed_at":"2026-08-06T22:14:41.746790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.799743Z","title":"Utilizing machine learning to predict question difficulty and response time for enhanced test construction","venue":null,"work_id":"d37b5778-044e-42e8-8ff4-2ed6d67c95d5","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.002766Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:385ed352ca43e685faf4f555aaa9e4a994911eb081db70da8f3e5d78220ab7b4","observation_id":"bd1f35c3-6685-44ca-b59a-31fc5afdaa51","resolution":{"observed_at":"2026-08-06T22:14:46.861974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:47.041092Z","title":"Geoqa: A geometric question answering benchmark towards multimodal numerical reasoning","venue":null,"work_id":"75ad39f7-edec-4026-b232-074be0eb9daf","year":2021},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.835610Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:3a25d4d303b109d3dac667b3a22b15ad5cb78b6a0d72e2a0aaffdbaab5540a4c","observation_id":"357b56c4-fdb2-418b-90ed-5656ae20e6ba","resolution":{"observed_at":"2026-08-06T22:14:47.064968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T12:07:33.746082Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":5,"verified_fuzzy":13},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.04554."}