{"as_of":"2026-08-10T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:95676102eeba9465efc04e6b6ad1fb3a3bf5b4032cf5893976854c719edf10fb","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:49:12.272682Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:48:07.106359Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:48:07.604735Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"cited_work":{"arxiv_id":"2502.03793","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.03793","snapshot_observed_at":"2026-08-06T17:48:07.604735Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","venue":"cs.CL","work_id":"5090f212-7232-44a1-a561-154aabfaf56b","year":2025},"citing_paper":{"arxiv_id":"2507.09973","last_updated":"2025-07-14T06:43:00Z","snapshot_observed_at":"2026-08-08T02:31:23.778902Z","submitted_at":"2025-07-14T06:43:00Z","title":"Tiny Reward Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:48:07.106359Z"},"links":{"cited_paper":"/paper/2502.03793","citing_paper":"/paper/2507.09973"},"observation_digest":"sha256:a12403a0005865938fcdc25840a68eef2995845b443831d568921cfdf3611da9","observation_id":"f86633c8-6b4d-4265-b4bc-f7dbf11bcbe6","resolution":{"observed_at":"2026-08-06T17:48:07.607922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03793/citation-record","integrity":"/paper/2502.03793/integrity","json":"/paper/2502.03793/citation-record.json","paper":"/paper/2502.03793"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.089123Z","title":"Devlin, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.089123Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:3814dfee7b1d09e8e239fb60988acb66288a9723ac3f73ebe2325ee7968ac86b","observation_id":"cc187f64-08d4-4506-8f5c-9dfb66ab5f66","resolution":{"observed_at":"2026-08-09T00:49:12.089123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.774546Z","title":"Vaswani, N","venue":null,"work_id":"516b8fc1-e281-4dee-a7cc-cd387ef142b4","year":2017},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.092704Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:053e70f943091c943d2a02fdaff8efa3a0037b734f5607505e5499f224be323e","observation_id":"22cdd5a5-e432-466c-adbc-cbac4b4dd012","resolution":{"observed_at":"2026-08-09T00:49:12.777086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-08T12:58:42.430328Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-09T00:49:12.095682Z","title":"Lambert, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.095682Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:6f775dfaec361fe1047ef8b427d7da110f97ff4abd9bd7c1edcae85defd55dff","observation_id":"49986245-a2c9-4247-bb85-3dec3673329e","resolution":{"observed_at":"2026-08-09T00:49:12.095682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T00:49:12.098714Z","title":"Dubey, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.098714Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:71105715cdceac4fad5689c2b5a505d3e394c89939f6c7409c552af86cda6709","observation_id":"400316d9-f446-46eb-a295-5d494dcfdad4","resolution":{"observed_at":"2026-08-09T00:49:12.098714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-09T00:49:12.101823Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.101823Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:e77bcac45e165b07baf9f69f48e84f136967d44b3fbef9a1c6809022039441fe","observation_id":"55f7d166-2e43-4751-9fcb-89d6573861f8","resolution":{"observed_at":"2026-08-09T00:49:12.101823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.767719Z","title":null,"venue":null,"work_id":"2f1990b2-f029-48b1-a189-32a2e23f501b","year":2020},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.105079Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:8ec731c5fbf6070308bc47f62da0c5399efcc495e86c165d09485b63f98a56a7","observation_id":"ea9ebb7e-5310-4cad-ba3d-7e56cfcf2934","resolution":{"observed_at":"2026-08-09T00:49:12.770286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.760369Z","title":"Radford, J","venue":null,"work_id":"031f4078-c0f2-4de2-a763-7ead24313bbb","year":2019},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.108155Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:7cc7f848d7e04635ccbbf81dcd440a4b3d88b67c7e6f8ac6b4dba7df0088a7e3","observation_id":"04652211-c8e1-4e13-96eb-02bfcbb15305","resolution":{"observed_at":"2026-08-09T00:49:12.763255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-09T00:49:12.110889Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.110889Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:4e53c450336c86a9ffc2fb0de646477f0d96bd87626b2c5ec8c295882e0cd8ca","observation_id":"00a61132-d8b6-42e9-b6f6-2ceac0fed9f1","resolution":{"observed_at":"2026-08-09T00:49:12.110889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.751969Z","title":null,"venue":null,"work_id":"9aa1ec97-9513-4fd5-9524-f17a1fbe0f00","year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.117045Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:be49b518c70495646f1d5b767d07713967f158cd44dab4260da27c555794a171","observation_id":"d2d252ac-0ae0-4771-a493-3480d848cc2a","resolution":{"observed_at":"2026-08-09T00:49:12.755261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.744105Z","title":"Warner, A","venue":null,"work_id":"b317844b-3dcc-4314-9ddd-94085bb85414","year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.120107Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:4d1fc48fea95f18112967f854e0f39af64fa6b75aaaf05adf5523efdf0335e13","observation_id":"384a8075-f251-4be6-8579-106cb6463d61","resolution":{"observed_at":"2026-08-09T00:49:12.746731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-09T00:49:12.124370Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.124370Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:a3db3b24b728e4da58504b4809a50434c384c31cdca761ebd0cc81c8a7ad38a3","observation_id":"029cfc9e-e971-4cb0-afbc-c1fee4e52d77","resolution":{"observed_at":"2026-08-09T00:49:12.124370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.127371Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.127371Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:5ca4970216ee4d48d3569ce457c8e6f0fad2ac9c6482a0788e62eb916dee2854","observation_id":"42474086-e085-4513-bc04-7a813f4f7b3e","resolution":{"observed_at":"2026-08-09T00:49:12.127371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.735774Z","title":"Williams, N","venue":null,"work_id":"bd700ef0-f5d3-41da-bfeb-c8c2f2647e05","year":2018},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.130541Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:6ce9c5114b451c674221a36dd9d2f75d09ad3980c8dfdaa686cef374e887ecec","observation_id":"4f511a31-509a-484e-a37b-f6f478050150","resolution":{"observed_at":"2026-08-09T00:49:12.738655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.133110Z","title":"Lewis, Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.133110Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:5478de4478b458c7d9cc97f19dc501a2e2509c75fa3891d772f53519c1190b47","observation_id":"57a9767d-54d3-4d57-91c5-e4d6643aa27f","resolution":{"observed_at":"2026-08-09T00:49:12.133110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.727964Z","title":null,"venue":null,"work_id":"87f85a83-ad79-4eb0-82a9-0e6376edfd5b","year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.135882Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:ce02413592c4fdbe214bff7c87a9682f75108ff156d462e575f48d784601a2df","observation_id":"6c0f14fa-70c8-44af-b1f4-7ee5c8641108","resolution":{"observed_at":"2026-08-09T00:49:12.730589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.138705Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.138705Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:c50d2697cb971a7cf805a61e66ce7be23befc50ea0985e0b80629b3f1071f330","observation_id":"81724653-4351-41d6-96b8-b1da6a36bc38","resolution":{"observed_at":"2026-08-09T00:49:12.138705Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.719722Z","title":"cloze procedure","venue":null,"work_id":"d0f79a37-03b3-4f4e-a4fd-ffa29c61429f","year":1953},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.142256Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:7835344f98aba2d4eef7df7c01a0280b3dd9cb41102005576f402e213facdd84","observation_id":"677a9b5e-a461-4546-8cea-3d2c65f71208","resolution":{"observed_at":"2026-08-09T00:49:12.722993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.147694Z","title":"Schick, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.147694Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:960fa572553f720b0318e4444e12f2b279fe5450c4ad150a87bfe05bbe39dfd6","observation_id":"1883359b-0aa2-4ad8-b81f-60b4cc9357a9","resolution":{"observed_at":"2026-08-09T00:49:12.147694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04823","last_updated":"2024-10-31T16:48:51Z","snapshot_observed_at":"2026-08-09T16:32:45.355541Z","submitted_at":"2024-06-07T10:48:45Z","title":"BERTs are Generative In-Context Learners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04823","snapshot_observed_at":"2026-08-09T00:49:12.150658Z","title":"Samuel, Berts are generative in-context learners, CoRR abs/2406.04823 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.150658Z"},"links":{"cited_paper":"/paper/2406.04823","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:6aa6424fd038e7e9d8b49631dc128738b70fb281c6af491afbf6e830b78b7d18","observation_id":"727558e6-826b-48f3-b14e-2ef42269f5aa","resolution":{"observed_at":"2026-08-09T00:49:12.150658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.474","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"ce1b8ce4-b249-49e4-aba1-a6dc51955362","year":2022},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.153789Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:81360f3db562cdbd8d0728b305878f2f0cb466aebd96bc5bc846a53dafa6c59f","observation_id":"5eb73e16-027b-4e3e-ab2d-7b9b91c7bc34","resolution":{"observed_at":"2026-08-09T00:49:12.333868Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-09T00:49:12.156833Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.156833Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:8eb65000ea1de0e1b4761cdbeae041dcb9de808290c2dfe8f26b4d09fef63901","observation_id":"9d14c827-305c-4ec8-827a-3e4a1f7c6089","resolution":{"observed_at":"2026-08-09T00:49:12.156833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-09T00:49:12.159808Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.159808Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:3746e8ebaad449066f06c3c4d99732c71e12cda8b40cdcd29d5f3fa74e5dbc5f","observation_id":"2cc7376d-b3f4-4990-942b-f6a6e2989072","resolution":{"observed_at":"2026-08-09T00:49:12.159808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T00:49:12.162737Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.162737Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:ae901c66d0f56dfd6c7316d18230f3be1fa587fae0dd08c6ad42f5f945f5c388","observation_id":"49fb940e-5250-4f1d-a5cb-e951956d090b","resolution":{"observed_at":"2026-08-09T00:49:12.162737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00159","last_updated":"2024-06-06T18:46:40Z","snapshot_observed_at":"2026-08-08T04:07:59.311599Z","submitted_at":"2024-01-31T20:29:50Z","title":"Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00159","snapshot_observed_at":"2026-08-09T00:49:12.166031Z","title":"Soldaini, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.166031Z"},"links":{"cited_paper":"/paper/2402.00159","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:b5168c65d0fc98b8c23ab647c50b1016a7e89722b5125c2af874ffc0609e4784","observation_id":"72e65d2c-17a6-4faf-a9f1-c353d719ebab","resolution":{"observed_at":"2026-08-09T00:49:12.166031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11794","snapshot_observed_at":"2026-08-09T00:49:12.169403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.169403Z"},"links":{"cited_paper":"/paper/2406.11794","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:60b3747d47a788508d1010563d93f928eafa654c04f9cc7ab22a92afa306e08e","observation_id":"e8469c3f-7a12-4714-ba72-5335a943d876","resolution":{"observed_at":"2026-08-09T00:49:12.169403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17557","last_updated":"2024-10-31T11:37:49Z","snapshot_observed_at":"2026-08-02T15:25:02.551919Z","submitted_at":"2024-06-25T13:50:56Z","title":"The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17557","snapshot_observed_at":"2026-08-09T00:49:12.172991Z","title":"Penedo, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.172991Z"},"links":{"cited_paper":"/paper/2406.17557","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:e59234b43d9d1a863403c2dea4cd3b8be0011d3d3c93bb232623ede201a22f5a","observation_id":"48009407-6cc4-4b6b-84fa-d505198f9747","resolution":{"observed_at":"2026-08-09T00:49:12.172991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-09T00:49:12.176185Z","title":"Warner, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.176185Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:73b84f801dc77428c796b48bb230cfdcf28d11597f63de7a8375d15b3edc8dbe","observation_id":"b9053eac-b2a3-4d70-a394-df095850ad93","resolution":{"observed_at":"2026-08-09T00:49:12.176185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.712132Z","title":null,"venue":null,"work_id":"5f00160a-6a99-4a68-aee3-175e997f056c","year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.179707Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:1efdb0adde78ef5a9dc8aeedb13ab250fa71b101bae76864d8ce22fcbe239e43","observation_id":"9c65427e-5506-45f0-a57f-493555cb3691","resolution":{"observed_at":"2026-08-09T00:49:12.714808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.703103Z","title":"Zhang, Y","venue":null,"work_id":"9212f6e6-1429-4369-8617-6a31ca0973cb","year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.183270Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:dab4f799150ece507c6f92d942ba93240dc50b0ccb9c838e450652d29c1231ad","observation_id":"fd3c91fe-112f-4c6c-aae9-2a9de888dd46","resolution":{"observed_at":"2026-08-09T00:49:12.706544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.695228Z","title":"Javaheripi, S","venue":null,"work_id":"a824473e-9ee0-43c5-b801-e6580c8f5467","year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.186606Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:0bc84b8b596cfbdc3f7a2a7f2855512ada735a4981bfc53e7875d1c098684bde","observation_id":"1575c2c5-855c-415a-8bec-64d3902e0bae","resolution":{"observed_at":"2026-08-09T00:49:12.698090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-09T00:49:12.189956Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.189956Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:6f590055d2af2e5734c2fea6c7848bea26152650e17ac69140ec2430af98c1c1","observation_id":"b130bb73-1fce-494b-aaf2-bf70cd1024e0","resolution":{"observed_at":"2026-08-09T00:49:12.189956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.687839Z","title":null,"venue":null,"work_id":"837457de-1e1c-4e8d-8bcf-d6d2a9f9ba05","year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.193102Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:d51a46416d06f8d504ac7696b53187c4f25bb880061c2cf94c37f61c6885ab15","observation_id":"49d80b63-c591-4c7c-978a-b3b79a642df8","resolution":{"observed_at":"2026-08-09T00:49:12.690578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-09T00:49:12.195565Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.195565Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:a7583556e2d5cf15bc526c9a6532a279493bf992d514fba4efbf81d907bc2dc9","observation_id":"c08affc9-d785-4f9a-968a-9606dcf46c3c","resolution":{"observed_at":"2026-08-09T00:49:12.195565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.680384Z","title":"Sutskever, O","venue":null,"work_id":"cea483e9-5e4c-4860-83ca-c1d827c3d2de","year":2014},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.198723Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:9ea35d33fe4f64c4734264b84558a3e3596a488e4ea0e24f2fc09100eb3f85e2","observation_id":"67a90a28-3383-4623-b097-725b80457f00","resolution":{"observed_at":"2026-08-09T00:49:12.683142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.201569Z","title":"Ra ffel, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.201569Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:f8464aa8b5d130263a3c2acd130d9cdd4564aede22352a846632e8080506c637","observation_id":"9c4216a1-3d61-45b9-a617-0cdd483ee7f9","resolution":{"observed_at":"2026-08-09T00:49:12.201569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.780","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"279970fd-1c82-4b47-aaa7-433fe9442083","year":2022},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.204286Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:aa7e839b4459bdcd6bdc6b63e7f289dda0a77103bddfa0870e3b97defa2aadf9","observation_id":"eabbf38e-33b3-4748-91fc-a3fd99de6f55","resolution":{"observed_at":"2026-08-09T00:49:12.312478Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.667694Z","title":"Longpre, L","venue":null,"work_id":"0d372f64-0d95-45f5-926d-73e773b148d9","year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.207043Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:d4628afcd2c827b2b749568ae1da77e7de15d113f3beb7d70a6252f380d52ceb","observation_id":"7c060403-72a8-45f4-97ea-5dd4431e0d1f","resolution":{"observed_at":"2026-08-09T00:49:12.670374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.659680Z","title":"Hendrycks, C","venue":null,"work_id":"35aa22da-9028-4580-9ae8-afd3b0e93f5a","year":2021},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.210834Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:0810b9dfdda8ac615abd28c1ab3421b6afee3eea9e8e5f134a2793b323dcce48","observation_id":"d1d0f590-36a1-4de5-ae50-26a263b8076d","resolution":{"observed_at":"2026-08-09T00:49:12.662642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-09T00:49:12.213813Z","title":"Suzgun, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.213813Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:8704431e3fcc73bbea079d41bb8327032503c3bbe0a4a0866241e0c5d106f8d1","observation_id":"cecd3773-fd12-44e2-90f6-cbc869d0af81","resolution":{"observed_at":"2026-08-09T00:49:12.213813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.217095Z","title":"Srivastava, G","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.217095Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:811c56693e0b76839bfd8d1dc31b2e1ce581dd678e3e24ae3cffaa54728b691a","observation_id":"6fef0aae-67cd-4a5a-8bf2-3240be7a6197","resolution":{"observed_at":"2026-08-09T00:49:12.217095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.647797Z","title":"Khattab, M","venue":null,"work_id":"57975928-0fa4-48b6-841b-fa5a62d7a241","year":2020},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.220142Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:5b532126f5d1b7aa4e340cf89f94088c7cd577c99b6c3e367781d8d58673118d","observation_id":"70ce846d-d0da-4fce-9eec-c1496881593b","resolution":{"observed_at":"2026-08-09T00:49:12.650911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03533","last_updated":"2024-02-22T06:21:51Z","snapshot_observed_at":"2026-07-06T14:27:46.217000Z","submitted_at":"2022-12-07T09:25:54Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03533","snapshot_observed_at":"2026-08-09T00:49:12.223389Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.223389Z"},"links":{"cited_paper":"/paper/2212.03533","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:7496c6e85bb1af2ebff0b42c78e0e286f54a4a6a5d75be5a9f4311ae39c4a976","observation_id":"4b016110-2dab-4397-bf2e-92efff9fd97a","resolution":{"observed_at":"2026-08-09T00:49:12.223389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.638203Z","title":"Zhang, et al., Jasper and stella: distillation of sota embedding models, arXiv e-prints (2024) arXiv–2412","venue":null,"work_id":"428c2e19-637d-46df-b591-2baec3692915","year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.227145Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:1bc263b72ad311c74792825fc74a8e757f76243517703dc312afdb9d106ceeab","observation_id":"31aa18ef-6a75-4636-9511-47909dc375cb","resolution":{"observed_at":"2026-08-09T00:49:12.641399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-09T00:49:12.234415Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.234415Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:31b00415adf5d6629b01038e14f9c5f4ec3c1c4d0ce347a40c1f5f68590a787c","observation_id":"56b514b6-0342-4bc5-ac0d-acb81f14916a","resolution":{"observed_at":"2026-08-09T00:49:12.234415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14076","last_updated":"2022-01-18T21:40:14Z","snapshot_observed_at":"2026-08-05T22:09:34.214916Z","submitted_at":"2021-09-28T22:35:31Z","title":"RAFT: A Real-World Few-Shot Text Classification Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.14076","snapshot_observed_at":"2026-08-09T00:49:12.237357Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.237357Z"},"links":{"cited_paper":"/paper/2109.14076","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:40b4a4b5f9121a19136bf525e59cab9184894f88eaad2b551b4aeae70e522557","observation_id":"ff5c76f0-f918-4ccc-93fa-93725ff048de","resolution":{"observed_at":"2026-08-09T00:49:12.237357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.240445Z","title":"Gurulingappa, A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.240445Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:6b02c21094784cc0ef2393da896e4320dbe6b82509b8225ec3cbde91cf0503c0","observation_id":"c26a35cf-1d59-43d3-aedd-873f115ce4ca","resolution":{"observed_at":"2026-08-09T00:49:12.240445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w18-0535","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Vajjala, I","venue":null,"work_id":"c8dde4c7-4a73-4adc-ae84-ccc897a65387","year":2018},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.243751Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:4e1331436be5c68a5ac2acec58cb33cceedceb531ccc674c7e7ae602207588ef","observation_id":"30f134f6-211e-41aa-bc9c-888d74ff69e0","resolution":{"observed_at":"2026-08-09T00:49:12.300315Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.246217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.246217Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:bf8c9df4db510920f38001995393bb180b1c852434d107b7260b544e1557ce62","observation_id":"2bf2b1d9-718d-44bf-b78a-68021688fab4","resolution":{"observed_at":"2026-08-09T00:49:12.246217Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.629959Z","title":"Zhang, J","venue":null,"work_id":"accdf511-32b4-42d6-be7e-77141ff4d8dc","year":2015},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.248745Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:b991cbb3884b04e140f252c3195093aad262a0c0f9393a0afe346eb98c50c6e4","observation_id":"d012e6c7-8181-4285-ae60-d561652ec04f","resolution":{"observed_at":"2026-08-09T00:49:12.633224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.621740Z","title":null,"venue":null,"work_id":"54c9ed68-773e-4c93-9ebe-a4d7e298630e","year":2011},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.252185Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:052e8f8801785c848d60e25d57454ec0486cfa27cbd1bd52ab6d62f53b7e3526","observation_id":"f94c6c45-71ce-4498-bce1-cc7bfe0b2175","resolution":{"observed_at":"2026-08-09T00:49:12.625095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-09T00:49:12.255533Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.255533Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:accb2945fed5c05e0c8521e7330f2aef0ab3be25339efcc7c6197eb9bc3e5b85","observation_id":"853fa846-d311-4f34-87a9-536cb65c7633","resolution":{"observed_at":"2026-08-09T00:49:12.255533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.259260Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.259260Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:581299466dc0bdc3a0d50fd518c54a3d7c12aa2529a9555d37498675be3f9c53","observation_id":"37139d8d-fe31-4959-8b98-5aefdd56cb93","resolution":{"observed_at":"2026-08-09T00:49:12.259260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.613824Z","title":null,"venue":null,"work_id":"e5c8b4ae-a0ea-4be7-9b26-10a2d2f531a1","year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.262838Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:11e2490e0d4af471923360ab841cf2c2f3ef921ef62d74768bd12b709488a212","observation_id":"eddd7f55-8fb1-4944-80ca-562e3ffc17f2","resolution":{"observed_at":"2026-08-09T00:49:12.616581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11857","last_updated":"2024-08-15T20:17:33Z","snapshot_observed_at":"2026-07-06T19:04:13.760549Z","submitted_at":"2024-08-15T20:17:33Z","title":"Hermes 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11857","snapshot_observed_at":"2026-08-09T00:49:12.266170Z","title":"Teknium, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.266170Z"},"links":{"cited_paper":"/paper/2408.11857","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:463e940971f1b00222b3d68e421b6827773c52b22ea9b9fa9a9f71430911b07f","observation_id":"02a1e252-c7d2-49dd-9dbb-d72c34d7d4b6","resolution":{"observed_at":"2026-08-09T00:49:12.266170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-09T00:49:12.269561Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.269561Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:9749950d685c51d1225b05494c95bbe93b77f466609f87bc2201a0399201603d","observation_id":"0a211ce9-50bb-4526-8191-9360ed615c75","resolution":{"observed_at":"2026-08-09T00:49:12.269561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:12.606319Z","title":null,"venue":null,"work_id":"fe02b843-31c7-408b-a6ca-1c0620582bb1","year":2023},"citing_paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:12.272682Z"},"links":{"citing_paper":"/paper/2502.03793"},"observation_digest":"sha256:4154ad554ddc35b4fd238eda1b9571f0726c66de8e9ebf2f8cf95730d20c2d7a","observation_id":"75fdcb7c-54bd-4507-95c5-3b735ac1ead5","resolution":{"observed_at":"2026-08-09T00:49:12.609062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03793","last_updated":"2025-02-10T14:08:19Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T00:40:46.525297Z","submitted_at":"2025-02-06T05:47:37Z","title":"It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":3,"verified_fuzzy":13},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2502.03793."}