{"as_of":"2026-08-16T04:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a6b00582754fe55640c07f98842e999c3a6741f41b5539b9136fcaa9b8cc487","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:21:27.902347Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19608/citation-record","integrity":"/paper/2607.19608/integrity","json":"/paper/2607.19608/citation-record.json","paper":"/paper/2607.19608"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-01T12:21:27.187689Z","title":"Lal Khan, Ammar Amjad, Noman Ashraf, and Hsien- Tsung Chang","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.187689Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:6c39b7e49d2824fb1f01775815bd9dfd284248683c9c21c53a2b2a19af873307","observation_id":"8a5cf67e-ce82-42fc-bd4b-95d8ae5124cc","resolution":{"observed_at":"2026-08-01T12:21:27.187689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.434213Z","title":"InProceedings of the 2018 Conference on Empirical Methods in Natural Language Processing, pages 2381–2391, Brussels, Belgium","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.434213Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:1841bcc86077abbeafd8081d8addce00b1bfbe03b6cfe0b81604999f3180e24e","observation_id":"9905b508-1e12-42b5-a6f7-c3507413d7a0","resolution":{"observed_at":"2026-08-01T12:21:27.434213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.732290Z","title":"Jason Wei, Maarten Bosma, Vincent Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.732290Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:e2cbffe5c337172f651711aaa1810d6f509b0949b40582e1e5e7a4d6471dc4ed","observation_id":"7b233d8a-7bab-46f6-ae6c-c3af734f5e82","resolution":{"observed_at":"2026-08-01T12:21:27.732290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.817717Z","title":"In International Conference on Learning Representa- tions, volume 2024, pages 40193–40219","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.817717Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:8e0f437f564aca3cf444ffefe9787e2418b6e08b38a76918fa617598a143145f","observation_id":"1454e511-acdc-4761-85ae-7fcfc4019a0a","resolution":{"observed_at":"2026-08-01T12:21:27.817717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.522508Z","title":"InProceedings of the 2015 Conference on Empirical Methods in Natural Lan- guage Processing, pages 1743–1752, Lisbon, Portu- gal","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.522508Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:12bbb1a1d2896d50f621b74b4b54c8df50725b3105495d495842c96c9c6f7a9c","observation_id":"51222f51-d4e5-4ec0-8ff6-a7b2d03ac1f5","resolution":{"observed_at":"2026-08-01T12:21:27.522508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.263986Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.263986Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:d19283444b3f1d8ca504f31da9b4a92e4c120505465223aa32f3516a28041ecb","observation_id":"3aa5ae0f-8446-43d3-9d19-f18c9d9cbba5","resolution":{"observed_at":"2026-08-01T12:21:27.263986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.344201Z","title":"In Proceedings of the 2017 Conference on Empirical Methods in Natural Language Processing, pages 785– 794, Copenhagen, Denmark","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.344201Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:1440c1b7c6d9ee3c71846fdea68d64a9d374261e46cf4d9cdf9ca225f4902a56","observation_id":"eaab194c-25fc-4e3c-a2f0-9b801b099ed5","resolution":{"observed_at":"2026-08-01T12:21:27.344201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-01T12:21:27.069244Z","title":"Boyi Deng, Xu Wang, Yaoning Wang, Yu Wan, Yubo Ma, Baosong Yang, Haoran Wei, Jialong Tang, Huan Lin, Ruize Gao, and 1 others","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.069244Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:04fd62558d0a1c5e68bcf8452db5a52cf569835d69c0e7b41f97c2be1ba69c86","observation_id":"8fbfd539-fd3a-4116-b824-a70cce5c63d8","resolution":{"observed_at":"2026-08-01T12:21:27.069244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10063","last_updated":"2019-08-27T07:40:48Z","snapshot_observed_at":"2026-07-30T05:49:50.660286Z","submitted_at":"2019-08-27T07:40:48Z","title":"FinBERT: Financial Sentiment Analysis with Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10063","snapshot_observed_at":"2026-08-01T12:21:26.881155Z","title":"Jose Belda-Medina and Vendula Kokosková","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:26.881155Z"},"links":{"cited_paper":"/paper/1908.10063","citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:60e527aa5386e2e695390c6c930e359529fa21863a7e13fabd62f1a86a73cb9e","observation_id":"35ad0d64-4d48-4513-8a40-e99799afc4f9","resolution":{"observed_at":"2026-08-01T12:21:26.881155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:26.949299Z","title":"InAdvances in Neural Information Processing Systems, volume 33, pages 1877–1901","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:26.949299Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:19804d43fd9c5c4cc306aba629a5d732e62fd8c843b4e74f343b0a599501a789","observation_id":"3ba57595-a891-4b7b-98ed-1f7bc48748ce","resolution":{"observed_at":"2026-08-01T12:21:26.949299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08207","last_updated":"2022-03-17T17:53:01Z","snapshot_observed_at":"2026-08-14T04:21:28.978034Z","submitted_at":"2021-10-15T17:08:57Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08207","snapshot_observed_at":"2026-08-01T12:21:27.618990Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.618990Z"},"links":{"cited_paper":"/paper/2110.08207","citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:79949dc3c1b25d1ec0d0d0a2350fd3418e10f6544dbbc113335d25da5b6e4215","observation_id":"83e97f75-e045-41b8-bc55-953a4db40ff0","resolution":{"observed_at":"2026-08-01T12:21:27.618990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.683212Z","title":"InProceedings of the 2022 conference on empirical methods in natu- ral language processing, pages 5085–5109","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.683212Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:31a62c68a64f2a0fb8e9d6b4da29197041be48171547719c094f86196ed52873","observation_id":"bc5af543-c740-4fdf-ad7d-be4b7cf8fb3c","resolution":{"observed_at":"2026-08-01T12:21:27.683212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-01T12:21:27.902347Z","title":"A Experimental Details We evaluated five Qwen3.5 checkpoints: Qwen/Qwen3.5-0.8B, Qwen/Qwen3.5-2B, Qwen/Qwen3.5-4B, Qwen/Qwen3.5-9B, and Qwen/Qwen3.5-27B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.902347Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:90a20e8a9965e95bab322ece6446eceb0d35b48ee14ce6ffbeb3e7aac2dfeee4","observation_id":"cfbc7349-0859-404c-b1c9-28b8cfe6629c","resolution":{"observed_at":"2026-08-01T12:21:27.902347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:21:27.011124Z","title":"InFindings of the Association for Computational Linguistics: EMNLP 2024, pages 1691–1706","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.011124Z"},"links":{"citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:1b98ee0d73c7aca987525d1820a9e81e99bf75655de8693d6f44bf632c637ec7","observation_id":"42b8d5a2-167a-4323-ae69-8184e535f646","resolution":{"observed_at":"2026-08-01T12:21:27.011124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11887","last_updated":"2026-05-12T10:01:06Z","snapshot_observed_at":"2026-08-15T05:25:59.083289Z","submitted_at":"2026-05-12T10:01:06Z","title":"Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11887","snapshot_observed_at":"2026-08-01T12:21:27.112037Z","title":"Tingchen Fu, Yafu Li, Jiawei Gu, Xiaoye Qu, and Yu Cheng","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T12:21:27.112037Z"},"links":{"cited_paper":"/paper/2605.11887","citing_paper":"/paper/2607.19608"},"observation_digest":"sha256:3ce89141ef29f743e61fbc9e72283cd25ffeb535c719fb1c3fc5f0b507504800","observation_id":"6b8c3433-9075-43b9-84cc-c0f0a60d5cc9","resolution":{"observed_at":"2026-08-01T12:21:27.112037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19608","last_updated":"2026-07-21T22:24:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:24:01.268256Z","submitted_at":"2026-07-21T22:24:18Z","title":"Task Competence Is Not Instruction Following: Evaluating Instruction-Conflicting Behavior in Small Language Models"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2607.19608."}