{"as_of":"2026-08-18T17:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d1ec107d6f627f2551778898a5bb0322d02c37eb19ee0e07d698eecb97233ae","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:18:35.704016Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.05063/citation-record","integrity":"/paper/2505.05063/integrity","json":"/paper/2505.05063/citation-record.json","paper":"/paper/2505.05063"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-15T23:18:35.249573Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.249573Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:c53ab5cb2d09615700dcfc0c2a938c265141910efe7531cf665eb603c4555371","observation_id":"deacab77-8d21-4d2d-8de8-97ac932730e8","resolution":{"observed_at":"2026-08-15T23:18:35.249573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.546022Z","title":"i am borrowing ya mixing?","venue":null,"work_id":"43b2a93b-a0c7-44e6-ac82-24eb6758c5ec","year":2014},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.337434Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:718ecbfd8008e9c02175e97acc67ff3c949e4393be57d51a07e204444edea79b","observation_id":"46580f22-0eac-43e2-8f2b-6f3677b6dc70","resolution":{"observed_at":"2026-08-15T23:18:36.550112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.456744Z","title":"Phog: Probabilistic model for code generation","venue":null,"work_id":"a25301b3-ff87-4ec6-8841-aaa2ba064abb","year":2016},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.341603Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:eef7e798730aa7271fffb27c2232888c5ce15748ac20fd4281ad9bd3c3f60b9c","observation_id":"deddd272-a4f5-4c47-9b5c-c9ef2d0d3901","resolution":{"observed_at":"2026-08-15T23:18:36.509484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.391871Z","title":"Classification of code-mixed text using capsule networks","venue":null,"work_id":"afcada04-fe17-4376-affb-29c25b56c5d0","year":2021},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.345799Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:31c6b8bc2e0576b27f43257043ac4a9ad4c618f4ceaba6d8a8de66a01aad4fce","observation_id":"21852ec5-62ee-47d4-be96-db1984db72a0","resolution":{"observed_at":"2026-08-15T23:18:36.405677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T23:18:35.350319Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.350319Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:86b10825501b1f25864dcd985f1518183a05c9af979ad0fe5768e1569d720843","observation_id":"579c3317-9f18-4cb3-93c0-c6d139d82f01","resolution":{"observed_at":"2026-08-15T23:18:35.350319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T23:18:35.354863Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.354863Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:5bf2ae8386a7bc163ff50e641fbda943e576ea55b34881f4e26c635b68244543","observation_id":"f6b2fd87-52be-4d7b-b620-7955a6c31056","resolution":{"observed_at":"2026-08-15T23:18:35.354863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.379110Z","title":"Mipe: A metric independent pipeline for effective code-mixed nlg evaluation","venue":null,"work_id":"8e4558df-a8c9-43db-b59c-725fdad9a141","year":2021},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.359965Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:467cdb4689ed6ce421cbc92c76252ea2b97bc11ab6765c2f594f09be16fee7c7","observation_id":"eb97ed91-16b4-4328-917c-c0c5e2f4bf58","resolution":{"observed_at":"2026-08-15T23:18:36.383219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-15T23:18:35.455170Z","title":"Deepseek-coder: When the large language model meets programming -- the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.455170Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:53c4000121f5c4fb6b900945d7170ebba55a7d09ba0737d6b06cdd67ea2d427c","observation_id":"bd49260b-b5db-40a1-8692-120a94d61b24","resolution":{"observed_at":"2026-08-15T23:18:35.455170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10580","last_updated":"2024-10-14T14:54:05Z","snapshot_observed_at":"2026-08-18T03:19:05.018251Z","submitted_at":"2024-10-14T14:54:05Z","title":"Multilingual Controlled Generation And Gold-Standard-Agnostic Evaluation of Code-Mixed Sentences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10580","snapshot_observed_at":"2026-08-15T23:18:35.516306Z","title":"Multilingual controlled generation and gold-standard-agnostic evaluation of code-mixed sentences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.516306Z"},"links":{"cited_paper":"/paper/2410.10580","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:49e53deb77dd1df4e0025b77f1978d5f431eec518f54a750ae6dde92ada4d693","observation_id":"7945a1a2-e56a-4b00-9335-94f4fe603128","resolution":{"observed_at":"2026-08-15T23:18:35.516306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.367122Z","title":"Measuring coding competence with apps","venue":null,"work_id":"d3015ffc-8862-47f5-9f41-aa9c5093a0c0","year":2021},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.520765Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:1d83788ade01604fa30123a13ac0d84888af551301796069a85e93c703e8a104","observation_id":"7a3f0f0e-6c1a-4809-a439-81d1af668cda","resolution":{"observed_at":"2026-08-15T23:18:36.371721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04905","last_updated":"2025-03-20T03:28:56Z","snapshot_observed_at":"2026-08-16T13:02:01.818557Z","submitted_at":"2024-11-07T17:47:25Z","title":"OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04905","snapshot_observed_at":"2026-08-15T23:18:35.525371Z","title":"Opencoder: The open cookbook for top-tier code large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.525371Z"},"links":{"cited_paper":"/paper/2411.04905","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:60122121a9fd06927413ab811e9231e246e533d9e15224b703376109022de712","observation_id":"8b755cbe-4d94-49fe-9a83-c0bbfeee2452","resolution":{"observed_at":"2026-08-15T23:18:35.525371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-15T23:18:35.530570Z","title":"Qwen2.5-coder technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.530570Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:f4cd72a06d5e3d6260694eb509e86e5f0d9124dcf8c886c2af0ba25855cf78a4","observation_id":"db7399f3-104d-4068-b8df-8fec8ea16e85","resolution":{"observed_at":"2026-08-15T23:18:35.530570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.353856Z","title":"Xcodeeval: An execution-based large scale multilingual multitask benchmark for code understanding, generation, translation and retrieval","venue":null,"work_id":"d4888ea3-9848-43a1-9a09-00e7e1183404","year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.535050Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:2c09ee7a1f05225d0c21ddface6b795b0480d1d3ccbf74dbb26aac7f8ce83d86","observation_id":"cfc7534e-3e48-4727-a268-0b587693ed24","resolution":{"observed_at":"2026-08-15T23:18:36.358665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.235559Z","title":"Starcoder: May the source be with you! Transactions on Machine Learning Research, 2023","venue":null,"work_id":"31345b8b-e5e1-40f4-b0e2-c014fd3a5cbc","year":2023},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.538539Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:d2c26b505daae1760fdde94b6a556512dca123eb779c210d03d726b328a24ade","observation_id":"d1ba9b2e-80e2-46d4-b681-1eac09b371eb","resolution":{"observed_at":"2026-08-15T23:18:36.287324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07814","last_updated":"2022-02-08T23:16:31Z","snapshot_observed_at":"2026-08-15T05:41:03.327624Z","submitted_at":"2022-02-08T23:16:31Z","title":"Competition-Level Code Generation with AlphaCode","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07814","snapshot_observed_at":"2026-08-15T23:18:35.558304Z","title":"Competition-level code generation with alphacode","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.558304Z"},"links":{"cited_paper":"/paper/2203.07814","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:5dc12cc6dd390efdf94940784429f974edbd65766f79af2207201bfc655c672e","observation_id":"e0f9c429-54c4-43cc-ab5c-cb50e0ccb30e","resolution":{"observed_at":"2026-08-15T23:18:35.558304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.178685Z","title":"Social Motivations for Codeswitching: Evidence from Africa","venue":null,"work_id":"a8a8560e-df74-4710-938c-71a7a5b335b1","year":1993},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.622218Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:b541babe8f8feff0ca8dbfaf7bbf1de65093de9674f122e28a1ef63a5f475c5d","observation_id":"ee3af78b-dafd-4990-86a1-f1c754a9734c","resolution":{"observed_at":"2026-08-15T23:18:36.182343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.165958Z","title":"L 3 C ube- H ing C orpus and H ing BERT : A code mixed H indi- E nglish dataset and BERT language models","venue":null,"work_id":"4d270e45-458f-4090-b75e-48b2d574e3eb","year":2022},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.627051Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:b3e45f8f7446eb6b956d13c52a809f1e5255ed3bc258c7dfa3e6bf3614a4cdeb","observation_id":"719e9503-0e78-4627-a6de-d9aa743dbc84","resolution":{"observed_at":"2026-08-15T23:18:36.169809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.152108Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"73bcb6be-bfc0-403a-82ab-e73543dbef65","year":2002},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.630744Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:dc277eff21a6f446f720ea199d13adab5bbbf4a847182d56860633f7633c9331","observation_id":"9c098994-e277-4348-8978-083009bc0613","resolution":{"observed_at":"2026-08-15T23:18:36.156782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.037865Z","title":"Sentiment analysis of code-mixed text: A comprehensive review","venue":null,"work_id":"e345d123-f18e-415a-98f0-0a1b7905df40","year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.634879Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:c0768fdfb6c82ec0a7b0654d507dca1957bacc5ffab955a2300a37ea7d08818c","observation_id":"1276fdf1-b787-4fa1-80ef-33f553aa67f1","resolution":{"observed_at":"2026-08-15T23:18:36.098132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-15T23:18:35.639926Z","title":"Code llama: Open foundation models for code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.639926Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:9a8dec1209d18965cd4609481d87bc10c491752acf9aed15776cff2519fdfafc","observation_id":"ce573e0f-2027-44c2-92f7-7d0548af6017","resolution":{"observed_at":"2026-08-15T23:18:35.639926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:36.024404Z","title":"Learning to predict code-switching points","venue":null,"work_id":"d4b309ac-18cd-4e3e-a740-cd3917ee3b6d","year":2008},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.687812Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:e2be9ef64cf7318aebd9b8ee12353433feb4a2747dbf74d7fa5a6ebbd6b2de8e","observation_id":"b766b0f7-d1bb-47a9-85f5-462ab6d0a138","resolution":{"observed_at":"2026-08-15T23:18:36.028558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:35.974129Z","title":"Feature-rich part-of-speech tagging with a cyclic dependency network","venue":null,"work_id":"fa69d2bf-320e-4b80-8733-e427249b72aa","year":2003},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.692403Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:f1aeba58b2c070f2651d23e28e9f47872c14c1ec657a651fa31e50c4b674c663","observation_id":"8aa3407d-a41b-4cf8-80a8-59a816ac0b4d","resolution":{"observed_at":"2026-08-15T23:18:36.015629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:35.889955Z","title":"Adapting multilingual models for code-mixed translation","venue":null,"work_id":"e65d95a4-0211-4587-af78-e84ee83fc419","year":2022},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.696359Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:7a77b3d713c8d5f73b27879860a54425952e8f2c35b390ee1b33a4e68e3ddcbe","observation_id":"5514d3b7-6fd8-47e3-b988-45232dec1f54","resolution":{"observed_at":"2026-08-15T23:18:35.919580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:35.876951Z","title":"A syntactic neural model for general-purpose code generation","venue":null,"work_id":"b909ea77-a4ef-4649-8b6d-2904a8896293","year":2017},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.700248Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:8ce09ee30dc59a76e977767597ecb7a75fe71e29cddabbb1541640c02683cdd7","observation_id":"76344f3a-9d8a-47b9-aa9e-9f7c320ea426","resolution":{"observed_at":"2026-08-15T23:18:35.881327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:18:35.826812Z","title":"Bigcodebench: Evaluating language models on tool-augmented code generation","venue":null,"work_id":"ee2fde0a-b19f-4425-abbc-c60a141c4e81","year":2025},"citing_paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T23:18:35.704016Z"},"links":{"citing_paper":"/paper/2505.05063"},"observation_digest":"sha256:c883392b3c0b171fcdfa605baae7f37aebc10de15ff3e2ac5dcb58dcfce89457","observation_id":"27270050-9858-4485-9aa9-24bd1e8d33fc","resolution":{"observed_at":"2026-08-15T23:18:35.868455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05063","last_updated":"2025-05-08T08:55:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T21:47:16.763783Z","submitted_at":"2025-05-08T08:55:32Z","title":"CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2505.05063."}