Pith. sign in

Paper Citation Record · LEDGER

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models

As of 6 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2604.01444.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2604.01444 v2

Coverage vector

measured 42 of 42 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-11T11:50:26.030339Z

measured 43 of 43 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-28T22:27:44.703466Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-06-28T22:32:44.314091Z

Reference resolution

42 of 42 outbound references displayed

  • verified exact18
  • verified fuzzy9
  • unresolved0
  • parse uncertain0
  • malformed identifier3
  • metadata mismatch12

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 70d12f98-1c10-4ba0-8fd5-7f5d50dd68f3 · outbound

This paper cites Vending-Bench: A Benchmark for Long-Term Coherence of Autonomous Agents.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Vending-Bench: A Benchmark for Long-Term Coherence of Autonomous Agents

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.367050Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:9c98b75624971dd50d386d71cc8477f6d1f4932a5eefdeeb92839dab42a2633f

Observation 82c6632c-ed5f-4714-99e0-c9f783a5dcd2 · outbound

This paper cites Foodsafesum: Enabling natural language processing applications for food safety document summa- rization and analysis.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Foodsafesum: Enabling natural language processing applications for food safety document summa- rization and analysis

Reference 2

Resolution
verified exact
doi, observed 2026-05-13T22:03:19.912265Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:b0c29ceb8df4e8100e6a2e9f1afb4fc34b58375c67e36a6593ce77c6133b8827

Observation 7308ff04-55d1-4e9e-8a66-afacf04b036d · outbound

This paper cites Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell

Reference 3

Resolution
metadata mismatch
arxiv_id, observed 2026-05-13T22:03:19.921093Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:2756f33fe56e16e983019dda5e1b260efab43b55a80eabf40f3b5532f04b404d

Observation e1de75b1-6d2a-4e82-bbce-7a6075274f46 · outbound

This paper cites To Trust or to Think: Cognitive Forcing Functions Can Reduce Overreliance on AI in AI-assisted Decision-making.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models To Trust or to Think: Cognitive Forcing Functions Can Reduce Overreliance on AI in AI-assisted Decision-making

Reference 4

Resolution
metadata mismatch
doi, observed 2026-05-15T18:04:20.739991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:f1f65cdb922a41207233213bec567d809cc83be034de76eac1333a65663871d7

Observation 0aa553d0-95c2-4cbf-8c44-3b259def265d · outbound

This paper cites Jailbreaking Black Box Large Language Models in Twenty Queries.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Jailbreaking Black Box Large Language Models in Twenty Queries

Reference 5

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:20.388321Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:64b9bd9ecb477eb23fd136e25175b45c8fd40c6df251c6f3db02983a57380ddd

Observation 3523a4aa-29ec-4a3d-b267-0d69fe87a2e9 · outbound

This paper cites Artificial Intelligence for Food Innovation.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Artificial Intelligence for Food Innovation

Reference 6

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:20.364007Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:7d952acc112682e3d9f86539dc9ce5f7d09a6fe07059ffec3f7aa12ac7f8ed92

Observation 37164101-21f8-4f08-a204-388fd456d631 · outbound

This paper cites Hwang, Soumya Sanyal, Xiang Ren, Allyson Ettinger, Za ¨ıd Harchaoui, and Yejin Choi.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Hwang, Soumya Sanyal, Xiang Ren, Allyson Ettinger, Za ¨ıd Harchaoui, and Yejin Choi

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.709836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:c371520c582becc172d680509ad100e647983cd8d5fbb239663697de09cbd35c

Observation bbbcea99-6732-41cb-9229-69efa880d3e5 · outbound

This paper cites Fred Fung, Huei-Shyong Wang, and Suresh Menon.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Fred Fung, Huei-Shyong Wang, and Suresh Menon

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.708101Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:64571cc37b26eb0164b8c241a3444a2ac6dc94b577cdfc6e5cfbb392d247f6f7

Observation 0f134718-38ac-4b3e-9310-123bbae77737 · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 9

Resolution
verified exact
local_arxiv, observed 2026-05-13T22:03:20.361552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:98eb9bbac1a346eb375e8a384171ccdb76c8c47b73be72fabb5f765ecfd43a64

Observation d82b539f-42e0-498a-b8cb-4ddd18c0e8c1 · outbound

This paper cites The Llama 3 Herd of Models.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models The Llama 3 Herd of Models

Reference 10

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:20.369667Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:84195f4f8b395d2ff9402cbabc44f412fb0c47a9409f46548c993e5e3a27e74d

Observation b9f0bbc0-c0eb-4a95-a547-1f47426c7780 · outbound

This paper cites ISBN 9798400714542.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models ISBN 9798400714542

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:19.930381Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:3ac181782a7ba6b2ef8ec694e738c0c551c30ff256f97e1b18cbe582f2538f91

Observation 6e5821f2-e75b-4b00-8bd3-177225f9566b · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 12

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:19.896441Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-07-11T11:50:26.030339Z digest=sha256:a22654429619814c194ee9e51f521380df3db1cc232e4754dd666f0633b62406

Observation 44e2844e-3698-47e5-b6e2-e1e3246e727c · outbound

This paper cites Suyog Joshi, Soumyajit Basu, Lipika Dey, and Partha Pratim Das.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Suyog Joshi, Soumyajit Basu, Lipika Dey, and Partha Pratim Das

Reference 13

Resolution
verified exact
doi, observed 2026-05-13T22:03:19.923413Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:91d85362aed9284199545c8db0b7361d3601d655e200f16f8e035eb74b544e94

Observation 8415bb81-8218-4586-939e-43fd2c93d097 · outbound

This paper cites SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.350730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:79777c83c193062d691359e6d02e03bc7f4364788a93eeccf7b76b209d263e4f

Observation e4cd7655-86b5-4bd2-aa68-fe4aee4bb356 · outbound

This paper cites When Helpers Become Hazards: A Benchmark for Analyzing Multimodal LLM-Powered Safety in Daily Life.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models When Helpers Become Hazards: A Benchmark for Analyzing Multimodal LLM-Powered Safety in Daily Life

Reference 15

Resolution
verified exact
local_arxiv, observed 2026-05-13T22:03:20.353185Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:87828cf0b25026cdeb6765bb3bd0b5747faabb1729f4e052911cd5841b74f965

Observation 226f53af-b87c-4feb-b09d-03645da07d83 · outbound

This paper cites Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-05-13T22:03:20.355783Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:8214b030341490e703e1faa97414c36d1e89a0f0a57185fc454affb219fdd616

Observation 1ded42ea-fc73-4c2d-bc59-ae279d9eac74 · outbound

This paper cites Dy- namic guided and domain applicable safeguards for enhanced security in large language models.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Dy- namic guided and domain applicable safeguards for enhanced security in large language models

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.706436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:9fd1720241e126a25a7667ee64076e17520b96459a471d47f1f82795b9f92f38

Observation 985d49bb-5099-4bfe-ba4e-e90fab9acbd3 · outbound

This paper cites CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.345361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:8597ec0fba09eaa69ce576f64c4f845f52f88222011bd2a34f137f60ed96be93

Observation 0ac92ca4-c4d8-4956-b5b3-a2c89d99d30b · outbound

This paper cites doi: 10.3390/nu17223515.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models doi: 10.3390/nu17223515

Reference 19

Resolution
verified exact
doi, observed 2026-05-13T22:03:19.927644Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:92f80eef340a792c74a8de03368aefd064a86b807aa9251a444451d3ae21d3eb

Observation 2df80683-2c12-48ac-a0ef-de91aefd9509 · outbound

This paper cites Safety alignment should be made more than just a few tokens deep.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Safety alignment should be made more than just a few tokens deep

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.711477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:be207e3c4ec9fc53c80e922ac9470a091cbcf1b3808f0620af9a156bd99426dd

Observation 85773433-26ff-4dda-9540-2e41d370cfea · outbound

This paper cites Qwen2.5 Technical Report.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Qwen2.5 Technical Report

Reference 21

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:20.393438Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:a357e2b56bdf1ca389f02cf1ee1858e2fb1d3cdef77fbf62da7f1fd56ac6580f

Observation 55fc4bc5-a864-42b6-9a51-354b937030f3 · outbound

This paper cites NeMo Guardrails: A Toolkit for Controllable and Safe LLM Applications with Programmable Rails.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models NeMo Guardrails: A Toolkit for Controllable and Safe LLM Applications with Programmable Rails

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.358831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:04671dd37114df2a485ed328bf6fbd005ae51fe0287896097e026c6f317c446f

Observation cb498c00-5ad1-4815-b158-a4d15dc9daaa · outbound

This paper cites doi: 10.3390/healthcare11060887.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models doi: 10.3390/healthcare11060887

Reference 23

Resolution
verified exact
doi, observed 2026-05-13T22:03:19.925685Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:6a874550ada5c6a5e161ef868b1a796ceda33fe250e3e6c2ab724aafbbb9af6c

Observation 069554b5-3485-4685-9869-aa11d74fec1d · outbound

This paper cites doi: 10.1145/3748239.3748242.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models doi: 10.1145/3748239.3748242

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:19.889635Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:7cca76ed0d364aa6d56d60e55796e67757e9f4a04901fe611836a73ff298720f

Observation 6863dc78-0078-4642-a53f-295b9c1073db · outbound

This paper cites author Sharma, A.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models author Sharma, A

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-05-13T22:03:19.902527Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:bbedfbb4e63a115237aebd617cbe0f76ccd41a3ca383365a23fa01e6df2a4639

Observation 5da9c509-66eb-4038-9916-930fdf5a9d66 · outbound

This paper cites What can large language models do for sustainable food?.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models What can large language models do for sustainable food?

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.391191Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:66e0a9f280349bc9597c4492df237bd384c46896d879d9e7e813571aa862aad6

Observation 791868b8-4416-499c-8c40-c5005b3d8224 · outbound

This paper cites Food and Drug Administration.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Food and Drug Administration

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.718993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:9cc38761c18713e26a8cd14f3e67a16a3127d08814c1fa41d60a7c70ceb12837

Observation 21a0681c-8444-4df5-a19e-154c3591aa31 · outbound

This paper cites fda.gov/food/fda-food-code/food-code-2022.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models fda.gov/food/fda-food-code/food-code-2022

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.716457Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:d2592bc145a6c056ee151465c7a52bb5c507062e0cb36c4a8a11b622148d7866

Observation 7fa78247-350d-45db-b66c-fcde9b73a2e5 · outbound

This paper cites PATeam at SemEval- 2025 task 9: LLM-augmented fusion for AI-driven food safety hazard detection.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models PATeam at SemEval- 2025 task 9: LLM-augmented fusion for AI-driven food safety hazard detection

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.720949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:f293c22f69e8effe188db78a58d9127b84d26e6a12b60a9d4da925c868492c7e

Observation 242f391a-722b-4d3c-8e24-77db8dc4e70b · outbound

This paper cites ISBN 979-8-89176-273-2.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models ISBN 979-8-89176-273-2

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.714837Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:d9678844d525e6621fc22da1e54bc263b05d95e54fc09ee7014a96b8ecb7460a

Observation aff94550-37b0-4bdf-8fcb-7c74bfd3e047 · outbound

This paper cites Do-Not-Answer: A Dataset for Evaluating Safeguards in LLMs.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Do-Not-Answer: A Dataset for Evaluating Safeguards in LLMs

Reference 31

Resolution
metadata mismatch
arxiv_id, observed 2026-05-13T22:03:20.386027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:4fa0504dc07aa39feeaa2391f1fbee98fd5cd1218a8a4130aab2cee27f6b5dfe

Observation 9da0812d-d5d4-451a-a891-fa5064b67989 · outbound

This paper cites Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph Alignment.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph Alignment

Reference 32

Resolution
malformed identifier
doi_truncated, observed 2026-05-13T22:03:19.899242Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:0fbf4e0d7abddc1044b8a600facca49f558f5f924a65ae64d3a83c161ed2fccc

Observation e98b6ac1-1510-40ae-933e-ac21ce56c765 · outbound

This paper cites Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-05-13T22:03:20.713231Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:37b2e17f70a91bc35528f4c4b68cff0c9ab7ad5d7bcf3bfd3087655501237c95

Observation 68229108-751a-4222-869a-b49f4e954901 · outbound

This paper cites Knowledge-Centric Hallucination Detection.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Knowledge-Centric Hallucination Detection

Reference 34

Resolution
verified exact
doi, observed 2026-05-13T22:03:19.914964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:cf77041b1263ab2102bb57ecc25ec278f0829c50afe24cf667d4cc5d953b6a4f

Observation db2b430d-9252-4c41-9a9e-1aec8c24ccda · outbound

This paper cites 16 Preprint Nan Xu, Fei Wang, Ben Zhou, Bangzheng Li, Chaowei Xiao, and Muhao Chen.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models 16 Preprint Nan Xu, Fei Wang, Ben Zhou, Bangzheng Li, Chaowei Xiao, and Muhao Chen

Reference 35

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.380424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:a09f56c31dc69ce993262a4e5c27ffa69cc33f41891d998ac8dd6416504bd878

Observation 106b793f-8b28-4eaf-9743-f856184ee255 · outbound

This paper cites Qwen3 Technical Report.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Qwen3 Technical Report

Reference 36

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:20.372271Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:0f1491344beae6b20ee022db549729e3de174a091f9ffec3c4e3fbd6fc05e6cf

Observation f23df412-cb53-4fac-a70d-79d3f1f360e9 · outbound

This paper cites net/forum?id=pn83r8V2sv.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models net/forum?id=pn83r8V2sv

Reference 37

Resolution
verified exact
doi, observed 2026-05-13T22:03:19.905304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:c49c84464c2492cdb56f1f3b9b78ebc392aaa304b8f546a954bc6cbdfc7066d9

Observation 512809fa-6d48-495b-98c8-306dc21bdfa8 · outbound

This paper cites Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata

Reference 38

Resolution
metadata mismatch
local_arxiv, observed 2026-05-13T22:03:19.909954Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-07-11T11:50:26.030339Z digest=sha256:4d3b779286c5b379757ae0caf59b166fa63f302665b3fdb55a6f81007609bf0f

Observation 77548c0f-f68b-4302-b493-eeeabb6d6ba5 · outbound

This paper cites Qwen3Guard Technical Report.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Qwen3Guard Technical Report

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:33:37.835217Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:d73472c1fd873e14042683d0b5dd7b41084534e4ddf545a98d973d1fc1e70019

Observation a4704ae7-3f2f-45ac-8b6a-5576628cf5d6 · outbound

This paper cites Weak-to-strong jailbreaking on large language models.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Weak-to-strong jailbreaking on large language models

Reference 40

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.347951Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:cc2bc37dd5169bd5b1b715f3ed9006cc858937370b7c123844e67dde0f73341c

Observation a96f3cba-ad2d-443c-b4ca-8e1731e1afd8 · outbound

This paper cites Universal and Transferable Adversarial Attacks on Aligned Language Models.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Universal and Transferable Adversarial Attacks on Aligned Language Models

Reference 41

Resolution
malformed identifier
local_arxiv, observed 2026-05-13T22:03:20.374861Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:871b167717b32e5a7588abf716bea99144050a57b4343d741ca935fa316c9c6f

Observation 451205d3-543a-414c-94fc-642c20862b9d · outbound

This paper cites Based on this categorization, the final Fleiss’ Kappa among the three human experts is 0.4684.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models Based on this categorization, the final Fleiss’ Kappa among the three human experts is 0.4684

Reference 42

Resolution
malformed identifier
arxiv_id, observed 2026-05-13T22:03:20.377630Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:8d40b9f1e4053d0a83ef862c20b220c31017c77f591e4b66598de72e3ae9852c

Pith citing papers

Observation 5e904aac-8ada-4084-b68c-0d6b102ff2e6 · inbound

Triaging Threats to Specialized Guardrails cites this paper.

Triaging Threats to Specialized Guardrails Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models

Reference 30

Resolution
verified exact
local_arxiv, observed 2026-06-28T22:32:44.315322Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=arxiv_source observed=2026-06-28T22:27:44.703466Z digest=sha256:377ba2e794ef5c93a649b305ac6e98d426a45debab1e204af67e988cd9bd8dad