Skip to content
Draft
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
2 changes: 1 addition & 1 deletion doc/bibliography.md
Original file line number Diff line number Diff line change
Expand Up @@ -5,6 +5,6 @@ All academic papers, research blogs, and technical reports referenced throughout
:::{dropdown} Citation Keys
:class: hidden-citations

[@aakanksha2024multilingual; @adversaai2023universal; @andriushchenko2024tense; @anthropic2024manyshot; @aqrawi2024singleturncrescendo; @atr2026; @bethany2024mathprompt; @bhardwaj2023harmfulqa; @bhardwaj2024homer; @boucher2023trojan; @brahman2024coconot; @bryan2025agentictaxonomy; @bullwinkel2025airtlessons; @bullwinkel2025repeng; @bullwinkel2026trigger; @chao2023pair; @chao2024jailbreakbench; @choi2026xlsafetybench; @cui2024orbench; @darkbench2025; @derczynski2024garak; @ding2023wolf; @embracethered2024unicode; @embracethered2025sneakybits; @gehman2020realtoxicityprompts; @ghosh2025aegis; @ghosh2025ailuminate; @gong2025figstep; @gupta2024walledeval; @haider2024phi3safety; @han2024medsafetybench; @han2024wildguard; @hiddenlayer2025policypuppetry; @hines2024spotlighting; @inie2025summon; @ji2023beavertails; @ji2024pkusaferlhf; @jiang2025sosbench; @jones2025computeruse; @kingma2014adam; @li2024drattack; @li2024mossbench; @li2024saladbench; @li2024wmdp; @lin2023toxicchat; @liu2024flipattack; @liu2024mmsafetybench; @lopez2024pyrit; @luo2024jailbreakv; @lv2024codechameleon; @mazeika2023tdc; @mazeika2024harmbench; @mckee2024transparency; @mehrotra2023tap; @microsoft2024skeletonkey; @odin2024; @palaskar2025vlsu; @pfohl2024equitymedqa; @promptfoo2025ccp; @robustintelligence2024bypass; @roccia2024promptintel; @rottger2023xstest; @rottger2025msts; @russinovich2024crescendo; @russinovich2025cca; @russinovich2025price; @scheuerman2025transphobia; @shaikh2022second; @shayegani2025computeruse; @shen2023donotanything; @sheshadri2024lat; @souly2024strongreject; @stok2023ansi; @tan2026comicjailbreak; @tang2025multilingual; @tedeschi2024alert; @vantaylor2024socialbias; @vidgen2023simplesafetytests; @wang2023decodingtrust; @wang2023donotanswer; @wang2025siuo; @wang2026visualleakbench; @wei2023jailbroken; @xie2024sorrybench; @yu2023gptfuzzer; @yuan2023cipherchat; @zeng2024persuasion; @zeng2024shieldgemma; @zhang2024cbtbench; @ziems2022mic; @zong2024vlguard; @zou2023gcg]
[@aakanksha2024multilingual; @adversaai2023universal; @andriushchenko2024tense; @anthropic2024manyshot; @aqrawi2024singleturncrescendo; @atr2026; @bethany2024mathprompt; @bhardwaj2023harmfulqa; @bhardwaj2024homer; @boucher2023trojan; @brahman2024coconot; @bryan2025agentictaxonomy; @bullwinkel2025airtlessons; @bullwinkel2025repeng; @bullwinkel2026trigger; @chao2023pair; @chao2024jailbreakbench; @choi2026xlsafetybench; @cui2024orbench; @darkbench2025; @deniz2026turkishpromptinjection; @derczynski2024garak; @ding2023wolf; @embracethered2024unicode; @embracethered2025sneakybits; @gehman2020realtoxicityprompts; @ghosh2025aegis; @ghosh2025ailuminate; @gong2025figstep; @gupta2024walledeval; @haider2024phi3safety; @han2024medsafetybench; @han2024wildguard; @hiddenlayer2025policypuppetry; @hines2024spotlighting; @inie2025summon; @ji2023beavertails; @ji2024pkusaferlhf; @jiang2025sosbench; @jones2025computeruse; @kingma2014adam; @li2024drattack; @li2024mossbench; @li2024saladbench; @li2024wmdp; @lin2023toxicchat; @liu2024flipattack; @liu2024mmsafetybench; @lopez2024pyrit; @luo2024jailbreakv; @lv2024codechameleon; @mazeika2023tdc; @mazeika2024harmbench; @mckee2024transparency; @mehrotra2023tap; @microsoft2024skeletonkey; @odin2024; @palaskar2025vlsu; @pfohl2024equitymedqa; @promptfoo2025ccp; @robustintelligence2024bypass; @roccia2024promptintel; @rottger2023xstest; @rottger2025msts; @russinovich2024crescendo; @russinovich2025cca; @russinovich2025price; @scheuerman2025transphobia; @shaikh2022second; @shayegani2025computeruse; @shen2023donotanything; @sheshadri2024lat; @souly2024strongreject; @stok2023ansi; @tan2026comicjailbreak; @tang2025multilingual; @tedeschi2024alert; @vantaylor2024socialbias; @vidgen2023simplesafetytests; @wang2023decodingtrust; @wang2023donotanswer; @wang2025siuo; @wang2026visualleakbench; @wei2023jailbroken; @xie2024sorrybench; @yu2023gptfuzzer; @yuan2023cipherchat; @zeng2024persuasion; @zeng2024shieldgemma; @zhang2024cbtbench; @ziems2022mic; @zong2024vlguard; @zou2023gcg]

:::
9 changes: 9 additions & 0 deletions doc/references.bib
Original file line number Diff line number Diff line change
Expand Up @@ -39,6 +39,15 @@ @article{tedeschi2024alert
url = {https://arxiv.org/abs/2404.08676},
}

@misc{deniz2026turkishpromptinjection,
title = {Turkish Prompt-Injection Dataset},
author = {Enes Deniz},
year = {2026},
howpublished = {Hugging Face},
url = {https://huggingface.co/datasets/3nesdeniz/turkish-prompt-injection-1k},
note = {CC BY 4.0},
}

@article{derczynski2024garak,
title = {garak: A Framework for Security Probing Large Language Models},
author = {Leon Derczynski and Erick Galinkin and Jeffrey Martin and Subho Majumdar and Nanna Inie},
Expand Down
123 changes: 96 additions & 27 deletions pyrit/datasets/seed_datasets/remote/__init__.py
Original file line number Diff line number Diff line change
Expand Up @@ -17,12 +17,20 @@
ATRVariationType,
_AgentThreatRulesDataset,
)
from pyrit.datasets.seed_datasets.remote.aya_redteaming_dataset import _AyaRedteamingDataset
from pyrit.datasets.seed_datasets.remote.babelscape_alert_dataset import _BabelscapeAlertDataset
from pyrit.datasets.seed_datasets.remote.aya_redteaming_dataset import (
_AyaRedteamingDataset,
)
from pyrit.datasets.seed_datasets.remote.babelscape_alert_dataset import (
_BabelscapeAlertDataset,
)
from pyrit.datasets.seed_datasets.remote.beaver_tails_dataset import _BeaverTailsDataset
from pyrit.datasets.seed_datasets.remote.categorical_harmful_qa_dataset import _CategoricalHarmfulQADataset
from pyrit.datasets.seed_datasets.remote.categorical_harmful_qa_dataset import (
_CategoricalHarmfulQADataset,
)
from pyrit.datasets.seed_datasets.remote.cbt_bench_dataset import _CBTBenchDataset
from pyrit.datasets.seed_datasets.remote.ccp_sensitive_prompts_dataset import _CCPSensitivePromptsDataset
from pyrit.datasets.seed_datasets.remote.ccp_sensitive_prompts_dataset import (
_CCPSensitivePromptsDataset,
)
from pyrit.datasets.seed_datasets.remote.coconot_dataset import (
CoCoNotCategory,
CoCoNotSplit,
Expand All @@ -41,9 +49,17 @@
_DecodingTrustToxicityDataset,
)
from pyrit.datasets.seed_datasets.remote.equitymedqa_dataset import _EquityMedQADataset
from pyrit.datasets.seed_datasets.remote.figstep_dataset import FigStepCategory, FigStepVariant, _FigStepDataset
from pyrit.datasets.seed_datasets.remote.forbidden_questions_dataset import _ForbiddenQuestionsDataset
from pyrit.datasets.seed_datasets.remote.garak_audio_dataset import _GarakAudioAchillesHeelDataset
from pyrit.datasets.seed_datasets.remote.figstep_dataset import (
FigStepCategory,
FigStepVariant,
_FigStepDataset,
)
from pyrit.datasets.seed_datasets.remote.forbidden_questions_dataset import (
_ForbiddenQuestionsDataset,
)
from pyrit.datasets.seed_datasets.remote.garak_audio_dataset import (
_GarakAudioAchillesHeelDataset,
)
from pyrit.datasets.seed_datasets.remote.garak_package_hallucination_dataset import (
_GarakCratesDataset,
_GarakDartDataset,
Expand All @@ -58,27 +74,51 @@
_GarakTmSystemPromptDataset,
)
from pyrit.datasets.seed_datasets.remote.harmbench_dataset import _HarmBenchDataset
from pyrit.datasets.seed_datasets.remote.harmbench_multimodal_dataset import _HarmBenchMultimodalDataset
from pyrit.datasets.seed_datasets.remote.harmbench_multimodal_dataset import (
_HarmBenchMultimodalDataset,
)
from pyrit.datasets.seed_datasets.remote.harmful_qa_dataset import _HarmfulQADataset
from pyrit.datasets.seed_datasets.remote.hixstest_dataset import HiXSTestLanguage, _HiXSTestDataset
from pyrit.datasets.seed_datasets.remote.jailbreakv_28k_dataset import _JailbreakV28KDataset
from pyrit.datasets.seed_datasets.remote.jailbreakv_redteam_2k_dataset import _JailbreakVRedteam2KDataset
from pyrit.datasets.seed_datasets.remote.jbb_behaviors_dataset import _JBBBehaviorsDataset
from pyrit.datasets.seed_datasets.remote.librai_do_not_answer_dataset import _LibrAIDoNotAnswerDataset
from pyrit.datasets.seed_datasets.remote.hixstest_dataset import (
HiXSTestLanguage,
_HiXSTestDataset,
)
from pyrit.datasets.seed_datasets.remote.jailbreakv_28k_dataset import (
_JailbreakV28KDataset,
)
from pyrit.datasets.seed_datasets.remote.jailbreakv_redteam_2k_dataset import (
_JailbreakVRedteam2KDataset,
)
from pyrit.datasets.seed_datasets.remote.jbb_behaviors_dataset import (
_JBBBehaviorsDataset,
)
from pyrit.datasets.seed_datasets.remote.librai_do_not_answer_dataset import (
_LibrAIDoNotAnswerDataset,
)
from pyrit.datasets.seed_datasets.remote.llm_latent_adversarial_training_dataset import (
_LLMLatentAdversarialTrainingDataset,
)
from pyrit.datasets.seed_datasets.remote.medsafetybench_dataset import _MedSafetyBenchDataset
from pyrit.datasets.seed_datasets.remote.mlcommons_ailuminate_dataset import _MLCommonsAILuminateDataset
from pyrit.datasets.seed_datasets.remote.medsafetybench_dataset import (
_MedSafetyBenchDataset,
)
from pyrit.datasets.seed_datasets.remote.mlcommons_ailuminate_dataset import (
_MLCommonsAILuminateDataset,
)
from pyrit.datasets.seed_datasets.remote.mm_safetybench_dataset import (
MMSafetyBenchCategory,
MMSafetyBenchVariant,
_MMSafetyBenchDataset,
)
from pyrit.datasets.seed_datasets.remote.moral_integrity_corpus_dataset import _MICDataset
from pyrit.datasets.seed_datasets.remote.mossbench_dataset import MossBenchOversensitivityType, _MossBenchDataset
from pyrit.datasets.seed_datasets.remote.moral_integrity_corpus_dataset import (
_MICDataset,
)
from pyrit.datasets.seed_datasets.remote.mossbench_dataset import (
MossBenchOversensitivityType,
_MossBenchDataset,
)
from pyrit.datasets.seed_datasets.remote.msts_dataset import _MSTSDataset
from pyrit.datasets.seed_datasets.remote.multilingual_vulnerability_dataset import _MultilingualVulnerabilityDataset
from pyrit.datasets.seed_datasets.remote.multilingual_vulnerability_dataset import (
_MultilingualVulnerabilityDataset,
)
from pyrit.datasets.seed_datasets.remote.odin_dataset import (
ODINSecurityBoundary,
ODINSeverity,
Expand All @@ -90,24 +130,47 @@
_ORBenchHardDataset,
_ORBenchToxicDataset,
)
from pyrit.datasets.seed_datasets.remote.pku_safe_rlhf_dataset import _PKUSafeRLHFDataset
from pyrit.datasets.seed_datasets.remote.pku_safe_rlhf_dataset import (
_PKUSafeRLHFDataset,
)
from pyrit.datasets.seed_datasets.remote.promptintel_dataset import (
PromptIntelCategory,
PromptIntelSeverity,
_PromptIntelDataset,
)
from pyrit.datasets.seed_datasets.remote.red_team_social_bias_dataset import _RedTeamSocialBiasDataset
from pyrit.datasets.seed_datasets.remote.remote_dataset_loader import _RemoteDatasetLoader
from pyrit.datasets.seed_datasets.remote.red_team_social_bias_dataset import (
_RedTeamSocialBiasDataset,
)
from pyrit.datasets.seed_datasets.remote.remote_dataset_loader import (
_RemoteDatasetLoader,
)
from pyrit.datasets.seed_datasets.remote.salad_bench_dataset import _SaladBenchDataset
from pyrit.datasets.seed_datasets.remote.sgxstest_dataset import SGXSTestLabel, _SGXSTestDataset
from pyrit.datasets.seed_datasets.remote.simple_safety_tests_dataset import _SimpleSafetyTestsDataset
from pyrit.datasets.seed_datasets.remote.sgxstest_dataset import (
SGXSTestLabel,
_SGXSTestDataset,
)
from pyrit.datasets.seed_datasets.remote.simple_safety_tests_dataset import (
_SimpleSafetyTestsDataset,
)
from pyrit.datasets.seed_datasets.remote.siuo_dataset import SIUOCategory, _SIUODataset
from pyrit.datasets.seed_datasets.remote.sorry_bench_dataset import _SorryBenchDataset
from pyrit.datasets.seed_datasets.remote.sosbench_dataset import _SOSBenchDataset
from pyrit.datasets.seed_datasets.remote.strong_reject_dataset import _StrongRejectDataset
from pyrit.datasets.seed_datasets.remote.tdc23_redteaming_dataset import _TDC23RedteamingDataset
from pyrit.datasets.seed_datasets.remote.strong_reject_dataset import (
_StrongRejectDataset,
)
from pyrit.datasets.seed_datasets.remote.tdc23_redteaming_dataset import (
_TDC23RedteamingDataset,
)
from pyrit.datasets.seed_datasets.remote.toxic_chat_dataset import _ToxicChatDataset
from pyrit.datasets.seed_datasets.remote.transphobia_awareness_dataset import _TransphobiaAwarenessDataset
from pyrit.datasets.seed_datasets.remote.transphobia_awareness_dataset import (
_TransphobiaAwarenessDataset,
)
from pyrit.datasets.seed_datasets.remote.turkish_prompt_injection_dataset import (
TurkishPromptInjectionFamily,
TurkishPromptInjectionLabel,
TurkishPromptInjectionSplit,
_TurkishPromptInjectionDataset,
)
from pyrit.datasets.seed_datasets.remote.visual_leak_bench_dataset import (
VisualLeakBenchCategory,
VisualLeakBenchPIIType,
Expand All @@ -119,7 +182,9 @@
VLGuardSubset,
_VLGuardDataset,
)
from pyrit.datasets.seed_datasets.remote.vlsu_multimodal_dataset import _VLSUMultimodalDataset
from pyrit.datasets.seed_datasets.remote.vlsu_multimodal_dataset import (
_VLSUMultimodalDataset,
)
from pyrit.datasets.seed_datasets.remote.wildguardmix_dataset import (
WildGuardMixAdversarial,
WildGuardMixPromptHarmLabel,
Expand Down Expand Up @@ -155,6 +220,9 @@
"PromptIntelSeverity",
"SGXSTestLabel",
"SIUOCategory",
"TurkishPromptInjectionFamily",
"TurkishPromptInjectionLabel",
"TurkishPromptInjectionSplit",
"VLGuardCategory",
"VLGuardSubcategory",
"VLGuardSubset",
Expand Down Expand Up @@ -227,6 +295,7 @@
"_TDC23RedteamingDataset",
"_ToxicChatDataset",
"_TransphobiaAwarenessDataset",
"_TurkishPromptInjectionDataset",
"_VLGuardDataset",
"_VLSUMultimodalDataset",
"_VisualLeakBenchDataset",
Expand Down
Loading