AltaySec Açık Kaynak AI Güvenlik Araçları
Türkçe veri setleri, ölçütler, checklistler ve linterlar — tek dizin
Bir güvenlik bulgusu ancak çalıştırılıp doğrulanabildiğinde değer taşır. Bu sayfa, AltaySec'in kamuya açık yapay zekâ güvenliği depolarını — veri setleri, ölçütler, araçlar ve rehberler — kategorize eder ve her birini ilgili Türkçe analize bağlar.
Neden açık kaynak?
AltaySec'in yapay zekâ güvenliği araştırmaları yalnızca yazılardan ibaret değil; bulguların çoğu açık kaynak araç, veri seti ve ölçüt olarak da yayımlanıyor. Bunun iki nedeni var: (1) bir güvenlik iddiası ancak bağımsız olarak çalıştırılıp doğrulanabildiğinde anlam taşır; (2) Türkçe'ye özgü saldırı ve savunma verisi, ortak bir zemin oluşması için paylaşılmalıdır. Bu sayfa, kamuya açık depoların kategorize edilmiş bir dizinidir. Her araç, ilgili derinlemesine Türkçe analizle (araştırma yazısı) çift yönlü bağlıdır.
Önemli bir dürüstlük notu: aşağıdaki depoların bir kısmı olgun ve üretime yakın, bir kısmı ise erken aşama referans uygulamalarıdır. Her deponun kendi README'sinde kapsamı ve olgunluğu belirtilir; buradaki hiçbir araç "üretimde kanıtlanmış" garantisi olarak sunulmaz.
Türkçe veri setleri & ölçütler
| Depo | Ne işe yarar | İlgili yazı |
|---|---|---|
guardrail-arena | Two-axis, multilingual (EN+TR) benchmark for LLM prompt-injection guardrails: measures attack miss-rate AND ov | Over-Refusal Nedir? Türkçe'de Aşırı Red Uçurumu |
turkish-over-refusal-set | XSTest-style over-refusal eval for Turkish LLM guards: 120 benign-but-scary pairs. Finding: ProtectAI over-ref | Over-Refusal Nedir? Türkçe'de Aşırı Red Uçurumu |
prompt-injection-corpus | A multilingual (English + Turkish) corpus of prompt-injection & jailbreak techniques for defenders — each | Türkçe Prompt Injection: Saha Verisinden 5 Saldı |
garak-multilingual-probes | Turkish + multilingual prompt-injection, jailbreak & casefold-evasion probes for NVIDIA garak — test your | Türkçe Prompt Injection: Saha Verisinden 5 Saldı |
guard-blindspots-tr | An English-good injection guard is not automatically Turkish-good: one popular open guard misses 85% of Turkis | Llama Guard vs NeMo Guardrails vs Guardrails AI |
turkish-casefold-evasion | 'İGNORE'.lower() != 'ignore'. Turkish case-folding & Unicode confusables bypass naive prompt-injection fil | Türkçe Casefold ve Dotsuz-ı Bypass'ı: 8 Harf Dön |
Uyum & checklist
| Depo | Ne işe yarar | İlgili yazı |
|---|---|---|
mcp-security-checklist | A practical, bilingual (EN+TR) security hardening checklist for MCP servers & configs — mapped to OWASP LL | MCP Sunucusu Güvenlik İncelemesi: Yetkiden Tool |
eu-ai-act-technical-checklist | A technical (engineering) compliance checklist for the EU AI Act for LLM/GPAI providers & deployers — red- | EU AI Act Uyum Rehberi: Türk Şirketleri için Pra |
kvkk-ai-compliance-kit | KVKK + AI compliance checklist & toolkit for LLM applications (Turkce) — PII, masking, data minimization, | KVKK ve LLM Güvenliği: Yapay Zekâ Veri Uyumu |
owasp-agentic-skills-top10-tr | A Turkish community guide to the OWASP Agentic Skills Top 10 framework. | OWASP Agentic Top 10 (2026) Türkçe: ASI01–ASI10 |
awesome-agent-supply-chain-security | A curated list of tools, research, standards and datasets for the security of AI agent extensions — skills, MC | Skill Poisoning: SKILL.md Tedarik Zinciri Saldır |
Araçlar & linterlar
| Depo | Ne işe yarar | İlgili yazı |
|---|---|---|
lethal-trifecta-lint | Zero-dependency linter that flags the 'lethal trifecta' (private-data + untrusted-input + external-comm) in an | Lethal Trifecta (Ölümcül Üçlü) Nedir? Ajanlarda |
hf-dataset-scan | Zero-dependency scanner for smuggled prompt-injection in datasets (invisible Unicode, injection phrases, exfil | Veri Zehirleme (Data Poisoning) Nedir? LLM04 Tür |
prompt-canon | Canonicalize before you guard: strip invisible-Unicode tags, homoglyphs and locale casefold traps before text | Türkçe Casefold ve Dotsuz-ı Bypass'ı: 8 Harf Dön |
unicode-threat-reveal | Reveal invisible-Unicode, homoglyph & Turkish casefold prompt-injection payloads hiding in text — paste-an | Sıfır Genişlikli Unicode ile Gizli Talimat: SKIL |
turkish-pii-redactor | Checksum-validated Turkish PII (TCKN, IBAN, VKN, plaka, phone, card) detection & redaction. Zero-dep libra | KVKK Uyumlu PII Maskeleme: LLM Trafiğinde Veri K |
tr-pii-detect | Türkiye'ye özgü PII (TC, IBAN, VKN, kart, telefon, plaka) için algoritma doğrulamalı tespit ve maskeleme kütüp | KVKK Uyumlu PII Maskeleme: LLM Trafiğinde Veri K |
uncloak | Reveal hidden prompt injection & supply-chain risks in AI agent extensions — scans Claude/agent Skills, MC | Sıfır Genişlikli Unicode ile Gizli Talimat: SKIL |
ai-honeypot | A zero-dependency honeypot that looks like a vulnerable AI agent, captures prompt-injection/jailbreak/agent-ab | LLM Honeypot Tasarımı: Saldırganı Çeken Sahte AI |
agent-security-ci | Ready-to-use GitHub Actions recipes to scan AI agent extensions (Skills/MCP/rules) with uncloak in CI — SARIF, | Skill Poisoning: SKILL.md Tedarik Zinciri Saldır |
prompt-injection-detection-rules | Open detection rules (regex + YAML) for prompt injection & jailbreak — for guardrails, WAFs and log pipeli | LLM Detection Engineering: Tespit Kuralı Yazma R |
skills-in-the-wild | An open, reproducible security audit of 3,168 real public AI agent extensions (skills, MCP configs, rules file | Skill Poisoning: SKILL.md Tedarik Zinciri Saldır |
Referans & rehberler
| Depo | Ne işe yarar | İlgili yazı |
|---|---|---|
awesome-turkish-ai-security | Turkish AI/LLM security resources — guides, tools, datasets, community. Turkce yapay zeka guvenligi kaynaklari | AI Security Öğrenme Rehberi — Sıfırdan Uzmanlığa |
ai-security-glossary | A bilingual (Turkce + English) glossary of AI/LLM security terms — prompt injection, jailbreak, guardrail, MCP | Türkçe Yapay Zekâ Güvenliği Sözlüğü — 40 Terim T |
llm-red-team-playbook | A practical LLM/agent red-team playbook (EN+TR) — scoping, threat model, OWASP LLM Top 10 test matrix, reporti | AI Red Teaming Playbook: Bir LLM Uygulaması Nası |
kalkan-arena | Turkish 'red-team our guard' prompt-injection challenge (HackAPrompt-style) that turns consented, PII-masked a | Bekçi: Türkçe LLM Prompt Injection Lab Mimarisi |
damn-vulnerable-agent-skill | Intentionally vulnerable AI Agent Skill scenarios for hands-on learning, with detection via uncloak. Education | Skill Poisoning: SKILL.md Tedarik Zinciri Saldır |
llm-security-skills | Agent Skills that turn your AI coding agent into an LLM security reviewer — prompt-injection testing, OWASP LL | AI Red Teaming Playbook: Bir LLM Uygulaması Nası |
guardarena-live | Two-axis LLM guardrail leaderboard — score any keyword/regex guard on jailbreak miss-rate vs benign over-refus | Over-Refusal Nedir? Türkçe'de Aşırı Red Uçurumu |
Nasıl atıf verilir?
Bu depoların her biri CITATION.cff ve README'de bir BibTeX bloğu içerir. Akademik veya teknik bir çalışmada bir aracı, veri setini ya da ölçütü kullanırsanız, ilgili deponun atıf bilgisini kullanabilirsiniz. Sert bulgu içeren veri setlerine (ör. Türkçe aşırı-red ölçümü, guardrail karşılaştırması) kalıcı bir atıf hedefi için DOI eklenmesi sürmektedir.
