Released RL prompt injection attacker checkpoints from PIForge and PISmith.
Albert Yin
AlbertYin
AI & ML interests
LLM
Recent Activity
liked a model 1 day ago
AlbertYin/agentdojo_attacker_qwen3_4b_5.6_terra upvoted a paper 9 days ago
GraphForge: Training Working Agents with Graph-Anchored Workspace Synthesis upvoted a paper 10 days ago
PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection DefensesOrganizations
None yet