π€ AI Product Management, Evals & Prompt Systems
AI product strategy, evals, prompt systems, RAG quality, model selection, AI safety, token economics, and trustworthy AI UX.
Synthetic Data Generation Plan
Build the synthetic data generation plan for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Responsible-AI Review Checklist
Build the responsible-AI review checklist for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Red Team Plan
Build the red team plan for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
RAG Quality Evaluation Plan
Build the rag quality evaluation plan for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Prompt-Injection Threat Review
Build the prompt-injection threat review for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Prompt-Feature Specification
Build the prompt-feature specification for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Prompt Spec Writer
Build the prompt spec writer for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Prompt Engineering Workshop Builder
Build the prompt engineering workshop builder for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Prompt A/B Test Designer
Build the prompt A/B test designer for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Model-Selection Trade-off Matrix
Build the model-selection trade-off matrix for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Model Selection Memo
Build the model selection memo for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Model Drift Monitoring Plan
Build the model drift monitoring plan for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
LLM-as-Judge Eval Setup
Build the llm-as-judge eval setup for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
LLM Cost vs Quality Analysis
Build the llm cost vs quality analysis for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Human-in-the-Loop Flow Design
Build the human-in-the-loop flow design for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Hallucination Mitigation Strategy
Build the hallucination mitigation strategy for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Golden Test-Set Builder
Build the golden test-set builder for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Fine-tune vs Prompt vs RAG Memo
Build the fine-tune vs prompt vs rag memo for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Eval-Driven Model Upgrade Check
Build the eval-driven model upgrade check for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Eval Spec Generator
Build the eval spec generator for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Eval Set & Rubric Designer
Build the eval set & rubric designer for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Eval Dataset Curator
Build the eval dataset curator for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Cost Per Query Audit
Build the cost per query audit for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Confidence & Uncertainty UX Spec
Build the confidence & uncertainty UX spec for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.
Bias & Fairness Audit Prompt
Build the bias & fairness audit prompt for AI product work, covering eval criteria, failure modes, test data, safety risks, model behavior, and release decisions.