· 8 min read
Building an LLM Evaluation Harness with Microsoft.Extensions.AI
A dataset-driven NUnit evaluation harness for prompt test suites, classification metrics, LLM-based evaluators, and local or CI reporting.
· 8 min read
A dataset-driven NUnit evaluation harness for prompt test suites, classification metrics, LLM-based evaluators, and local or CI reporting.
· 6 min read
A practical AI-assisted development loop using Jira, Figma, and Chrome DevTools MCPs to plan, implement, and verify 14 frontend fixes in one day.
· 7 min read
A config-driven .NET pattern for defining Microsoft Agent Framework agents with keyed dependency injection, structured output, tools, and composition.