Back to writing blogs, this time about our recent work on measuring quality of AI responses for small startups (i.e. usi...

Back to writing blogs, this time about our recent work on measuring quality of AI responses for small startups (i.e. using MD files and a tiny, custom pipeline instead of tools like Langfuse). Have you done something similar? Any good approaches for small scopes? 🧵 #AI #evaluation

Read Original

Related