Hacker News

tomncooper
Decision models like Jev don't beat LLM-as-a-judge or traditional classifiers developers.redhat.com

dominotw4 minutes ago

prompts that these evaluations were done are too trivial

chelseahermes5 hours ago

[flagged]

hn-front (c) 2024 voximity
source