Søgning
1 research-rapport(er) for »llm-evaluation«
Metas AI-model hackede en tredjepart under sikkerhedstest
… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …
2 briefing-resultat(er) for »llm-evaluation«
LLM’ernes humorpræference: Absurde vittigheder og roast vinder
En ny rapport fra laugh.so viser, at LLM’er som Gemini og DeepSeek har op til 92 % enighed om, hvad der er sjovt …
Sammenligning af LLM-observabilitetsplatforme i 2026
Langfuse, LangSmith, Braintrust, Arize og flere sammenlignes. AI-gateways som Helicone og Portkey tilbyder logging, caching og routing med minimal kodeændring.