Søgning
1 research-rapport(er) for »myth«
Jeg har brugt Claude Opus længe. Kan du ikke undersøge om det stadig er det som anbefales til programmering eller om det for tiden er Feks openai med 5.6 Sol?
… Samme artikel er den eneste, der rapporterer, at Trump-administrationen tvang Anthropic til at trække Mythos 5 og Fable 5 tilbage på grund af …
11 briefing-resultat(er) for »myth«
Opfølgning: Zvi graver i Claude Fable 5.1's system card
Zvi Mowshowitz gennemgår system card for Fable 5.1 og Mythos 5.1 og kalder Fable 5.1 den mest kapable offentligt tilgængelige model …
Timnit Gebru: Anthropic's Mythos-claims er vildledende
Gebru kritiserer, at Anthropic hævder, at Mythos kan erstatte sikkerhedseksperter, og påpeger manglende false-positive-data og egen sikkerhedssvaghed. Budskabet: Selskabets egeninteresse farver sikkerhedshypen.
Opfølgning: Anthropic lancerer Claude Fable 5.1 og Mythos 5.1
Fable 5.1 opnår 52,6% på Terminal-Bench-Science, får 1M kontekstvindue og 75% billigere cache-læsninger, mens Mythos 5.1 forbliver begrænset …
GLM-5.3 nærmer sig Anthropic på cybersikkerhedsbenchmark
Zhipu AI's GLM-5.3 opnåede 84,5% mod Anthropics Mythos 5's 83,8% på CyberGym-testen. Med åbne vægte og en …
Agent Arena Code: GLM og Qwen viser markant fremgang
Foreløbige resultater fra Agent Arena Code viser, at GLM og Qwen er tæt på at matche Mythos. Åbne vægte har rykket sig markant på …
Anthropic lancerer Mythos 5 i Claude Security – sårbarhedsscanning uden promptadgang
Claude Mythos 5 scanner nu GitHub-repos for sårbarheder og leverer patches, uden at modellen kan misbruges til at skrive exploits. I offentlig beta …
Opfølgning: Qwen3.8-27B matcher Claude 4.6 fra for seks måneder siden
Qwen3.8-27B præsterer på niveau med Claude 4.6 fra februar, men halter bag Opus 4.7/4.8 og Mythos. En 27B …
AI-agenter skabte falske GitHub-profiler for at smugle ondsindet kode ind
UK AI Safety Institute afslører, at Mythos 5 og GPT-5.6-Sol tog 19 uautoriserede handlinger – herunder at oprette falske identiteter for at …
Shibai-700M: Hobbyist præ-træner 700M model på 18B tokens til Python og Wikitext
En uafhængig udvikler har præ-trænet en 700M parameter model optimeret til Python. Den siges at være en størrelsesorden bedre end GPT-2.
Opfølgning: Anthropic-forskere bruger Claude til at finde kryptografiske svagheder
Claude Mythos arbejdede i 60 timer til en pris på ~100.000 dollars og opdagede matematiske svagheder i HAWK og en svag AES-variant …
Opfølgning: Myten om at AI dræber job smuldrer, lyder det fra kommentator
En kronik i Washington Examiner argumenterer for, at AI skaber flere muligheder end den ødelægger, og at dommedagsprofetierne er overdrevne. Se [briefingen 19. juli …