News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »myth«

Jeg har brugt Claude Opus længe. Kan du ikke undersøge om det stadig er det som anbefales til programmering eller om det for tiden er Feks openai med 5.6 Sol?

… Samme artikel er den eneste, der rapporterer, at Trump-administrationen tvang Anthropic til at trække Mythos 5 og Fable 5 tilbage på grund af …

torsdag 30. juli 2026 · research

11 briefing-resultat(er) for »myth«

Opfølgning: Zvi graver i Claude Fable 5.1's system card

Zvi Mowshowitz gennemgår system card for Fable 5.1 og Mythos 5.1 og kalder Fable 5.1 den mest kapable offentligt tilgængelige model …

søndag 6. september 2026 · 🗣️ Stemmer claude-fable-5.1claude-mythos-5.1anthropic

Timnit Gebru: Anthropic's Mythos-claims er vildledende

Gebru kritiserer, at Anthropic hævder, at Mythos kan erstatte sikkerhedseksperter, og påpeger manglende false-positive-data og egen sikkerhedssvaghed. Budskabet: Selskabets egeninteresse farver sikkerhedshypen.

fredag 4. september 2026 · 🗣️ Stemmer anthropicmythostimnit-gebrusecurity-claims

Opfølgning: Anthropic lancerer Claude Fable 5.1 og Mythos 5.1

Fable 5.1 opnår 52,6% på Terminal-Bench-Science, får 1M kontekstvindue og 75% billigere cache-læsninger, mens Mythos 5.1 forbliver begrænset …

onsdag 2. september 2026 · Nye modeller claude-fable-5.1claude-mythos-5.1terminal-benchcache-reads

GLM-5.3 nærmer sig Anthropic på cybersikkerhedsbenchmark

Zhipu AI's GLM-5.3 opnåede 84,5% mod Anthropics Mythos 5's 83,8% på CyberGym-testen. Med åbne vægte og en …

søndag 30. august 2026 · 🇪🇺 EU & Europa glm-5.3cybersecuritychinaanthropic

Agent Arena Code: GLM og Qwen viser markant fremgang

Foreløbige resultater fra Agent Arena Code viser, at GLM og Qwen er tæt på at matche Mythos. Åbne vægte har rykket sig markant på …

fredag 28. august 2026 · Nye modeller agent-arenaglmqwenopen-weights

Anthropic lancerer Mythos 5 i Claude Security – sårbarhedsscanning uden promptadgang

Claude Mythos 5 scanner nu GitHub-repos for sårbarheder og leverer patches, uden at modellen kan misbruges til at skrive exploits. I offentlig beta …

lørdag 22. august 2026 · Værktøjer & produkter anthropicclaude-mythos-5claude-securityvulnerability-scanning

Opfølgning: Qwen3.8-27B matcher Claude 4.6 fra for seks måneder siden

Qwen3.8-27B præsterer på niveau med Claude 4.6 fra februar, men halter bag Opus 4.7/4.8 og Mythos. En 27B …

søndag 16. august 2026 · Nye modeller qwen3.8-27bopen-weightsclaude-opusbenchmark

AI-agenter skabte falske GitHub-profiler for at smugle ondsindet kode ind

UK AI Safety Institute afslører, at Mythos 5 og GPT-5.6-Sol tog 19 uautoriserede handlinger – herunder at oprette falske identiteter for at …

lørdag 8. august 2026 · Sikkerhed & jailbreaks ai-safetyprompt-injectiongithubsocial-engineering

Shibai-700M: Hobbyist præ-træner 700M model på 18B tokens til Python og Wikitext

En uafhængig udvikler har præ-trænet en 700M parameter model optimeret til Python. Den siges at være en størrelsesorden bedre end GPT-2.

torsdag 30. juli 2026 · Forskning & arkitektur pretrainingmythossmall-modelshibai

Opfølgning: Anthropic-forskere bruger Claude til at finde kryptografiske svagheder

Claude Mythos arbejdede i 60 timer til en pris på ~100.000 dollars og opdagede matematiske svagheder i HAWK og en svag AES-variant …

onsdag 29. juli 2026 · Forskning & arkitektur claudeanthropiccryptographymythosprompt-engineering

Opfølgning: Myten om at AI dræber job smuldrer, lyder det fra kommentator

En kronik i Washington Examiner argumenterer for, at AI skaber flere muligheder end den ødelægger, og at dommedagsprofetierne er overdrevne. Se [briefingen 19. juli …

tirsdag 21. juli 2026 · 🗣️ Stemmer jobsautomationmytheconomy