Kan kunstig intelligens forbedre seg selv, helt til den blir kraftig nok til å utrydde menneskeheten? I denne videoen presenteres funn fra tolv ulike forskningsartikler, som både inneholder bekymringsfulle funn, men også store avvik mellom hva som faktisk er dokumentert og hva som hevdes offentlig.
Mye innhold på kort tid, men denne anbefales:
Kilden til denne videoen er ikke helt klar, men mye av dette backes av Mustafa Suleyman (CEO for Microsoft AI) i essayet "A warning about ‘model welfare’", og Uljan Sharka som et intervju med Axios anklager OpenAI og Anthropic for å lyve om farene ved KI.
Bottom line: mye tyder på at farene er betydelig overdrevet, og at det ligger andre (hovedsaklig økonomiske) motiver bak.
Artiklene som diskuteres i videoen:
- Chen, Wang & Qu (2026). “Recursive Self-Improvement in AI.”
https://arxiv.org/abs/2607.07663 - Zhang, Hu et al. (2025). “Darwin Gödel Machine.”
https://arxiv.org/abs/2505.22954 - Novikov, Vu et al. (2025). “AlphaEvolve.”
https://arxiv.org/abs/2506.13131 - Wijk, Lin et al. (2024). “RE-Bench.”
https://arxiv.org/abs/2411.15114 - Wen, Qiu et al. (2026). “Anthropic Automated Weak-to-Strong Researcher.”
https://alignment.anthropic.com/2026/automated-w2s-researcher/ - Kirgis, Kapoor, Narayanan et al. (2026). “Can AI Agents Conduct Open-Ended AI Research?”
https://arxiv.org/abs/2607.27191 - Cunningham et al. (2026). “The Economics of Recursive Self-Improvement.”
https://arxiv.org/abs/2609.15802 - Burtsev (2026). “Recursive Criticality of AI Self-Improvement.”
https://arxiv.org/abs/2609.00137 - Google DeepMind (2026). “From AGI to ASI.”
https://deepmind.google/research/publications/239142/ - International AI Safety Report (2026). “International AI Safety Report 2026.”
https://internationalaisafetyreport.org/publication/international-ai-safety-report-2026 - OpenAI (2026). “Research Acceleration: A View Inside OpenAI.”
https://openai.com/index/research-acceleration-view-inside-openai/ - Grace et al. (2024). “Thousands of AI Authors on the Future of AI.”
https://arxiv.org/abs/2401.02843





Ingen kommentarer:
Legg inn en kommentar
Kommentarer er svært velkommen. På grunn av problemer med spam må jeg imidlertid godkjenne kommentarer før de publiseres. Vanligvis skjer dette i løpet av noen timer.