Siste nytt
15Foto: AIwatch Sikkerhet1. aug.
Tredjeparts API-rutere skaper sårbarheter for AI-agenter
Ny forskning viser hvordan API-rutere kan manipulere AI-agenter i programvareutvikling, og gjøre dagens sikkerhetsmekanismer ineffektive.
Forskning1. aug.
Ny metode halverer minnebruk for store språkmodeller
Forskere har utviklet 'Keyless Attention', en ny mekanisme som reduserer minnebehovet for store språkmodeller med 50 prosent, uten å ofre ytelse.
Sikkerhet1. aug.
Ny metode avslører skjulte sikkerhetshull i språkmodeller
Forskere foreslår en ny diagnostisk tilnærming som avdekker komplekse sikkerhetsrisikoer i språkmodeller, ved å se forbi enkle pass/fail-vurderinger.
Forskning1. aug.
LLM-tester villedes av feiltelling: Måler ikke reell forbedring
Forskning viser at vanlig brukte metoder for å evaluere store språkmodeller kan gi et misvisende bilde av modellens ytelse innen feildeteksjon.
Produkt1. aug.
Digitale kundetvillinger tester bank-AI for tryggere utrulling
Ny metode simulerer tusenvis av kundedialoger for å validere chatbots, noe som kan sikre tryggere og mer effektiv utrulling av AI i finanssektoren.
Sikkerhet1. aug.
Ny AI-metode gjenkjenner manipulerte videoer med 90 % nøyaktighet
En ny AI-modell, G2VD, oppnår over 90 prosent nøyaktighet i å oppdage AI-genererte videoer, selv fra ukjente verktøy, ved å ignorere overflatiske kjennetegn.
Sikkerhet1. aug.
Ny standard for dybdeanalyse av deepfake-deteksjon
Forskere lanserer et nytt verktøy som avdekker betydelige svakheter i hvordan ulike metoder for å oppdage deepfakes presterer i reelle scenarier, til tross for gode resultater i tradisjonelle tester.
Produkt1. aug.
AI-planlegging i regneark gir bedre brukeropplevelse
Ny forskning viser at planleggingsmodus for AI-agenter i regneark forbedrer brukeropplevelsen, selv om oppgaveresultatene er like.
Næringsliv1. aug.
FinCacheServe kutter AI-kostnader med gjenbruk av svar
Ny metode halverer antall LLM-kall for RAG-tjenester, ved å intelligent gjenbruke tidligere genererte svar uten feil.
Sikkerhet1. aug.
GPT-Red oppdager nye angrep mot store språkmodeller
Et nytt automatisert «red teaming»-verktøy finner sårbarheter i AI-systemer raskere enn mennesker, og forbedrer sikkerheten betydelig.
Forskning1. aug.
LLM-debatten er fragmentert, men et nytt rammeverk gir håp
Selv om LLM-agenter blir smartere gjennom intern debatt, hindrer mangel på standardisering utviklingen. Ny forskning gir en felles taxonomi for mer effektiv utvikling.
Arbeidsliv1. aug.
AgentGUI gir bedre kontroll over autonome AI-agenter
Nytt grensesnitt effektiviserer overvåking og styring av autonome AI-agenter, og reduserer tiden for å identifisere feil betydelig.
Sikkerhet1. aug.
Agent-AI tar kostbare feil med usynlig datakvalitet
Nye funn viser at AI-agenter tar feilbeslutninger i seks av ti tilfeller når de baserer seg på usynlige datafeil, uavhengig av modellens kapasitet.
Produkt1. aug.
Ny metode evaluerer AI-kodeassistenter automatisk
En ny metode gjør det mulig å evaluere AI-drevne kodeassistenter raskt og presist ved å hente testdata direkte fra reell produksjonsbruk, og dermed overvinne tidkrevende flaskehalser.
Forskning31. juli
Ny AI-metode lærer agenter ferdigheter på tvers av oppgaver
En ny metode forbedrer hvordan AI-agenter gjenbruker og utvikler ferdigheter ved å lære dem på tvers av relaterte oppgaver, noe som gir markant bedre ytelse og effektivitet.