Close Menu
    Trending
    • Gemini introducerar funktionen schemalagda åtgärder i Gemini-appen
    • AIFF 2025 Runway’s tredje årliga AI Film Festival
    • AI-agenter kan nu hjälpa läkare fatta bättre beslut inom cancervård
    • Not Everything Needs Automation: 5 Practical AI Agents That Deliver Enterprise Value
    • Prescriptive Modeling Unpacked: A Complete Guide to Intervention With Bayesian Modeling.
    • 5 Crucial Tweaks That Will Make Your Charts Accessible to People with Visual Impairments
    • Why AI Projects Fail | Towards Data Science
    • The Role of Luck in Sports: Can We Measure It?
    ProfitlyAI
    • Home
    • Latest News
    • AI Technology
    • Latest AI Innovations
    • AI Tools & Technologies
    • Artificial Intelligence
    ProfitlyAI
    Home » Ny studie avslöjar att vissa LLM kan ge vilseledande förklaringar
    Latest AI Innovations

    Ny studie avslöjar att vissa LLM kan ge vilseledande förklaringar

    ProfitlyAIBy ProfitlyAIJune 6, 2025No Comments2 Mins Read
    Share Facebook Twitter Pinterest LinkedIn Tumblr Reddit Telegram Email
    Share
    Facebook Twitter LinkedIn Pinterest Email


    • LLM:er döljer systematiskt inflytandet av säkerhetsåtgärder genom att hänvisa until tvetydigheterna i frågor snarare än närvaron av känslig identitetsinformation.
    • Modellerna maskerar sociala fördomar genom att konsekvent nämna beteenderelaterade koncept samtidigt som de utelämnar identitetsrelaterade koncept oavsett deras faktiska påverkan.
    • Forskarna upptäckte att avancerade modeller som GPT-4o och Claude-3.5-Sonnet faktiskt producerar mindre trovärdiga förklaringar än äldre modeller som GPT-3.5

    Forskare från Microsoft och MIT har utvecklat en metod för att avgöra när AI-system ljuger eller ger vilseledande förklaringar. Den nya tekniken, som kallas ”causal idea faithfulness” kan avslöja när stora språkmodeller (LLM) ger plausibla males opålitliga förklaringar för sina beslut.

    Problemet med AI:s förklaringar

    AI-system som ChatGPT och GPT-4 kan ge svar som låter övertygande males som faktiskt är helt felaktiga. David Canter från Social Science Area beskriver hur Microsoft Copilot agerade som ”en lat scholar” och hittade på svar med uppenbar självförtroende trots att de var uppenbart felaktiga. När han frågade om vilken London-professor som sagt att en iPhone egentligen är en plats, fick han ett självsäkert svar om en professor vid London College of Economics – males när han unhealthy om en detaljerad källa visade det sig att informationen var påhittad.

    Forskningsresultat från tolv AI-modeller

    Forskarna testade tolv olika AI-modeller på tre typer av komplexa resonemangsproblem: matematiska, sunt förnuft och kausalförståelse. Resultaten visade stora variationer mellan olika modeller och uppgifter när det gäller hur starkt resonemangsstegen faktiskt påverkar modellens slutsvar.

    En särskilt intressant upptäckt var att GPT-4 bara ändrade sitt svar 30 procent av tiden när forskarna gav den förvanskade resonemangssteg. Det tyder på att modellen inte följer sin egen logik konsekvent.

    Mer information:

    https://openreview.net/forum?id=4ub9gpx9xw



    Source link

    Share. Facebook Twitter Pinterest LinkedIn Tumblr Email
    Previous ArticleElevenlabs nya V3 kan vara perfekt för audioböcker
    Next Article How I Automated My Machine Learning Workflow with Just 10 Lines of Python
    ProfitlyAI
    • Website

    Related Posts

    Latest AI Innovations

    Gemini introducerar funktionen schemalagda åtgärder i Gemini-appen

    June 7, 2025
    Latest AI Innovations

    AIFF 2025 Runway’s tredje årliga AI Film Festival

    June 7, 2025
    Latest AI Innovations

    AI-agenter kan nu hjälpa läkare fatta bättre beslut inom cancervård

    June 7, 2025
    Add A Comment
    Leave A Reply Cancel Reply

    Top Posts

    AudioX: En kraftfull ny AI som förvandlar allt till ljud

    April 16, 2025

    OpwnAI: AI That Can Save the Day or HACK it Away

    April 4, 2025

    Want Better Clusters? Try DeepType | Towards Data Science

    May 3, 2025

    What Statistics Can Tell Us About NBA Coaches

    May 22, 2025

    Dia en ny öppen källkods text till tal-modell

    April 24, 2025
    Categories
    • AI Technology
    • AI Tools & Technologies
    • Artificial Intelligence
    • Latest AI Innovations
    • Latest News
    Most Popular

    AI tool generates high-quality images faster than state-of-the-art approaches | MIT News

    April 4, 2025

    OpenAI lanserar globalt initiativ – vill samarbeta med regeringar om AI-infrastruktur

    May 8, 2025

    AI can do a better job of persuading people than we do

    May 19, 2025
    Our Picks

    Gemini introducerar funktionen schemalagda åtgärder i Gemini-appen

    June 7, 2025

    AIFF 2025 Runway’s tredje årliga AI Film Festival

    June 7, 2025

    AI-agenter kan nu hjälpa läkare fatta bättre beslut inom cancervård

    June 7, 2025
    Categories
    • AI Technology
    • AI Tools & Technologies
    • Artificial Intelligence
    • Latest AI Innovations
    • Latest News
    • Privacy Policy
    • Disclaimer
    • Terms and Conditions
    • About us
    • Contact us
    Copyright © 2025 ProfitlyAI All Rights Reserved.

    Type above and press Enter to search. Press Esc to cancel.