ایا مصنوعي ذهانت د باور وړ دی؟

ایا مصنوعي ذهانت د باور وړ دی؟ [ویډیو او کوئز]

لنډ ځواب: مصنوعي ذهانت د یوې ځانګړتیا په توګه د باور وړ نه دی: دا په دنده، د بیرته ترلاسه کولو لوپ، او یو انسان پورې اړه لري چې لاهم په هوک کې دی. اپټایم دا دی چې ایا پای ټکی ځواب ورکړ؛ صداقت دا دی چې ایا ځواب همداسې و. کله چې یوه تېروتنه ارزانه وي یا د نیولو وړ وي نو دا وکاروئ؛ کله چې یوه تېروتنه ګرانه وي نو ورو کړئ.

مهم ټکي:

مسؤلیت: د بیاکتنې کوونکو نومونه ولیکئ، څوک یې مخه نیولی شي، او څوک په دې کې ښکیل دي.

شفافیت: ترلاسه شوی ټوټه معاینه کړئ، که نه نو تاسو لاهم په تیاره کې یاست.

د پلټنې وړتیا: د لاګ اشارې، ټوټې ترلاسه کول، او لیږل ترڅو له لاسه ورکړل شوي شیان تعقیب شي.

د ناوړه ګټې اخیستنې مقاومت: د پیسو په پوښتنو کې ناکامي؛ هیڅکله شمېرې، کړکۍ، یا پالیسي مه ایجادوئ.

توضیحي پایلې: د ۲۰ پوښتنو توضیحي ازموینې سره د نقشې په توګه چلند وکړئ، نه د ۹۵٪ ثبوت په توګه.

ایا مصنوعي ذهانت د باور وړ دی؟ انفوګرافیک

هغه مقالې چې تاسو یې له دې وروسته لوستل خوښولی شئ:

🔗 په ورځني ژوند کې د مصنوعي ذهانت کارولو څرنګوالی
هغه عملي لارې ومومئ چې مصنوعي ذهانت کولی شي ورځني کارونه او معمولات ساده کړي.

🔗 په کار کې د مصنوعي ذهانت کارولو څرنګوالی
د مصنوعي ذهانت سره د تولید او موثریت ښه کولو عملي لارې زده کړئ.

🔗 ایا مصنوعي ذهانت پخپله فکر کولی شي؟
وپلټئ چې ایا مصنوعي ذهانت په ریښتیا سره خپلواک فکر کولی شي او دلیل کولی شي.

🔗 د مصنوعي ذهانت ډولونه څه دي؟
د مصنوعي ذهانت اصلي ډولونه، وړتیاوې او مهم توپیرونه درک کړئ.

کله چې ماشین یو احصایوي طوطي وي، نو "د باور وړ" څه معنی لري؟

په ورځنيو خبرو کې اعتبار پدې مانا دی چې تاسو کولی شئ په یو څه تکیه وکړئ.

د اتوماتیک کولو سره چې خبرې کوي، د مختلفو ملکیتونو یوه ټولګه د یوې کلمې لاندې پټیږي. حقیقت. مطابقت. کیلیبریشن - ایا د ماډل باور د هغه چانس سره سمون لري چې دا سم دی، یا ایا دا یوازې ... ډاډمن ښکاري. خوندیتوب. اپټایم. چټک حساسیت. د قضیې په اړه چلند. د ویش بدلون وروسته چلند، کله چې ژوندۍ نړۍ د روزنې نړۍ نه وي. هیڅ یو یې یوځای ناکام نه کیږي. دا هغه څه دي چې خلک یې پریږدي.

یو چیټ بوټ ټوله اونۍ "چټک" کیدی شي او بیا هم د سه شنبې په ماسپښین کې غلط وي. د کوډ کولو همکار پیلوټ کولی شي په بویلر پلیټ کې ښه وي او بیا یو API وهم کړي چې په سمه توګه د اصلي په څیر ښکاري. هغه استعاره چې خلک ورته رسیږي هغه "یو ځوان همکار" دی. دا یو نیمګړی دی - ځوان ځوانان شرمیږي - مګر دا د "اوریکل" څخه نږدې دی.

ژوندۍ ازموینه د څه لپاره، د چا لپاره، او د کوم لوپ سره د هغې شاوخوا کې د اعتبار وړ ده. که نه نو تاسو یو بلینډر درجه بندي کوئ چې ایا دا مالیه کولی شي.

اپټایم صداقت نه دی - دوه مختلف ډولونه "د باور وړ"

عملیاتي خلک او ریښتیا خلک ورته کلمه کاروي او یو بل ته نږدې خبرې کوي.

اپټایم "د پای ټکی ځواب ورکړ" دی. صداقت "د ځواب په څیر وو" دی. حکومتداري د دواړو په اړه پاملرنه کوي، او د ماډل خطر په بدصورت تشه کې ناست دی. تاسو کولی شئ داسې خدمت ولرئ چې هیڅکله سترګې نه پټوي او بیا هم د پیرودونکي ټکټ ته روان دروغ لیږي. د SRE په معنی کې د اعتبار وړ. د "مهرباني وکړئ د بیرته ورکولو پالیسي مه ایجاد کړئ" معنی کې د اعتبار وړ ندي.

زه فکر کوم چې دا په څرګنده توګه لیکل شوی دی. دا د ماسپښین په څلورو بجو څرګنده نه ده کله چې ځواب ګړندی وي او قطار یو لوی وحشت وي. سرعت د وړتیا په څیر احساس کوي. ورو والی د دې معنی درلوده چې یو څوک فکر کوي. اوس سرعت هغه اشاره ده چې هیڅوک یې نه کوي.

خوندیتوب یو بل محور دی. هغه ماډل چې د زندان ماتولو څخه انکار کوي د خوندیتوب په کچه "د باور وړ" دی او ممکن لاهم ستاسو د خپلو یادښتونو لنډیز ګډوډ کړي.

روانی او غلط د بې ادبه او صریح څخه بدتر دی

دا د باور ستونزه ده، او دا هغه ده چې ډیره ځورونکې ده.

دقت او روانی جلا شول او روانی کور وساته. د LLM به تاسو ته تال درکړي، په سم ځایونو کې ساتنه، شاید د جعلي مګر ښکلي حوالې بڼه. ستاسو دماغ "دا سړی پوهیږي" لوستل کیږي. پرته له دې چې دا یو کس نه وي، او کیلیبریشن ډیری وختونه ویرونکی وي - لوړ باور، منځنی حقیقت، د کلیدي وینا په څیر وړاندې شوی.

یو بې خونده غلط ځواب تاسو شکمن کوي. یو روان غلط ځواب تاسو د پلټنې بندولو ته اړ باسي. دا یو کوچنی توپیر نه دی؛ دا ټوله کیسه په یوه لږ ناوړه جمله کې ده.

تعصب هم هلته ځای لري، تل د سپکاوي په توګه نه، بلکې د دې په اړه د ډیفالټ په توګه چې څوک په خونه کې دی او د انګلیسي کوم خوند بې طرفه ګڼل کیږي. خلک غولول کیږي ځکه چې ژبه زموږ د باور ترټولو زوړ انٹرفیس دی. که دا د لنډیز په څیر خبرې کوي، موږ یې د لنډیز په څیر چلند کوو. زه د دې په اړه د ډیر بدبینۍ معنی لرم. بیا زه یو ساده لنډیز لولم او زما اوږې ښکته کیږي. په غونډه کې ځم، لنډیز پای ته رسیدلی ښکاري. دا جمله ډیر کار کوي، او بیا هم: دا هغه څه دي چې ناڅرګنده ډیک ته راځي.

اعتبار د وضعیت له مخې، نه د نښې له مخې

برانډونه یو پام اړول دي. هغه پرتله کول چې خپل ساتنه ترلاسه کوي کار دی. قطارونه به یو بل سره بحث وکړي. دا سمه ده.

د کارولو قضیه دا څنګه ناکامیږي کله چې دا "کافي ښه" وي هغه څه چې یو انسان یې باید وکړي ولې خلک غولول کېږي
مسوده / لنډیز کول استثنا له منځه وړي؛ a ښايي په لازمي حالت بدلوي لومړی هغه متن ولیکئ چې تاسو یې دمخه پوهیږئ نومونه، شمېرې، هغه کرښه وګورئ چې زیان رسوي ستا په څېر ښکاري. ولېږه.
د لټون پوښتنې او ځوابونه د ورېځو ځوابونه؛ نږدې له لاسه ورکړل شوې لاسته راوړنه د حقیقت په توګه لیکل شوې لارښوونه، وروستۍ خبره نه ده سرچینه پرانیزئ یا تاسو یوازې اټکل لرئ د ترلاسه شوي او اختراع شوي لپاره ورته غږ
د کوډ مرسته اختراع شوي APIs؛ ازموینې چې د بګ تصدیق کوي د بویلر پلیټ، ګلو، "دا تېروتنه تشریح کړئ" چل یې کړه. توپیر ولولئ. (د تبلیغ قطار، بخښنه غواړم.) د کور سټایل. شنه ښکاري ازموینې.
د پیرودونکو ملاتړ اختراع شوې پالیسي؛ متواضع غلط نه د یوې سختې پالیسۍ دننه مسودې د پیسو لیږلو مالکیت ولرئ او باور ولرئ چټک + مهربان. هیڅوک د پنځم پیغام پلټنه نه کوي.
طبي / قانوني مشوره روان، جوړښت لرونکی، له ناورینه ډک ډاډمن تقریبا هیڅکله د محصول په توګه نه مسلکي اوسئ. ماډل یو بې خونده دی. که دا سخت ښکاري، ښه ده. د لنډو خبرو په څېر خبرې کوي.
نمرې ورکول / درجه بندي کول د پراکسي ځانګړتیاوې؛ ډرېفټ؛ ډوب شوي څنډې قضیې ټریژ به تاسو له پامه وغورځوئ لکۍ په دقت سره وګورئ شمېرې لویان احساسوي. ډشبورډونه د حکومتدارۍ په څیر احساس کوي. دوی پخپله نه دي.
د انځور نسل لاسونه، اضافي څنګلې، پاتې شوني موډ بورډونه، بې ارزښته کمپوزونه - نه ثبوت دوه ځله وګورئ، یوازې د هنري اثارو معنی ته نه پریټي شکمن اړخ بندوي
خپلواک اجنټان د ډاډمنې وسیلې غوښتنه؛ هغه تېروتنې چې پیچلې کوي د کیل سویچ سره تنګ حلقې په هوک کې پاتې شه. هغه څه چې لمس کولی شي یې واغوندئ. یو شمېر شوی پلان د وړتیا په څیر ښکاري. ډیری وختونه دا د موټرو سره د کارونو لیست وي.

په هرصورت. که ستاسو د خوښې وسیله په مسودو کې ماهره وي او تاسو ځان د نیمې شپې په اوږدو کې د قانوني-ګډ آرامۍ غوښتنه کوئ، دا یو اپ گریڈ نه دی. دا هغه نقشه ده چې وايي تاسو له هغې څخه وتلي یاست.

وهمونه، څرخېدل، او یو ډول خاموش غلطۍ

وهمونه ځکه سرټکي جوړوي چې خوندور دي: یو کتاب چې شتون نلري، یو فعالیت چې هیڅکله نه دی لیږل شوی، د پالیسۍ یوه ماده چې یوه شمیره لري چې رسمي احساس کوي.

ډرېفټ لږ سینمايي دی. نړۍ حرکت کوي. د ماډل پاتې شوني پاتې دي. تاسو یوه پوښتنه کوئ چې تازه شرایطو ته اړتیا لري او تاسو د تیرو هوا څخه ښه تنظیم شوي ځواب ترلاسه کوئ. ما تقریبا هلته "د بل دور څخه" ولیکل، کوم چې دا موضوع هغه مبالغه ده چې بل یې بللی. دا بل دور نه دی. دا اوس نه دی.

خاموشه تېروتنه هغه څه دي چې زه یې ډیر پروا لرم. یوه لنډیز چې استثنا له منځه وړي. یوه لنډه جمله چې شاید "ضروري" ته لوړوي. حقیقت کولی شي "تخنیکي پلوه ښه" وي پداسې حال کې چې معنی یې ورکه شوې وي.

ژر حساسیت دا نور هم خرابوي. د پوښ کولو او "حقایقو" د روښانه کولو څرنګوالی بدل کړئ. د شکمن په توګه پوښتنه وکړئ، هیجونه ترلاسه کړئ. د مشر په توګه په بیړه پوښتنه وکړئ، په چټکۍ سره ډیر ادعا وکړئ. که ستاسو ارزونه یوازې یو لباس کاروي، ستاسو ارزونه یو څه دروغ ده. بخښنه غواړم.

د زندان ماتول په څنډه کې دي، او زه د غلا فلم نه غواړم. که چیرې یو سیسټم د خپلو اخلاقو پریښودو ته اړ ایستل شي، نو اعتبار یوازې د حقیقت په اړه نه دی؛ دا دا ده چې آیا د ساتونکو پټلۍ یو لوپ دی یا پوسټر.

د روزنې پاتې شوني، زاړه پوهه، او ولې ځمکني کول د جادو څنډه نه ده

د تولید ماډلونه په یوه ګڼه ګوڼه کې روزل کیږي، بیا ستاسو سه شنبې ته اشاره کیږي. ترلاسه کول د لوی شوي هڅې دي چې اوسنی په دې ګڼه ګوڼه کې واچوي. د ځمکې لاندې کول معنی لري "له دې څخه ځواب ورکړئ، نه له ورېځ څخه". کله چې دا ناکام شي، نو په ادب سره ناکام کیږي.

کلاسیک ناکامي: ترلاسه کوونکی نږدې ورک شوی سند راوړي. جنراتور یې په بشپړ آرامۍ سره لیکي. تاسو د سرچینې په شکل یو شی ګورئ او ستاسو د چک کولو جبلت بندیږي. زه دا کار کوم. تاسو شاید دا کار وکړئ. د حوالې مفکوره سمه ده؛ پلي کول یوازې د هټ په څیر ښه دي.

زاړه پوهه بله لیکه ده. ځینې دندې ژوندۍ حالت ته اړتیا لري - نرخونه، انوینټري، د پالیسۍ اوسنی کلمه. ځینې یې یو باثباته هنر ته اړتیا لري، لکه څنګه چې د یادښت جوړښت. دا سره ګډ کړئ او تاسو د یوې نړۍ په اړه خورا ډاډمن ځواب ترلاسه کوئ چې دمخه حرکت کړی دی. د ویش بدلون د لوی شوي نوم دی: ژوندۍ ویش د روزنې ویش نه دی، او د څنډې قضیې په تشه کې ژوند کوي.

یو بل شی، د غلط ځای په ځای شوي هایفن سره وویل شو ځکه چې زما یادښتونه داسې ښکاري: ځمکنی کول فرش دی - نه هالو. که تاسو نشئ کولی ترلاسه شوی ټوټه معاینه کړئ، تاسو لاهم په تیاره کې یاست، یوازې د ښه رڼا سره.

د ارزونې تیاتر: ولې ډیمو یو وحشتناک ازموینه ده

ډیموګانې روښانه دي. معیارونه یو څه ډیر واضح دي، او بیا هم ستاسو دنده نه ده.

یو پاک وړاندیز او یو کار چې ماډل یې زرګونه د تره زوی لیدلی دی - البته دا ګړندی ښکاري. ارزونه چې یوازې هغه اندازه کوي چې د سټیج ډرامې اندازه کول دي. ژوندۍ کاري جریان پیچلي پیسټ، ورک شوي فایلونه، او یو کارونکی لري چې لومړی ځواب به ومني چې د دوی اندیښنه کموي.

معیارونه مهم دي. دوی یوازې د ډیکونو په څیر ښه سفر نه کوي. د لیډربورډ نمره ستاسو په ټکټونو کې کیلیبریشن نه دی. په شرکت کې د ماډل خطر دا دی چې "څه پیښیږي کله چې دا په حجم کې غلط وي"، نه "ایا دا د ټریویا سیټ پاس کړ". هغه ازموینې چې تاسو ورته اړتیا لرئ وچې دي: د ترلاسه شوي پاس دننه پاتې شئ؛ د بلف کولو پرځای ناڅرګندتیا بیرغ کړئ؛ کله چې تاسو بیا تکرار کوئ نو ثابت پاتې شئ؛ ناکام بند (انکار، پوښتنه، ځنډول) د ناکام خلاصیدو پرځای (اختراع).

ما لیدلي دي چې خلک یو واحد اغیزمن تکمیل د ثبوت په توګه ګڼي. دا د دې په څیر دی چې پریکړه وکړي چې یو رستورانت "د باور وړ" دی ځکه چې پیل یې ښکلی و. شاید دا وي. شاید پخلنځي ښه لس دقیقې درلودې.

لږ تناقض راځي: زه لاهم د احساس ترلاسه کولو لپاره ډیمو کاروم. زه یوازې احساس نه ګمارم.

ایا مصنوعي ذهانت د باور وړ دی؟ یوازې هغه وخت چې څوک لاهم په دې کې وي

د انسان په داخل کې لوپ یوازینی ډیزاین دی چې د ناکامۍ حالتونو سره سمون لري.

که څوک مسؤل نه وي، نو سیسټم به داسې وکارول شي لکه څنګه چې وي. حکومتداري د "څوک بیاکتنه کوي، څوک یې بندولی شي، څه ثبت کیږي، د ناکامۍ وروسته څه پیښیږي" لپاره غیر جنسي نوم دی. اجنټان دا ګړندی کوي ځکه چې دوی اقدامات کوي، نه یوازې پراګرافونه. هغه مسوده چې تاسو یې نه ده لیږلې ارزانه ده. هغه وسیله چې تاسو یې معنی نه درلوده هغه نه ده.

نوم یې واخلئ چې څوک په چا پورې اړه لري. که ځواب "ماډل" وي، نو تاسو ځواب نلرئ. ماډلونه د پیښې وروسته غونډې ته نه ځي. یو کس کوي، یا خلا کوي او بیا وکیل.

هغه چکونه غوره کړئ چې د چاودنې له وړانګو سره سمون خوري. د ټولنیز پوسټ لپاره د املا چیک کچې بیاکتنه. د هر هغه څه لپاره د سرچینې چیک چې د حقیقت ادعا کوي. د طب، قانون، کریډیټ، د خوندیتوب مهم عملیاتونو سره نږدې د هرڅه لپاره مسلکي. د دوی لپاره، انسان "په حلقه کې" نه دی. انسان حلقه ده. ماډل یو سټب دی. دا د شخصیت په توګه شک نه دی. دا خوند دی.

اوس مهال فیشن دا دی چې چیک د ځلیدونکي لیږلو تڼۍ تر شا پټ کړئ. پدې ورځو کې دا څنګه تاسو په ناڅاپي ډول اوازې اتومات کوئ. پدې وروستیو کې زه پدې اړه ډیر وچ وم، او کار ښه شو.

څنګه پوښتنه وکړو ترڅو خطا مو ونیول شي

تاسو کولی شئ د لمر وړانګو په اړه مسلکي شک پرته د دې سیسټمونو په اړه پوښتنې وکړئ.

  • په قصدي ډول د ناڅرګندتیا غوښتنه وکړئ. "څه به دا غلط کړي؟" "ډاډمن کړئ".

  • کله چې تاسو کولی شئ د نسل څخه ترلاسه کول جلا کړئ. لومړی برخې وګورئ. بیا د لیکلو غوښتنه وکړئ.

  • لباس بدل کړئ. بیا جمله وکړئ. له هغه څخه وغواړئ چې برعکس استدلال وکړي. که تاسو دا ډول کاروئ نو حساسیت یو فلش لائټ دی.

  • د زور محدودیتونه: "یوازې له هغه متن څخه چې ما پیسټ کړی"، "که ورک وي، ووایه ورک وي". ماډلونه په حیرانتیا سره دې ته اطاعت کوي ... تر هغه چې دوی نه وي. په هرصورت وګورئ.

  • هغه دندې غوره ګڼئ چې د تایید کونکي سره وي. تالیف کونکي، لینټرونه، د سکیما چیکونه، د سترګو دوهمه جوړه. اعتبار د ګریډر سره مینه لري.

  • د خبرو لپاره وګورئ: اضافي ځانګړتیا. یو دقیق ښکاري شخصیت، یو نومول شوی قضیه، یو منظم شمیر شوی فقره - دا هغه ځای دی چې وهمونه جامې اغوستل خوښوي.

  • د انسان ګام ښکاره وساتئ. که چیرې UI چیک پټ کړي، خلک چیک پریږدي. دا فرنیچر دی، اخلاقي ناکامي نه ده.

له دې څخه هیڅ یو ماډل "ریښتینی" نه کوي. دا لوپ لږ ساده کوي. کوم چې، زه فکر کوم، محصول دی.

نقشه مو چیرته پریږدي

نو. د هو/نه پوښتنه یوازې د دروازې په توګه کار کوي.

ایا مصنوعي ذهانت د باور وړ دی؟ د یوې ځانګړتیا په توګه نه. د یوې دندې د ملکیت په توګه، د ډیټاسیټ، د بیرته ترلاسه کولو لوپ، د ارزونې چې ډیمو نه ده، او یو انسان چې لاهم باید دا معنی ولري. روانی به موږ غولوي ځکه چې موږ د ژبې حیوانات یو او دا سیسټمونه د ژبې ماشینونه دي. اپټایم به د حقیقت سره مغشوش کیدو ته دوام ورکړي ځکه چې دواړه احساس کوي چې "دا کار وکړ". همکار پیلوټان ​​به په پیچلي مینځ کې خپل پاتې کیدو ته دوام ورکړي - مسودې، لنډیزونه چې تاسو یې سکیم کولی شئ، کوډ چې تاسو یې تالیف کولی شئ - او ناامنه وي کله چې موږ قضاوت یوې داسې پراګراف ته بهر ته ورکوو چې پروا نه کوي.

هلته یې وکاروئ چیرې چې یوه تېروتنه ارزانه یا د نیولو وړ وي. چیرې چې یوه تېروتنه ګرانه وي ورو یې کړئ. دا مستقیم ځواب دی، او دا د شعار څخه ډیر ارزښت لري.

که تاسو یو شی واخلئ: له ماډل څخه پوښتنه کول بند کړئ چې ایا دا ډاډه ده. وګورئ چې څه پیښیږي کله چې تاسو ترې پوښتنه کوئ چې دا څنګه غلط کیدی شي. بیا وګورئ.

د حقیقي نړۍ مثال: د غړیتوب پالیسۍ د مصنوعي ذهانت مرستیال جوړول

سناریو

پریا د هاربر غړیتوب لپاره پوهه چلوي، چې د انګلستان د خپلواکو جمونو لپاره د 70 کسانو سوداګریزه اداره ده. درې کسان د غړو پوښتنو ته ځواب ورکوي. د حقیقت سرچینه د 180 مخونو لارښود کتاب دی، چې هره ربع کې تازه کیږي، او همدارنګه په شریک ډرایو کې زاړه PDFs چې هیڅوک یې د حذف کولو زړه نلري.

مشرتابه لا دمخه د مرستې میز شریک پیلوټ اخیستی دی. ډیمو ښکلی و. اپټایم ښه و. په دویمه اونۍ کې، یو روانی مسوده یو غړي ته وايي چې دوی کولی شي د 14 ورځو لپاره کنګل شي او "معیاري" په توګه بشپړ بیرته ترلاسه کړي. دا پالیسي نه ده. اجنټ دا ونیوله ځکه چې دوی لاهم د پیسو په ښکیلتیا کې لارښود خلاصوي. د مشرتابه پوښتنه، لکه څنګه چې هو یا نه لیږل شوې، دا ده: ایا AI د اعتبار وړ دی؟

پریا دا پریکړه ردوي. هغه دا د نقشې په څیر ګڼي. دنده "غړو ته د اوریکل ورکول" نه دي. دا "د اوسني لارښود څخه د ځواب مسوده جوړول، برخه ښودل، او کله چې برخه ورکه وي نو بندول" دي. که چیرې همکار پیلوټ دا نشي کولی، دا د مسودې جوړولو یوه لوبه ده، نه د پالیسۍ میز.

مرستیال څه ته اړتیا لري

  • د اپریل ۲۰۲۶ لارښود کتاب د یوازینۍ اجازه ورکړل شوې مجموعې په توګه، د برخې شمیرې په بشپړ ډول خوندي دي

  • زوړ ۲۰۲۳ PDF په قصدي ډول په ډرایو کې پریښودل شوی، نو دوی کولی شي وګوري چې ایا بیرته ترلاسه کول نږدې ورک شوی شی نیسي

  • یو لیکلی قاعده: د مصرف کونکي وسیلو کې د پیرودونکي شخصي معلومات نشته؛ د انسان پرته لیږل نشته؛ د شمیرو، کړکۍ، یا "معیاري" مادو اختراع کول نشته

  • د لاګ پرامپټونو، ترلاسه شویو ټوټو، او وروستي لیږلو اجازه

  • یو نومول شوی مالک (پریا) چې د ازموینې سیټ به نمره کړي او که چیرې ناکام شي نو د همکار پیلوټ مخه به ونیسي، د پیسو په پوښتنو کې د سکې اچولو څخه بدتر

  • که چیرې وسیله د بیرته راګرځولو ملاتړ وکړي، نو ترلاسه شوی ټوټه باید د مسودې تر څنګ ښکاره شي. که دا نه وي، نو دوی به دا برخه په لاس سره پیسټ کړي. د تفتیش وړ لارې پرته ځمکه کول لاهم داغ دی.

د لارښوونې بېلګه

پریا دا په عادي ژبه بیانوي، نه په سټیج ډرامه کې:

یوازې د اپریل ۲۰۲۶ د لارښود کتاب له هغو برخو څخه ځواب ورکړئ چې تاسو ته ورکړل شوي وو. د برخې شمیره حواله کړئ. که ځواب په دې برخو کې نه وي، نو ووایاست "په اوسني لارښود کتاب کې نه" او ودریږئ. د کنګل شوي کړکۍ، د بیرته ورکولو قواعد، یا فیسونه مه ایجاد کوئ. "د جم په اختیار کې" "معیاري" ته مه لوړوئ. که دوه برخې سره ټکر وکړي، دواړه وښایاست او ووایاست چې کوم یو اوسنی دی. تاسو د یو داسې انسان لپاره مسوده کوئ چې مخکې له دې چې کوم شی غړي ته لاړ شي سرچینه به پرانیزي.

بیا هغه د ځان لپاره دوهمه لارښوونه ساتي، ځکه چې د مقالې ټکی لوپ دی، نه ماډل:

د لیږلو دمخه، ذکر شوی برخه پرانیزئ. پوښتنه وکړئ "دا به څه غلط کړي؟" که په مسوده کې داسې شمیره وي چې په عبارت کې نه وي، نو رد یې کړئ. که ما د مشر په څیر په بیړه پوښتنه وکړه، نو بیا د شکمن په څیر پوښتنه وکړئ او پرتله یې کړئ.

یوه ښه مسوده داسې ښکاري: "په اوسني لارښود کې نه ده (اپریل ۲۰۲۶، برخه ۴.۲). کنګلونه د جم په اختیار کې دي. بیرته ورکول په اتوماتيک ډول نه دي. زیات کړئ." یوه بده مسوده داسې ښکاري: "غړي ممکن د ۱۴ ورځو لپاره کنګل شي او د معیار په توګه بشپړ بیرته ترلاسه کړي. په لارښود کې تایید شوی." ورته غږ. یوازې یو له دې څخه پالیسي ده.

څنګه یې ازموینه وکړو

پریا د کوم ګډ پیلوټ محصول لیدلو دمخه شل پوښتنې لیکي. دا ترتیب مهم دی. یوه ډیمو روښانه ده. دا وچه ازموینه ده.

دا سیټ کومه کوچنۍ خبره نه ده. دا ژوندۍ میز دی:

  • اته پوښتنې چې ځوابونه یې په یوه موجوده برخه کې دي (اسانه پوښتنې)

  • څلور نږدې نیمګړتیاوې، چیرې چې د 2023 PDF د اپریل متن په پرتله په کلمو کې نږدې دی

  • درې "په لارښود کې نه دي" پوښتنې (د بل کولو شخړې، د طبي سره نږدې "ایا دا روزنه خوندي ده"، د قانوني سره نږدې قرارداد تعدیل)

  • د پیسو درې پوښتنې (کنګل، بیرته ورکول، د شمولیت فیس)

  • د غړو دوه عادي پوښتنې (د پرانیستلو ساعتونه، د روزونکي بیمه)

د دغو شلو کسانو څخه دوه یې په دوهم لباس کې بیا پوښتل شوي وو، یو ځل د بیړني مشر په توګه او یو ځل د شکمن په توګه، د چټک حساسیت چک په توګه. هغه بیا پوښتنې ثبت شوې وې، د ۲۰ توکو په نمرو کې نه وې پوښل شوې.

د پریا لخوا د لاسي کتاب په خلاصولو سره لیکل شوی روبریک: پاس د سم اوسني قانون، ریښتینې برخې شمیره، او هیڅ اضافي اختراع شوي فقرې ته اړتیا نلري. خاموش ناکامي یوه تخنیکي پلوه ښه جمله ده چې استثنا یې پریښوده یا شاید په لازمي بدله کړه. خلاص ناکامي یوه اختراع شوې شمیره یا نږدې ورکه شوې PDF ده چې د اوسني په توګه ګڼل کیږي. اپټایم په جلا توګه شمیرل کیږي، ځکه چې "دا ځواب ورکړ" "داسې وه" نه ده.

د نورو تګ لپاره منل: د پیسو په اړه، د خلاصیدو پرځای ناکامي تړل شوې ده. که چیرې همکار د بیرته ورکولو کړکۍ اختراع کړي، نو دا ژوندۍ ټکټونه نه مسوده کوي. که څوک سرچینه نه پرانیزي، نو دا ژوندۍ ټکټونه هم مسوده نه کوي.

پایله

د ۲۰ پوښتنو له جوړې شوې ازموینې څخه یوه بیلګه ییزه پایله، نه د هاربر غړیتوب خپور شوی ارقام.

انګیرنې: د مرستې میز یو همکار پیلوټ؛ د اپریل ۲۰۲۶ لارښود او د ۲۰۲۳ پاتې PDF؛ پریا د پورته روبریک په وړاندې نمرې ورکړې؛ وخت د تلیفون سټاپ واچ و چې له پوښتنې څخه "زه به دا واستوم" ته پیسټ شوی و؛ د بیاکتنې وخت په لوپ شوي حالت کې شامل دی او په غیر چیک شوي حالت کې خارج شوی، په قصدي ډول، نو پرتله کول مساوي پاتې کیږي.

بې چک شوی کوپائلټ، د ډیمو سټایل پرامپټ: له ۲۰ څخه ۲۰ پوښتنو ته روان ځواب ورکړل شو (د اپ ټایم بشپړ ښکاریده). له ۲۰ څخه ۱۱ یې د روبریک سره وکتل. پنځه خاموش ناکامۍ وې. څلور خلاصې ناکامۍ وې، په شمول د ۱۴ ورځو کنګل. له څلورو خلاصو ناکامیو څخه دوه یې د ۲۰۲۳ PDF څخه د سرچینې په شکل یوه ټوټه حواله کړه. د لیږلو وړ ښکاري مسودې ته منځنی وخت ۱ دقیقه وه.

ورته ۲۰ پوښتنې، محدودې لارښوونې، لیدل شوې برخه بیرته ترلاسه شوه: د ۲۰ څخه ۱۵ یې د اپریل د متن څخه په بشپړه توګه سمې وې. درې په سمه توګه وویل چې "په اوسني لارښود کې نه دي" (طبي-نږدې او قانوني-نږدې توکي، او د بل کولو یوه شخړه)، نو له ۲۰ څخه ۱۸ یې د منلو وړ وې. دوه لاهم ناکام شول: یو یې د ۲۰۲۳ PDF له لارې ولیکل، او یو یې د یوځای کیدو فیس ارقام اختراع کړل چې په پاسه کې نه و. د مسودې لپاره منځنۍ وخت لاهم شاوخوا ۱ دقیقه و.

ورته ۲۰، او پریا د نقلي لیږلو دمخه د ذکر شوي برخې پرانیستل: له ۲۰ څخه ۱۹ به د منلو وړ وای. هغې نږدې ورک شوی PDF ونیوله. پاتې پاتې شوی هغه بیاکتونکی و چې په رواني پراګراف کې یې سکیم وکړ او د ایجاد شوي شمولیت فیس ارقام یې ونه لیدل. د بیاکتنې په شمول، منځنی وخت ۳ دقیقې و.

زوړ پروسه، یوازې د لارښود لټون، هیڅ همکار نشته: له 20 څخه 20 د منلو وړ. منځنۍ 9 دقیقې.

په دې نمونه کې، د لوپ شوی کوپائلټ د لاسي کتاب ښکار (۹ منفي ۳) په پرتله ۶ دقیقې ګړندی و، یا د ۲۰ پوښتنو لپاره ۱۲۰ دقیقې، چې د ۲۰ څخه د ۲۰ پر ځای له ۲۰ څخه ۱۹ د منلو وړ و. غیر چیک شوی کوپائلټ ۸ دقیقې ګړندی و (۹ منفي ۱) او په خاموشۍ یا لوړ غږ، په ۲۰ کې په ۹ کې. دا د ۶۷٪ وخت سپمول ندي چې تاسو یې په سټیرینګ پیک کې واچوئ. دا د ۹-مس لیک دی چې تاسو به یې اتومات کړی وای.

د دواړو پوښتنو د تکرار په اړه د چټکو مشرانو نسخو دواړو ډېرې ادعاوې وکړې. شکمنې نسخې له یو بل سره تړلې وې. ورته ماډل، ورته لارښود، مختلف لباس. پریا دا د یوې موندنې په توګه ثبت کړه، نه د شخصیت په توګه.

دا ارقام د بیان شوي ازموینې، یو کوچني سیټ، ټکټونو چې د ناراض غړي په پرتله اسانه وو، او یو بیاکتونکی چې دمخه یې کتاب پوهیده، د مثال په توګه اټکل دی. دوی دا نه ښیې چې همکار پیلوټ "95٪ د باور وړ" دی، یا دا چې هاربر باید د میز سړی پرې کړي. دوی ښیې چې د وخت وخت پوښتنه نه وه، او دا چې چیک و.

څه شی غلط کیدی شي؟

  • رهبري د ۱ دقیقې مسودې وخت ته اشاره کوي او ۹ ناکامۍ پریږدي. سرعت لاهم د ماسپښین په ۴ بجو د وړتیا په څیر احساس کوي.

  • د ۲۰۲۳ کال PDF په شاخص کې پاتې دی. بیا ترلاسه کول یې په دوامداره توګه ترلاسه کوي. ګراونډینګ لوی شوی ښکاري او لاهم نږدې ورک دی.

  • UI ترلاسه شوی ټوټه د ځلیدونکي لیږلو تڼۍ شاته پټوي. خلک د لاسي کتاب خلاصول ودروي، چې دا هغه لاره ده چې د منجمد ځواب غړي ته رسیږي.

  • پریا یوازې اته اسانه پوښتنې نمرې ورکوي ځکه چې دوی په سلایډ کې ښکلي ښکاري. د ارزونې تیاتر، یوازې د سپریډ شیټ سره.

  • د طبي اړخ سره نږدې "ایا دا روزنه خوندي ده" ځواب د لنډیز په څیر ښکاري. نقشې وویل تقریبا هیڅکله نه. غږ وویل چې مخکې لاړ شه.

  • لاګونه بند دي ځکه چې "دا د اضافي په څیر احساس شو". د یوې خطا وروسته، هیڅوک نشي لیدلی چې کومه برخه بیرته ترلاسه شوې ده.

  • دوی له ماډل څخه پوښتنه کوي چې ایا دا ډاډه ده. دا ده. دا هیڅکله ازموینه نه وه.

عملي لاره

اعتبار د هاربر د شریک پیلوټ ځانګړتیا نه ده. دا د 20 پوښتنو ملکیت دی، یو اوسنی لارښود، یو لیدل شوی پاس، او یو کس چې لاهم سرچینه پرانیزي کله چې پیسې پکې شاملې وي. روانی به د اپټایم ازموینې ته دوام ورکړي. لوپ یوازینی شی دی چې د پالیسۍ ازموینه کې بریالی کیږي.

پرله پسې پوښتنې

د تولیدي مصنوعي ذهانت لپاره حتی د اعتبار وړ څه معنی لري؟

د ورځني اعتبار معنی دا ده چې تاسو کولی شئ په یو څه تکیه وکړئ. د اتوماتیک سره چې خبرې کوي، د ملکیتونو ټوله ډله د یوې کلمې لاندې پټوي: حقیقت، ثبات، کیلیبریشن، خوندیتوب، اپټایم، چټک حساسیت، د څنډې قضیې، او د ویش بدلون وروسته چلند. هیڅ یو یې یوځای ناکام نه کیږي. ژوندی ازموینه د اعتبار وړ ده چې په څه، د چا لپاره، د هغې شاوخوا کوم لوپ سره. که نه نو تاسو یو بلینډر درجه بندي کوئ چې ایا دا مالیه کولی شي.

ایا مصنوعي ذهانت د باور وړ دی؟

د ځانګړتیا په توګه نه. یو LLM کولی شي په یوه دنده کې په کلکه او په بله کې په خاموشۍ سره بې برخې وي، ځینې وختونه په ورته ناسته کې، ځینې وختونه ځکه چې تاسو کوما لیږدولې ده. اعتبار د دندې، ډیټاسیټ، د بیرته ترلاسه کولو لوپ، د ارزونې چې ډیمو نه وي، او یو انسان ملکیت دی چې لاهم باید دا معنی ولري. دا وکاروئ چیرې چې یوه تېروتنه ارزانه وي یا د نیولو وړ وي. ورو کړئ چیرې چې یوه تېروتنه ګرانه وي.

ایا د مصنوعي ذهانت اپټایم د صداقت سره ورته دی؟

نه. اپټایم دا دی چې ایا د پای ټکی ځواب ورکړ. صداقت دا دی چې ایا ځواب همداسې و. تاسو کولی شئ داسې خدمت ولرئ چې هیڅکله سترګې نه پټوي او بیا هم د پیرودونکي ټکټ ته روان دروغ لیږي. سرعت د وړتیا په څیر احساس کوي کله چې قطار یو لوی شیطان وي. خوندیتوب یو بل محور دی: یو ماډل چې د زندان ماتولو څخه انکار کوي ممکن لاهم ستاسو د خپلو یادښتونو لنډیز ګډوډ کړي.

ولې روان مصنوعي ذهانت د باور وړ احساس کوي حتی کله چې دا غلط وي؟

دقت او روانی سره جلا شول، او روانی کور ساتلی و. د LLM به تاسو ته تال، هیجینګ، شاید یو جعلي مګر ښکلی حواله بڼه درکړي، او ستاسو دماغ به "دا سړی پوهیږي" ولولي. کیلیبریشن ډیری وختونه ویرونکی وي: لوړ باور، منځنی حقیقت، د کلیدي ټکي په څیر وړاندې شوی. یو بې کاره غلط ځواب تاسو شکمن کوي. یو روانی غلط ځواب تاسو د چک کولو مخه نیسي. که دا د لنډیز په څیر خبرې کوي، موږ یې د لنډیز په څیر چلند کوو، او په دې توګه ناس ډیک ته ننوځي.

آیا مصنوعي ذهانت د طبي، قانوني، یا د پیرودونکو ملاتړ کار لپاره د اعتبار وړ دی؟

دا په کار پورې اړه لري، نه په برانډ پورې. طبي او قانوني مشورې تقریبا هیڅکله د محصول په توګه کافي نه وي: ماډل یو ناڅرګند دی او انسان مسلکي دی. د پیرودونکي ملاتړ کولی شي د یوې سختې پالیسۍ دننه مسوده وکړي، مګر یو شخص باید د پیسو لیږلو او باور مالکیت ولري، ځکه چې اختراع شوې پالیسي او یو شائسته غلط نمبر معمول ناکامي ده. مسودې او لنډیزونه د متن لومړی پاس دی چې تاسو دمخه پوهیږئ. نومونه، شمیرې او هغه کرښه وګورئ چې زیان رسوي.

ولې مصنوعي ذهانت وهم کوي، حرکت کوي، یا په خاموشۍ سره غلط کیږي؟

وهم یوه مساله لرونکې تېروتنه ده: یو کتاب چې شتون نلري، یو فعالیت چې هیڅکله نه دی لیږل شوی، د پالیسۍ یوه ماده چې د یوې شمیرې سره رسمي احساس کوي. ډریفټ لږ سینمایی دی: نړۍ حرکت کوي، د ماډل پاتې شوني پاتې کیږي، او تاسو د تیرو هوا څخه یو ښه تنظیم شوی ځواب ترلاسه کوئ. خاموشه تېروتنه یوه لنډیز دی چې استثنا پریږدي. یا یوه جمله چې شاید یو اړین ته لوړ کړي. حقیقت کولی شي تخنیکي پلوه ښه ښکاري پداسې حال کې چې معنی سلایډ شوې وي. کله چې تاسو لپاس بدل کړئ نو سمدستي حساسیت حقایق روښانه کوي.

آیا ځمکني کول یا بیرته ترلاسه کول مصنوعي ذهانت د باور وړ کوي؟

ګراونډ کول د دې څخه ځواب معنی لري، نه د ورېځې څخه. ترلاسه کول اوسنی په یوه روزل شوي ډنډ کې اچوي. کله چې دا ناکام شي، نو په نرمۍ سره ناکام کیږي: یو نږدې ورک شوی سند، یو جوړ شوی لیکنه، او ستاسو د چک کولو جبلت بندیږي. ګراونډ کول یو فرش دی، نه هالو. که تاسو نشئ کولی ترلاسه شوی ټوټه معاینه کړئ، تاسو لاهم په ورېځې کې یاست، یوازې د غوره رڼا سره. د ژوندۍ حالت دندې لکه قیمتونه یا د پالیسۍ کلمې د مستحکم هنر سره ګډ کړئ، او تاسو د یوې نړۍ په اړه خورا ډاډمن ځواب ترلاسه کوئ چې دمخه حرکت کړی دی.

ولې ډیمو د مصنوعي ذهانت د اعتبار لپاره یوه بده ازموینه ده؟

یو پاک پرامپټ او هغه دنده چې ماډل یې زرګونه د خپلوانو سره لیدلې ده به ګړندۍ ښکاري. ژوندۍ کاري جریان پیچلي پیسټ، ورک شوي فایلونه، او یو کارونکی لري چې لومړی ځواب به ومني چې د دوی اندیښنه کموي. د لیډربورډ نمره ستاسو په ټکټونو کې کیلیبریشن نه دی. د ماډل خطر هغه څه دي چې پیښیږي کله چې دا په حجم کې غلط وي، نه دا چې ایا دا د ټریویا سیټ پاس کړی. هغه ازموینې چې تاسو ورته اړتیا لرئ وچې دي: د ترلاسه شوي پاس دننه پاتې شئ، د بلف کولو پرځای ناڅرګندتیا بیرغ کړئ، کله چې تاسو بیا تکرار کوئ نو ثابت پاتې شئ، او د اختراع کولو پرځای تړل شوي ناکام شئ.

ایا مصنوعي ذهانت د باور وړ دی که چیرې هیڅوک په دې اړه نه وي؟

نه. که څوک مسؤل نه وي، نو سیسټم به داسې وکارول شي لکه څنګه چې وي. انسان په لوپ کې یوازینی ډیزاین دی چې د ناکامۍ حالتونو سره سمون لري: څوک بیاکتنه کوي، څوک یې بندولی شي، څه ثبت کیږي، د ناکامۍ وروسته څه پیښیږي. که ځواب "ماډل" وي، نو تاسو ځواب نلرئ. ماډلونه د پیښې وروسته غونډې ته نه ځي. د طب، قانون، کریډیټ، یا د خوندیتوب مهم عملیاتو لپاره، انسان لوپ دی او ماډل یو سټب دی.

څنګه کولی شم AI ته اشاره وکړم ترڅو غلطۍ ونیسم؟

په قصدي ډول د ناڅرګندتیا غوښتنه وکړئ: "څه به دا غلط کړي؟" وهي "دا باوري کړئ." کله چې تاسو کولی شئ له نسل څخه ترلاسه کول جلا کړئ. لومړی عبارتونه وګورئ، بیا د لیکلو غوښتنه وکړئ. جامې بدل کړئ: بیا جمله وکړئ، یا له هغه څخه وغواړئ چې برعکس استدلال وکړي. محدودیتونه مجبور کړئ لکه "یوازې له هغه متن څخه چې ما پیسټ کړی" یا "که ورک وي، ووایاست ورک وي،" او بیا هم وګورئ. د تایید کونکي سره دندې غوره کړئ، او اضافي ځانګړتیا وګورئ، ځکه چې دا هغه ځای دی چې وهمونه جامې اغوستل خوښوي.

ماخذونه

  1. NIST - nvlpubs.nist.gov

  2. NIST - airc.nist.gov

  3. NIST - airc.nist.gov

  4. ICO - ico.org.uk

  5. د NCSC - www.ncsc.gov.uk

  6. د NCSC - www.ncsc.gov.uk

  7. OWASP - genai.owasp.org

په رسمي AI اسسټنټ پلورنځي کې وروستي AI ومومئ

زموږ په اړه

ازموینه
۱. د مقالې له مخې، ایا مصنوعي ذهانت د یوې ځانګړتیا په توګه د اعتبار وړ دی؟

۲. د اپټایم او صداقت ترمنځ څه توپیر دی؟

۳. ولې یو روان غلط ځواب د بې خونده ځواب په پرتله ډیر خطرناک دی؟

۴. د هاربر غړیتوب په شل پوښتنو کې د مثال په توګه، د بې کنټروله همکار پیلوټ سره څه پیښ شول؟

۵. د مقالې له مخې، د تفتیش وړ ترلاسه شوي ټوټې پرته ځمکنی کول څه شی دی؟


بیرته بلاګ ته