«Cognition»-ի Սքոթ Վուն ասում է, որ արհեստական բանականության կոդավորող գործակալները չպետք է փոխարինեն մարդկանց։ ↗
Cognition-ի Սքոթ Վուն հակադարձեց այն մտքին, որ Devin-ը ստեղծված է ծրագրավորողներին ուղղակիորեն փոխարինելու համար։ Մի փոքր անհարմար դիրքորոշում է, հաշվի առնելով, որ ընկերությունը նաև պնդում է, որ Devin-ը ստեղծում է իր սեփական կոդի մեծ մասը։.
Նրա ձևակերպումն ավելի շատ նման է «արհեստական ինտելեկտի կոդավորող ընկեր» արտահայտությանը, քան «քո աշխատանքը կերել է նոութբուքի գոբլինը»։ Այնուամենայնիվ, լարվածությունը դժվար է անտեսել՝ ավելի լավ գործակալներ, ավելի քիչ արդարացումներ գերծանրաբեռնված ինժեներական թիմերի համար… կամ այդպես է ընթանում փաստարկը։.
Այս արհեստական ինտելեկտի ստարտափը անվճար կմաքրի ձեր տունը՝ ապագայի ռոբոտներին մարզելու համար ↗
Shift-ը առաջարկում է անվճար տան մաքրություն՝ միաժամանակ և՛ հարմար, և՛ մի փոքր անհանգստացնող մի թակարդով. մաքրողները կրում են տեսախցիկով հագեցած «կախարդական գլխարկ», որպեսզի ընկերությունը կարողանա հավաքել ռոբոտների մարզման տվյալներ:.
Առաջարկը պարզ է՝ դու ստանում ես մաքուր բնակարան, նրանք՝ տնային գործերի տեսանյութ։ Գուցե կոկիկ գործարք է։.
Shift-ը նշում է, որ այն մշուշում է զգայուն մանրամասները և անանունացնում կադրերը, բայց ավելի լայն հարցը դեռևս մնում է այնտեղ՝ ինչպես գուլպան բազմոցի տակ. որքանո՞վ են մարդիկ պատրաստ տան գաղտնիությունը փոխանակել հարմարավետության հետ։
Anthropic-ը թողարկում է Claude Opus 4.8 տարբերակը ↗
Anthropic-ը թողարկեց Claude Opus 4.8-ը՝ թարմացումներով կոդավորման, գործակալական աշխատանքային հոսքերի, դատողության և մասնագիտական աշխատանքի համար: Ամենամեծ առավելությունը հուսալիությունն է՝ ավելի քիչ չաջակցվող պնդումներ, գործիքների ավելի լավ օգտագործում և ավելի շատ ինքնաստուգում:.
Claude Code-ը նաև ունի դինամիկ աշխատանքային հոսքեր, որոնք թույլ են տալիս մոդելին պլանավորել, գործարկել զուգահեռ ենթագործակալներ, ստուգել արդյունքները և հաշվետվություն ներկայացնել։ Սա ձանձրալի է թվում, մինչև չհասկանաք, որ դա, ըստ էության, նախագծի կառավարում է զրոյական ոճով։.
Գները մնում են բաժանված ստանդարտ և արագ ռեժիմների միջև, ընդ որում՝ Anthropic-ը ավելի շատ է կենտրոնանում ջանքերի կառավարման վրա, որպեսզի օգտատերերը կարողանան փոխզիջել արագության, որակի և թոքենների այրման միջև։.
Foxconn-ը անչափ վստահ է արհեստական բանականության շնորհիվ աճի տեմպի նկատմամբ, ասում է նախագահը ↗
Foxconn-ի նախագահը նշել է, որ արհեստական ինտելեկտի պահանջարկը փոխում է ընկերության սովորական սեզոնային ռիթմը։ Մատակարարների հին տարվա կեսի անկումը՞։ Ըստ երևույթին, այլևս նորմալ չի գործում։.
Պատճառը ամպային հսկաների արհեստական բանականության վրա կատարվող հսկայական ծախսերն են, որոնք Foxconn-ը համարում է իր սեփական շուկայական հնարավորություն: Սա արհեստական բանականության բումի ապարատային կողմն է, որը պակաս փայլուն է, քան չաթբոտները, բայց հենց այնտեղ է, որտեղ փողի խողովակները զրնգում են:.
Foxconn-ը արդեն Nvidia-ի խոշոր սերվերների արտադրող է, ուստի նրա լավատեսությունը հիմնականում արհեստական ինտելեկտի ենթակառուցվածքների մրցավազքի ջերմաստիճանի ստուգում է։.
Համատեղ ձեռնարկ վստահելի երրորդ կողմի գնահատականների համար ↗
OpenAI-ը հրապարակեց երրորդ կողմի արհեստական ինտելեկտի գնահատումների վերաբերյալ ուղեցույց՝ պնդելով, որ թեստերը պետք է ավելի հստակ մանրամասներ ներկայացնեն այն մասին, թե ինչ է գնահատվել, ինչպես է այն փորձարկվել և ինչ կարող են ապացուցել արդյունքները։.
Հիմնական կետը զարմանալիորեն գործնական է. առաջնային արհեստական ինտելեկտի գնահատումները չեն կարող պարզապես լինել վարկանիշային աղյուսակի տեսքով գուշակություններ: Գնահատողները պետք է բացատրեն փորձարկված համակարգը, հուշումները, պաշտպանության միջոցները, վավերականության ստուգումները և թե որտեղ են ավարտվում պնդումները:.
Դա կարևոր է, քանի որ մոդելներն ավելի գործակալական դառնալուն զուգընթաց, մակերեսային թեստերը կարող են համակարգերը ավելի անվտանգ կամ ավելի ուժեղ թվացնել, քան դրանք իրականում են։ Փոքր թղթաբանական ծախսեր, մեծ հետևանքներ։.
Հաճախակի տրվող հարցեր
Արդյո՞ք Դևինի նման արհեստական բանականության կոդավորող գործակալները նախատեսված են ծրագրավորողներին փոխարինելու համար։
Սքոթ Վուն արհեստական բանականության կոդավորող գործակալներին ներկայացնում է որպես ծրագրավորման գործընկերներ, այլ ոչ թե մարդ ծրագրավորողների լիարժեք փոխարինողներ։ Հոդվածը, սակայն, մատնանշում է մի լարվածություն. Դևինը նաև նկարագրվում է որպես Cognition-ի սեփական կոդի մեծ մասի ներդրող։ Գործնականում, եզրակացությունն այն է, որ այս գործիքները կարող են կրճատել որոշ առօրյա ինժեներական աշխատանքներ՝ միևնույն ժամանակ կախված լինելով մարդկանցից՝ դատողության, ուղղորդման և պատասխանատվության համար։.
Ինչո՞ւ է Shift-ը անվճար տան մաքրում առաջարկում արհեստական ինտելեկտի ուսուցման տվյալների համար։
Shift-ը առաջարկում է անվճար տան մաքրում, քանի որ ապագա ռոբոտներին մարզելու համար անհրաժեշտ է տնային գործերի ֆիզիկական աշխարհի տեսանյութեր: Մաքրողները աշխատանքի ընթացքում կրում են տեսախցիկով հագեցած «կախարդական գլխարկ»՝ ստեղծելով կադրեր, որոնք կարող են օգնել արհեստական բանականության համակարգերին հասկանալ տնային աշխատանքները: Փոխանակումը հստակ է. հաճախորդները ստանում են մաքուր տուն, մինչդեռ ընկերությունը տվյալներ է ստանում անձնական բնակելի տարածքներից:.
Ինչպե՞ս է Shift-ը պահպանում գաղտնիությունը տան մաքրման տեսանյութեր հավաքելիս։
Հոդվածում ասվում է, որ Shift-ը պնդում է, որ մշուշում է զգայուն մանրամասները և անանունացնում է կադրերը։ Դա կարող է նվազեցնել գաղտնիության որոշ ռիսկեր, բայց չի վերացնում մարդկանց տներում նկարահանման ավելի լայն մտահոգությունը։ Օգտատերերի համար կենտրոնական հարցն այն է, թե արդյոք անվճար մաքրման հարմարավետությունը արժե տվյալների հավաքագրման այդ մակարդակին։.
Ի՞նչ նորություն կա Claude Opus 4.8-ում։
Claude Opus 4.8-ը նկարագրվում է որպես կոդավորման, գործակալական աշխատանքային հոսքերի, դատողության և մասնագիտական աշխատանքի բարելավող։ Թարմացումը կենտրոնանում է հուսալիության վրա, ներառյալ չաջակցվող պնդումների նվազումը, գործիքների ավելի ուժեղ օգտագործումը և ինքնաստուգման ավելի մեծ հնարավորությունները։ Claude Code-ը նաև ստանում է դինամիկ աշխատանքային հոսքեր, որտեղ մոդելը կարող է պլանավորել, գործարկել զուգահեռ ենթագործակալներ, ստուգել արդյունքները և հաղորդել արդյունքների մասին։.
Ինչո՞ւ է Foxconn-ի արհեստական բանականության բումի լավատեսությունը կարևոր։
Foxconn-ի վստահությունը կարևոր է, քանի որ այն արտացոլում է արհեստական ինտելեկտի բումի սարքավորումների կողմը: Ընկերության նախագահը նշել է, որ արհեստական ինտելեկտի պահանջարկը փոխում է իր սովորական սեզոնային օրինաչափությունը, քանի որ ամպային հսկաների ենթակառուցվածքների վրա կատարվող ծախսերը ստեղծում են շուկայական մեծ հնարավորություն: Քանի որ Foxconn-ն արդեն Nvidia սերվերների խոշոր արտադրող է, նրա մեկնաբանությունները ծառայում են որպես արհեստական ինտելեկտի ենթակառուցվածքների պահանջարկի ուժեղ ազդանշան:.
Ի՞նչն է OpenAI-ի կարծիքով դարձնում երրորդ կողմի արհեստական բանականության գնահատականները հուսալի։
OpenAI-ը պնդում է, որ արհեստական բանականության գնահատումները կարիք ունեն ավելի պարզ բացատրությունների այն մասին, թե որ համակարգը է փորձարկվել, ինչպես է այն փորձարկվել և ինչ են իրականում ցույց տալիս արդյունքները: Սա ներառում է մանրամասներ հուշումների, պաշտպանության միջոցների, վավերականության ստուգման և ցանկացած պնդումների սահմանների վերաբերյալ: Այս կետը հատկապես կարևոր է ավելի գործակալական մոդելների համար, որտեղ մակերեսային փորձարկումները կարող են համակարգերը թվալ ավելի անվտանգ կամ ավելի կարողունակ, քան դրանք կան:.