Puna që zgjat me orë është bërë një nga fushat ku kompanitë AI po kërkojnë të dallohen. Anthropic prezantoi më 1 shtator Claude Fable 5.1 dhe Claude Mythos 5.1, duke theksuar programimin, punën me dije dhe zgjidhjen e problemeve me shumë hapa.

Sipas kompanisë, Fable 5.1 arrin rezultate më të larta se paraardhësi në disa vlerësime. Anthropic thotë gjithashtu se nivelet më të ulëta të përpjekjes llogaritëse mund të japin rezultate të krahasueshme me Fable 5 me kosto më të ulët. Ky është krahasimi i publikuar nga prodhuesi, jo testim ynë i pavarur.

Një demonstrim nuk është gjithë puna

Një detyrë e gjatë mund të përfshijë kërkim, shkrim kodi, testim dhe shpjegim të ndryshimeve. Në praktikë, dobia varet edhe nga mjetet që ka agjenti dhe nga qartësia e kërkesës. Një rezultat mbresëlënës në një shembull nuk garanton të njëjtën cilësi në çdo projekt.

Ku ta vendosim kriterin?

Këndvështrimi ynë: për ekipet që ndërtojnë faqe, produkte apo përmbajtje, pyetja është sa rezultat i verifikueshëm mbetet në fund. Një provë me të njëjtën detyrë, kriteret e pranimit dhe kohën e korrigjimit ndihmon më shumë se përshtypja nga një bisedë. Detyrat e gjata meritojnë edhe pika kontrolli, sidomos kur preken të dhëna apo publikime reale.

Burimet

Anthropic · Introducing Claude Fable 5.1 and Claude Mythos 5.1 ↗

Data e burimit / ngjarjes: 1 shtator 2026. Kontrolluar më 14 shtator 2026. Artikull origjinal në shqip me asistencë AI; këndvështrimi editorial shënohet veçmas.