Porovnej si dva AI modely na vlastní úloze, ne podle benchmarků
💬 ChatGPT / Claude / Gemini
Začátečník
👁 101 zobrazení
Benchmarky výrobců vám neřeknou, který model je lepší na VAŠI práci. Tenhle postup vám pomůže udělat si vlastní srovnání na úloze, na které vám skutečně záleží.
// Přesné znění promptu
Pomoz mi férově porovnat dva AI modely na mé konkrétní úloze, místo abych se spoléhal/a na benchmarky výrobců. Moje typická úloha: [POPIŠ, co s AI nejčastěji děláš, např. „psaní produktových popisků" nebo „vysvětlování kódu"] Udělej toto: 1. Navrhni 3 konkrétní testovací zadání, která reprezentují moji úlohu, od jednoduchého po náročné. Jedno z nich musí obsahovat záludnost, na které se modely často liší. 2. Ke každému zadání napiš, podle čeho poznám dobrý výstup od špatného (konkrétní kritéria, ne „líbí se mi to"). 3. Navrhni jednoduchou bodovací tabulku, do které si výstupy obou modelů zapíšu. 4. Upozorni na časté chyby při takovém srovnávání (např. že první model dostane snazší otázky, nebo že hodnotím podle délky místo kvality). Až mi to připravíš, dám oběma modelům stejná zadání a vrátím se s výstupy k vyhodnocení.
💡 Proč tento prompt funguje
Nejlepší model pro vás je ten, který zvládá vaši konkrétní práci, ne ten s nejvyšším skóre v cizím testu. Klíčový je bod 1 se záludnou úlohou: právě na hraničních případech se modely liší, zatímco na snadných je rozdíl nulový. Vlastní srovnání za půl hodiny vám řekne víc než deset recenzí.