Pelajari jenis pre-employment assessment, dari skill test, cognitive test, work sample, SJT hingga integrity test, serta cara memilih tes seleksi karyawan yang relevan.

Recruitment team tidak kekurangan pilihan tes masuk kerja. Ada cognitive test, skill assessment, personality test, work sample, situational judgment test, sampai integrity assessment. Masalahnya, semakin banyak assessment tidak otomatis membuat keputusan hiring semakin baik.
Tujuan pre employment assessment adalah mengurangi ketidakpastian yang masih tersisa tentang kandidat sebelum keputusan dibuat. Recruiter perlu melihat informasi apa yang belum cukup terbukti melalui CV, portfolio, atau interview, lalu memilih assessment yang paling langsung dan job-relevant untuk memperoleh evidence tambahan. Pendekatan ini lebih berguna daripada mencari satu jenis tes yang dianggap selalu paling akurat untuk semua pekerjaan.
Pre-employment assessment adalah evaluasi terstruktur sebelum hiring yang digunakan untuk mengumpulkan evidence tambahan mengenai construct yang relevan dengan pekerjaan. Construct tersebut dapat berupa technical capability, reasoning, situational judgment, behavioral tendency, atau aspek lain yang memang dibutuhkan untuk role. Review terbaru tentang personnel selection oleh Sackett, Lievens, dan Landers juga menggambarkan selection sebagai sistem yang dapat menggunakan berbagai predictor dan metode, bukan satu tes tunggal.
Istilah ini lebih luas daripada “psikotes”. Pre-employment assessment dapat mencakup cognitive assessment, skill test, work sample, simulation, personality assessment, integrity assessment, dan situational judgment test. Tes juga tidak harus selalu muncul sebelum interview karena posisi assessment dalam funnel bergantung pada candidate volume, biaya, candidate effort, dan evidence yang sudah tersedia.
Hal yang paling penting adalah memahami bahwa assessment merupakan satu sumber evidence, bukan hiring decision itu sendiri. Score baru mempunyai arti jika recruiter memahami apa yang diukur dan bagaimana hasil tersebut digunakan untuk membuat keputusan. Karena itu, assessment sebaiknya dipilih berdasarkan hiring question yang belum terjawab, bukan berdasarkan test library yang tersedia.
Bayangkan recruiter sedang mencari Data Analyst dan CV kandidat menunjukkan pengalaman menggunakan SQL. Informasi tersebut belum otomatis menjawab apakah kandidat benar-benar dapat menulis query untuk menyelesaikan business problem yang relevan dengan pekerjaan. Dalam kondisi seperti ini, short SQL exercise atau work sample dapat menghasilkan evidence yang lebih langsung daripada menambah tes yang tidak berkaitan dengan capability tersebut.
Jenis ketidakpastian yang berbeda membutuhkan assessment yang berbeda:
Tidak semua kandidat perlu mengerjakan seluruh jenis tes tersebut. Jika portfolio, certification, previous work sample, atau structured interview sudah menghasilkan evidence yang cukup, assessment tambahan dapat menambah candidate burden tanpa banyak meningkatkan kualitas informasi. Pilihan tes perlu mengikuti ketidakpastian yang ingin dikurangi.
Cognitive assessment dapat mengukur numerical, verbal, abstract, atau analytical reasoning serta problem solving dalam kondisi tes tertentu. Assessment ini dapat berguna ketika pekerjaan memang membutuhkan kemampuan memahami informasi baru atau menyelesaikan unfamiliar problems. Namun hasil cognitive test tetap perlu dibaca sebagai evidence tentang reasoning yang diukur oleh tes tersebut, bukan sebagai bukti bahwa kandidat otomatis menguasai technical skill tertentu.
Cognitive ability berbeda dari SQL, accounting, coding, atau learned capability lain. Kandidat dapat menunjukkan reasoning yang kuat tetapi belum memiliki technical knowledge yang dibutuhkan untuk sebuah role, atau sebaliknya memiliki pengalaman teknis yang kuat dengan hasil cognitive assessment yang berbeda. Recruiter karena itu tidak sebaiknya menerjemahkan high reasoning score menjadi “technically qualified”.
Klaim bahwa general mental ability selalu merupakan predictor terbaik juga perlu dibaca lebih hati-hati. Sackett et al. (2022) meninjau kembali koreksi restriction of range yang digunakan dalam sejumlah validity estimates klasik dan menghasilkan perubahan penting pada estimasi beberapa selection procedures. Penelitian Berry et al. (2024) selanjutnya menunjukkan bahwa dalam selection composites yang mereka uji, mengurangi atau menghilangkan GMA sering menghasilkan sedikit atau tidak ada validity cost sambil menurunkan adverse impact, meskipun evidence tersebut berasal dari konteks subgroup AS dan bukan validasi Indonesia.
Artinya bukan bahwa cognitive assessment tidak berguna. Kesimpulan yang lebih aman adalah bahwa cognitive assessment perlu digunakan ketika reasoning memang merupakan construct yang relevan dan hasilnya menambah evidence yang dibutuhkan. Ia tidak harus menjadi komponen wajib dalam setiap assessment battery.
Skill test menjawab pertanyaan yang lebih langsung mengenai learned capability. Jika recruiter ingin mengetahui apakah kandidat dapat menulis SQL, mengedit copy, melakukan debugging, atau menggunakan Excel untuk menyelesaikan pekerjaan tertentu, assessment yang meminta kandidat mendemonstrasikan capability tersebut dapat lebih informatif daripada mengandalkan claim pada CV. Prinsip validasi dari SIOP juga menekankan bahwa selection procedure harus mendukung inference yang relevan dengan pekerjaan dan intended use-nya.
Contoh skill dan technical assessment dapat mencakup:
Skill assessment dapat berbentuk knowledge test, procedural task, maupun work sample. Masing-masing menghasilkan jenis evidence yang berbeda sehingga recruiter perlu memastikan bentuk tes sesuai dengan pertanyaan yang ingin dijawab. Knowledge tentang sebuah process, misalnya, tidak selalu sama dengan kemampuan menjalankan process tersebut dalam situasi kerja.
Skill test juga tidak otomatis objektif hanya karena jawaban kandidat dapat diperiksa. Assessment tetap membutuhkan instruction yang jelas, kondisi pengerjaan yang cukup konsisten, rubric yang relevan, serta scoring yang dapat dipertanggungjawabkan. Job relevance merupakan keunggulan penting, tetapi tidak dengan sendirinya membuktikan reliability atau validity assessment.
Work sample meminta kandidat melakukan sesuatu yang menyerupai pekerjaan sebenarnya. Seorang marketer dapat diminta menganalisis campaign performance, kandidat Sales dapat menjalankan discovery scenario, sedangkan Customer Service candidate dapat menangani simulated escalation. Karena output-nya dekat dengan pekerjaan, evidence biasanya lebih mudah dipahami oleh recruiter dan hiring manager.
Kedekatan dengan pekerjaan tetap bukan jaminan bahwa semua work sample berkualitas. Perusahaan perlu menentukan apa yang sebenarnya sedang dinilai, menyusun rubric, menjaga scoring consistency, dan memastikan task tidak terlalu sempit sehingga satu exercise dianggap mewakili seluruh performance kandidat. Candidate familiarity terhadap tools dan kondisi pengerjaan juga dapat memengaruhi hasil.
Trade-off lain adalah candidate time dan assessor effort. Work sample yang membutuhkan beberapa jam mungkin masuk akal untuk finalists tetapi terlalu berat jika diberikan kepada seluruh applicant pool. Karena itu, semakin mahal atau panjang sebuah assessment, semakin penting recruiter memastikan informasi yang diperoleh benar-benar dibutuhkan.
Personality assessment mengukur behavioral tendencies atau traits, bukan technical capability maupun probability of success. Pembahasan mendalam mengenai Big Five, MBTI, penggunaan personality information, dan perbedaannya dengan skill assessment sudah tersedia di Personality Test vs Skill Test. Artikel ini cukup menempatkan personality assessment sebagai salah satu jenis supplementary evidence yang hanya layak digunakan ketika construct, instrument, dan intended use-nya memang relevan.
Satu batas yang tetap penting adalah MBTI. The Myers-Briggs Company sendiri menyatakan bahwa MBTI tidak dimaksudkan untuk recruitment atau candidate selection, sehingga type seperti “ENTJ” atau “introvert” tidak seharusnya dijadikan automatic screening criterion. Hal itu tidak berarti semua occupational personality assessment tidak berguna, tetapi recruiter perlu mengevaluasi setiap instrument secara spesifik.
Integrity assessment digunakan untuk mengukur construct yang berhubungan dengan dependability, rule adherence, atau tendencies yang berkaitan dengan counterproductive workplace behavior. Literatur membedakan overt integrity measures dengan pendekatan yang lebih personality-based, sebagaimana dibahas dalam review Rus dan Pitariu. Kategori ini dapat relevan untuk role tertentu, tetapi pemilihannya membutuhkan role-related rationale yang jelas.
Integrity assessment bukan lie detector. Score tidak membuktikan bahwa seseorang akan melakukan fraud, theft, atau pelanggaran tertentu di masa depan. Hasilnya lebih tepat dipandang sebagai risk-related evidence yang tetap bersifat probabilistic dan instrument-specific.
Karena modern quantitative evidence yang tersedia untuk integrity testing lebih terbatas dibanding beberapa kategori assessment lain, artikel ini tidak menggunakan universal validity coefficient untuk menentukan seberapa “akurat” integrity test. Recruiter yang mempertimbangkannya perlu meminta documentation mengenai reliability, validity, applicant population, dan intended use dari instrument yang benar-benar digunakan. Nama kategori saja tidak cukup sebagai bukti kualitas.
Situational Judgment Test atau SJT memberi kandidat situasi yang menyerupai workplace scenario dan meminta mereka memilih, menilai, atau memberikan respons terhadap situasi tersebut. Contohnya, kandidat dapat diminta menentukan prioritas ketika seorang customer penting mengeluh sementara tim sedang menangani incident lain yang lebih kritis. Fokusnya sebaiknya pada judgment atau procedural knowledge yang memang dirancang untuk diukur.
SJT tidak sebaiknya otomatis diberi label “leadership potential test” atau “soft-skill detector”. Systematic review oleh Webster et al. (2020) menemukan evidence yang positif dalam medical-selection context, tetapi hasil antarstudinya sangat heterogen. Artinya, scenario design, scoring, population, dan criterion yang digunakan dapat menghasilkan kesimpulan berbeda.
Evidence yang lebih baru juga menunjukkan bahwa format SJT terus berkembang. Meta-analysis Martín-Raugh et al. (2025) menemukan hasil yang menjanjikan untuk single-response SJT, tetapi sebagian besar studi yang mendasarinya masih menggunakan low-stakes settings. Karena itu, recruiter sebaiknya menilai SJT berdasarkan construct dan validation evidence dari instrument tertentu, bukan berdasarkan reputasi kategori secara umum.
Recruiter dapat mulai dengan menentukan critical competency yang benar-benar diperlukan untuk pekerjaan. Setelah itu, periksa evidence yang sudah tersedia melalui CV, portfolio, certification, atau structured interview, lalu identifikasi pertanyaan mana yang masih belum terjawab. Assessment dipilih hanya jika dapat menghasilkan evidence yang lebih langsung terhadap remaining uncertainty tersebut.
Empat pertanyaan berikut dapat digunakan sebagai panduan:
Untuk Software Engineer, coding task dapat memberi evidence yang lebih langsung tentang coding capability dibanding personality score. Untuk Sales Manager, recruiter mungkin membutuhkan sales scenario, structured behavioral interview, dan evidence mengenai leadership judgment daripada satu generic test. Tidak ada satu assessment battery yang otomatis cocok untuk semua pekerjaan.
Tidak ada urutan universal untuk tes seleksi karyawan. Posisi assessment sebaiknya menyeimbangkan information value, candidate effort, biaya, volume applicant, dan scarcity kandidat. Assessment yang murah dan singkat dapat masuk lebih awal, sedangkan metode yang membutuhkan banyak waktu kandidat atau assessor biasanya lebih masuk akal setelah candidate pool mengecil.
Secara praktis, recruiter dapat membangun funnel dalam tiga lapisan:
Mimo dapat menjadi contoh pada level workflow, bukan sebagai bukti psychometric validity setiap test. Platform Mimo secara publik menghubungkan Resume Screening, AI Video Interview, dan assessment dalam candidate-screening ecosystem, sehingga assessment dapat ditempatkan setelah evidence awal terkumpul. Kualitas setiap instrument tetap perlu dievaluasi berdasarkan validation evidence-nya sendiri, terlepas dari platform yang mengorkestrasi proses tersebut.
Setiap assessment mempunyai biaya bagi kandidat dan perusahaan. Kandidat mengeluarkan waktu dan effort, sementara perusahaan perlu mengelola administration, scoring, review, serta kemungkinan drop-off. Karena itu, menambah assessment hanya masuk akal jika informasi yang diperoleh benar-benar mempunyai incremental value.
Tidak ada evidence yang cukup untuk mengatakan bahwa seluruh pre-employment test seharusnya berlangsung 20, 30, atau 40 menit. Recruitment team lebih baik memantau completion rate, abandonment, median completion time, device, perbedaan berdasarkan role, serta candidate feedback dari proses mereka sendiri. Dari data tersebut, perusahaan dapat melihat apakah candidate effort sebanding dengan tambahan information value yang diperoleh.
Candidate feedback juga layak masuk ke measurement loop. Recruiter dapat menanyakan apakah instructions jelas, apakah task terasa relevan terhadap role, serta apakah terdapat technical atau accessibility problem selama pengerjaan. Jika perusahaan memberikan feedback hasil assessment kepada kandidat, isi feedback sebaiknya sesuai dengan apa yang benar-benar dapat diinterpretasikan dari instrument tersebut dan tidak melebih-lebihkan arti score.
Bahasa dan mobile experience juga perlu diuji. Jika assessment dimaksudkan untuk mengukur numerical reasoning, kesulitan membaca bahasa Inggris dapat mencemari score ketika English sebenarnya bukan bagian dari job requirement. International Test Commission memiliki guidelines khusus untuk test adaptation karena translation yang literal tidak otomatis memastikan construct equivalence, norm suitability, maupun administration equivalence.
Remote assessment sekarang dapat dikerjakan dengan bantuan generative AI, coding copilot, search, atau external tools. Lievens dan Dunlop membahas bagaimana GenAI dalam unproctored assessment dapat memengaruhi score dan validity dengan cara yang berbeda bergantung pada construct dan context. Penelitian Robie et al. (2026) pada real applicants juga menunjukkan bahwa penggunaan GenAI dalam pre-hire assessment merupakan fenomena yang benar-benar terjadi, bukan sekadar kemungkinan teoritis.
Respons yang tepat tidak selalu berupa pelarangan AI atau proctoring untuk seluruh kandidat. Jika employees dalam pekerjaan nyata memang menggunakan ChatGPT, Copilot, search, atau tools lain, assessment dapat dirancang untuk menilai kualitas output dan judgment dengan tools tersebut. Sebaliknya, bila perusahaan benar-benar perlu mengetahui baseline capability tanpa bantuan, kondisi itu harus dinyatakan dan diuji secara terpisah.
Policy mengenai penggunaan tools perlu muncul langsung di instructions. Recruiter dapat menjelaskan apakah kandidat boleh menggunakan AI untuk syntax lookup, research, atau editing, serta bagian mana yang harus dikerjakan secara mandiri. Setelah itu, interview atau follow-up review dapat digunakan untuk meminta kandidat menjelaskan reasoning, trade-off, dan keputusan yang dibuat selama assessment.
Score 70 tidak otomatis berarti “lulus” hanya karena terlihat seperti passing grade yang familiar. SIOP Principles for the Validation and Use of Personnel Selection Procedures membedakan critical score yang terkait dengan minimum acceptable criteria dari broader cutoff yang digunakan dalam selection decision. Pembahasan Calvin Hoffman juga menunjukkan masalah penggunaan universal 70% cutoff tanpa mempertimbangkan job, assessment, dan outcome.
Threshold perlu mengikuti apa yang sebenarnya diukur oleh tes dan bagaimana score akan digunakan. Minimum technical requirement mungkin memang membutuhkan hurdle tertentu, sementara assessment lain lebih tepat menjadi weighted evidence atau bahan verification. Recruiter sebaiknya menentukan peran score sebelum melihat hasil kandidat sehingga fungsi assessment tidak berubah secara ad hoc.
Ketika beberapa assessment digunakan bersamaan, perusahaan juga tidak perlu otomatis menjumlahkan semuanya menjadi satu “candidate score”. Tentukan terlebih dahulu mana persyaratan yang benar-benar harus dipenuhi dan mana evidence yang dapat dipertimbangkan bersama dengan metode lain. Modern selection research mendukung multi-method atau modular systems ketika metode yang dipakai memberikan informasi yang berbeda, tetapi “lebih banyak score” tidak otomatis menghasilkan keputusan yang lebih valid.
Fairness perlu diperiksa pada level assessment dan selection system. Standardized scoring tidak menjamin assessment bebas dari subgroup differences atau predictive bias, dan Berry et al. (2024) menunjukkan bahwa composition dari selection battery dapat memengaruhi trade-off validity dan adverse impact dalam konteks yang mereka teliti. Evidence tersebut tidak dapat langsung diterjemahkan menjadi satu formula Indonesia, tetapi cukup menunjukkan mengapa recruiter perlu memonitor subgroup outcomes daripada berasumsi sebuah test category otomatis fair.
Periksa setidaknya:
Digital assessment dapat memproses response, score, identity information, video, audio, atau profiling data. Karena itu, privacy dan governance tetap perlu diperiksa, tetapi artikel ini tidak perlu mengulang seluruh ketentuan UU PDP yang sudah dibahas di artikel lain. Recruitment team tetap perlu memastikan processing purpose, appropriate legal basis, transparency, access control, retention, vendor responsibilities, dan human oversight sesuai dengan workflow yang digunakan.
Untuk pembahasan hukum dan governance yang lebih lengkap, lihat Penggunaan AI yang Bertanggung Jawab dalam Rekrutmen. Untuk konteks automation dan candidate-data workflow pada tahap CV screening, lihat juga Automated CV Screening. Assessment procurement sebaiknya tetap melibatkan review internal yang sesuai ketika penggunaan data atau automated decision mempunyai risiko yang material.
Saat membandingkan vendor, jumlah jenis tes bukan indikator kualitas yang cukup. Buyer perlu mengetahui construct yang sebenarnya diukur, evidence apa yang mendukung penggunaan instrument, bagaimana score diinterpretasikan, dan apakah assessment dapat masuk ke recruitment workflow tanpa menciptakan candidate burden yang tidak perlu. Product demo yang menarik tidak menggantikan instrument-level documentation.
Gunakan pertanyaan berikut saat evaluasi:
Construct dan validity
Scoring
Candidate experience
Administration dan GenAI
Workflow dan governance
Red flag mencakup claim seperti “90% predicts job performance” tanpa supporting validation evidence, universal cutoff yang dipakai untuk seluruh role, score tanpa interpretation guidance, atau vendor yang tidak dapat menjelaskan population dan intended use instrument. Mimo maupun vendor lain sebaiknya dievaluasi dengan standar yang sama. Ketersediaan banyak assessment dalam satu platform tidak membuktikan semua test cocok menjadi selection gate.
Assessment architecture sebaiknya berubah mengikuti role dan uncertainty yang ingin dikurangi. Contoh berikut bukan universal best practice, tetapi ilustrasi bagaimana recruiter dapat memilih metode yang berbeda berdasarkan information need. Setiap perusahaan tetap perlu menyesuaikannya dengan selection process dan evidence yang sudah tersedia.
Tidak ada satu battery yang otomatis tepat untuk seluruh role tersebut. Arsitektur assessment harus mengikuti informasi yang perlu diperoleh dan biaya memperoleh informasi tersebut. Jika dua metode menjawab pertanyaan yang sama, recruiter perlu mempertanyakan apakah keduanya memang diperlukan.
Sebelum meluncurkan tes seleksi karyawan, recruitment team perlu memastikan assessment memiliki fungsi yang jelas. Checklist ini dapat digunakan untuk mengecek construct, evidence, administration, candidate experience, dan decision governance sebelum score mulai digunakan. Tujuannya adalah mencegah assessment menjadi proses tambahan yang tidak mempunyai hubungan jelas dengan hiring decision.
Checklist sebaiknya ditinjau kembali setelah assessment mulai digunakan. Internal data dapat menunjukkan apakah sebuah tes benar-benar membantu keputusan, menimbulkan candidate friction, atau menghasilkan pola error yang tidak terlihat pada saat pilot. Data tersebut digunakan sebagai input untuk validation dan improvement, bukan untuk otomatis membuat rule baru tanpa analisis.
Pre-employment assessment merupakan kategori yang lebih luas daripada psikotes. Psychometric assessment dapat menjadi salah satu bagiannya, tetapi skill test, cognitive test, work sample, simulation, integrity test, dan SJT juga dapat digunakan sebelum hiring. Yang membedakan bukan sekadar nama test, melainkan construct dan evidence yang ingin diperoleh.
Tidak semua kandidat membutuhkan assessment yang sama. Gunakan tes ketika assessment tersebut menghasilkan evidence yang belum cukup tersedia dari CV, portfolio, certification, interview, atau previous work sample. Jika informasi yang dibutuhkan sudah terbukti melalui sumber lain, menambah tes dapat menciptakan candidate burden tanpa banyak menambah decision value.
Tidak ada satu durasi optimal yang berlaku untuk semua tes dan role. Candidate effort perlu dibandingkan dengan information value, complexity assessment, tahap recruitment, dan scarcity kandidat. Monitor actual completion time dan abandonment pada proses perusahaan sendiri daripada menggunakan arbitrary universal limit.
Tidak. Score menggambarkan construct tertentu dalam kondisi assessment tertentu dan tidak otomatis merangkum seluruh kualitas kandidat. Recruiter tetap perlu menghubungkan score dengan job relevance, evidence lain, dan role requirements.
Pre-employment assessment yang baik bukan proses menguji kandidat sebanyak mungkin. Mulailah dari informasi penting yang masih belum terbukti, tentukan evidence yang diperlukan, kemudian gunakan assessment paling direct dan job-relevant untuk mendapatkannya. Dengan pendekatan ini, assessment menjadi bagian dari evidence-based hiring workflow, bukan sekadar tambahan tes di antara CV screening dan interview.
Sedang menyusun pre-employment assessment untuk recruitment team Anda? Mulailah dengan memetakan critical competency dan evidence yang sudah tersedia, lalu gunakan assessment hanya untuk menjawab hiring question yang masih belum terjawab.
Mimo mendukung proses pengumpulan evidence melalui CV screening, initial interview, dan candidate test dalam satu workflow. Saat mengevaluasi Mimo atau platform lain, tetap periksa construct, validity evidence, candidate experience, administration condition, serta bagaimana hasil assessment akan digunakan recruiter sebelum membuat hiring decision.