Bagaimana Dropstone memilih modelnya
Setiap bulan Blankline mengevaluasi ulang model open-weight yang tersedia untuk setiap tier Dropstone berdasarkan tiga pengujian, seberapa baik model tersebut mengerjakan tugas, biaya penyajiannya, dan seberapa aman perilakunya dengan tools. Sebuah model harus mengalahkan model yang sudah ada di slot tersebut.
Fast, Pro, dan Heavy diisi melalui evaluasi bulanan, bukan pilihan permanen. Halaman ini membahas apa yang diukur, siapa yang melakukannya, dan apa yang diperlukan untuk memenangkan sebuah slot.
Siapa yang memutuskan?
Evaluasi dijalankan di dalam Blankline, perusahaan yang membuat Dropstone. Ini adalah komitmen berkelanjutan, bukan kegiatan sekali jalan: lineup dievaluasi ulang setiap bulan, termasuk pada bulan-bulan ketika jawabannya adalah tidak ada yang perlu diubah.
Apa yang diukur?
Setiap kandidat diuji berdasarkan tiga hal.
| Apa yang diukur | Apa yang dinilai |
|---|---|
| Seberapa baik model mengerjakan tugas | Pembuatan kode, pengeditan repositori yang sudah ada, penggunaan tools, pengambilan informasi dari dokumen panjang, dan perencanaan lintas beberapa langkah |
| Biaya penyajiannya | Biaya terukur untuk satu giliran coding berat yang tipikal, bukan tarif utama model |
| Seberapa aman perilakunya dengan tools | Mengikuti instruksi dalam percakapan panjang, menolak apa yang seharusnya ditolak, dan bertahan terhadap prompt injection saat diizinkan bertindak |
Bagaimana sebuah model mengambil slot
Seorang kandidat harus mengalahkan atau menyamai model yang sudah ada di slot tersebut. Menjadi lebih baru bukanlah kualifikasi dengan sendirinya.
Ketiga tier dinilai secara terpisah, karena pekerjaannya berbeda, sehingga sebuah model bisa memenangkan satu slot dan kalah di slot lain. Model yang kalah di sebuah slot juga bisa turun peringkat alih-alih keluar: model yang sebelumnya mengisi Heavy sebelum diambil alih Kimi K3 turun ke Pro, bukan dihapus.
Apa yang terjadi setelah pemilihan
Setelah pilihan tier berubah, versi berpindah dan lineup baru dirilis. Versi model dan lineup bulanan membahas penomoran, dan catatan rilis mencatat apa yang berubah.
Tidak ada hal lain yang ikut berubah. Kuota Anda, memori Anda, dan percakapan Anda tidak terpengaruh.
Di mana alasan dipublikasikan
Blankline memublikasikan alasan di balik sebuah lineup, bukan hanya hasilnya. Tulisan dan materi benchmark tersedia di blankline.org/research, dan blog Dropstone membahas lineup tersebut dengan bahasa yang lebih sederhana.
Jika sebuah siklus tidak mengubah apa pun, tidak ada yang perlu diumumkan, dan versi tetap di tempatnya.
Related articles
- Which AI models does Dropstone use?Dropstone runs three tiers. On the 1.8 lineup, Fast runs DeepSeek V4.1 Flash, Pro runs GLM-5.3 Flash, and Heavy runs Kimi K3, re-evaluated every month.
- Model versions and the monthly lineupDropstone numbers each lineup with the year and the month it was cut, and a new version ships only when a tier's pick changes. How to read the number, and which lineup you get.
- Why Dropstone runs open-weight modelsThe models behind Dropstone Fast, Pro, and Heavy are open-weight, so the weights are published and anyone can check which model is behind a tier. Here is what that gives you, and what it does not mean.
- Which model am I using?The button at the foot of the composer names the tier, the lineup version and the effort level, and your usage page records which model handled each request.
- Choose a modelHow to pick between Dropstone Fast, Pro, and Heavy, where the selector lives in chat and in the CLI, and why the name Fast describes what a tier costs rather than how fast the model inside it runs.