Tantular adalah AI Indonesian-first — dibangun untuk memahami Bahasa Indonesia, konteks Indonesia, dan menjaga data Anda tetap di tangan Anda.
Sebagian besar model besar memperlakukan Bahasa Indonesia sebagai bahasa sekunder — hasil terjemahan dari cara berpikir dalam Bahasa Inggris. Tantular dimulai dari arah sebaliknya.
Register formal dan santai, singkatan sehari-hari, campuran Indonesia–Inggris dalam satu kalimat — Tantular menanggapi dengan suara yang wajar bagi telinga Indonesia, bukan terjemahan yang kaku.
Format surat dinas, struktur memo dan laporan, kebiasaan dokumen kerja Indonesia. Tantular mengenali konteks ini tanpa perlu dijelaskan ulang setiap kali.
Berjalan lokal di mesin Anda. Dokumen tidak pernah dikirim ke server luar untuk diproses — kedaulatan data ada di tangan Anda, bukan di infrastruktur pihak lain.
Tantular Models adalah bobot dan runtime yang bisa Anda jalankan sendiri. Tantular Office adalah cara paling langsung untuk memakainya sehari-hari.
Jalankan Tantular secara lokal lewat Ollama. Pilih tag sesuai RAM mesin Anda, panggil lewat /api/chat, dan bangun di atasnya.
Lihat detail teknisAdd-in AI untuk Word, Excel, dan PowerPoint. Terintegrasi langsung di aplikasi Office yang sudah Anda pakai, berjalan lokal, tanpa dokumen keluar mesin.
Buka Tantular Office38/40
Indonesian voice
19/20
Edit-contract JSON
0
Jawaban kosong
6,4s
Latency p50
ollama pull ghifidanukusumo/tantular| Tag | Kuantisasi | Ukuran | RAM | Untuk |
|---|---|---|---|---|
| latest · q8-0.5 | Q8_0 | 10 GB | 16 GB+ | Default |
| q4-0.4 | Q4_K_M | 6,6 GB | < 16 GB | Rollback, atau mesin dengan RAM lebih kecil |
| lite | Q4_K_M 4B | 3,4 GB | < 16 GB | Untuk RAM di bawah 16 GB |
Diukur pada 60 item internal (40 voice, 20 edit-contract) melalui /api/chat dengan think: false, temperature 0, satu permintaan pada satu waktu, GPU Apple lokal.
| Q8_0 — latest | Q4_K_M — q4-0.4 | |
|---|---|---|
| Indonesian voice | 38 dari 40 | 37 dari 40 |
| Edit-contract JSON | 19 dari 20 | 18 dari 20 |
| Jawaban kosong | 0 | 0 |
| Latency p50 | 6,4 detik | 3,8 detik |
| Latency p95 | 25,5 detik | 15,3 detik |
Q8 menjadi default karena Q4_K_M kehilangan kualitas; Q8 menyamai hasil bobot bf16 pada kedua evaluasi. Q4 lebih cepat dan lebih kecil — pilih Q4 bila kecepatan lebih penting daripada satu-dua item ketelitian.
Angka latency berasal dari satu mesin dan bukan janji kinerja. Permintaan paling lambat pada pengukuran kami mencapai 30 detik.
01
Pada instruksi multi-edit, model kadang mengeluarkan satu find melebihi batas 200 karakter alih-alih beberapa edit terarah. Terjadi pada Q4, Q8, maupun bf16 — 1 dari 20 item.
02
Evaluasi memakai dokumen sintetis, bukan dokumen Office nyata.
03
Ini profil, bukan fine-tune: kemampuan dasarnya adalah kemampuan Qwen3.5-9B.
Apache 2.0
Apache 2.0, mengikuti Qwen3.5.
Qwen3.5-9B
Tantular adalah system prompt, template, dan parameter di atas bobot itu. Tidak ada bobot yang dilatih.
Mulai dengan ollama pull ghifidanukusumo/tantular, atau jelajahi Tantular Office untuk pengalaman AI yang terintegrasi dengan produktivitas sehari-hari.
Indonesian-first. Local-first. Dibangun untuk privasi dan kedaulatan data.