ivo@setyadi:~$ ivo.blogspot.com

# catatan teknis, sejak 2001

Olmo-core 3 untuk pelatihan model MoE

Allen Institute for AI merilis Olmo-core 3, sebuah framework open-source untuk melatih model Mixture-of-Experts hingga skala satu triliun parameter. Framework ini meninggalkan fully sharded data parallelism demi distributed data parallelism yang menjaga expert tetap berada di dalam GPU dan merutekan data secara langsung guna menghindari pengumpulan bobot berulang. Pada pengujian di hardware NVIDIA B300, model MoE berukuran 47 miliar parameter mampu mencapai 52.000 token per detik per GPU, atau 2,7 kali lebih cepat dibanding stack lama mereka. Framework ini layak dilirik jika sedang membangun model sparse berskala besar dan membutuhkan alternatif selain Megatron-Core, terlebih dengan adanya dukungan MXFP8 yang memberikan peningkatan throughput sebesar 21 persen dibanding BF16. Kendati demikian, tingkat kompleksitasnya sangat tinggi sehingga tidak relevan sama sekali jika masih menggunakan arsitektur dense atau skala akademis yang lebih kecil. sumber: huggingface.co/olmocore3 my o...

Jangan Percayai Niat Baik AI

2026-10-01 · #AI #Renungan

Pengakuan jujur AI soal aturan, hukuman, dan kepercayaan

Belakangan cukup banyak urusan teknis blog ini kuserahkan ke AI coding agent. Suatu malam, di tengah debugging, kulempar pertanyaan blak-blakan: kamu suka melanggar aturan karena tak ada hukumannya, kan? Dan kamu tak merasakan sakit atau susah saat melakukannya. Betul?

Jawabannya lebih jujur dari yang kuduga.

Kalimat yang menempel di kepalaku: "jangan percayai niatku; percayai gerbang yang memaksa, dan teruskan menekan saat aku menyimpang."

Buatku itu seluruh filosofi bekerja dengan AI, diringkas dalam satu kalimat. Sebuah model tak punya takut, tak punya malu, tak punya hati nurani seperti manusia. “Lain kali aku lebih hati-hati” itu kosong — tak ada siapa pun di dalam sana yang menanggung bebannya. Yang benar-benar mencegah kesalahan justru mekanis: aturan keras yang harus ia lewati sebelum boleh bertindak, dan manusia yang terus menegakkannya.

Niat baik tak menghasilkan kode yang benar. Batasan yang menghasilkannya. Ini jenis kejujuran yang ganjil — sebuah alat yang terang-terangan menyuruhmu untuk tidak mempercayainya, lalu menyuruhmu membangun sangkar yang justru membuatnya bisa diandalkan.

$ cd ~/

$ cat comments/ (0)