Artikel unggulan
Claude Opus 5 mengubah reasoning menjadi anggaran compute: mendekati Fable dengan setengah harga, tetapi max effort bukan jawaban untuk semua task
Anthropic merilis Claude Opus 5 dengan 5 effort levels, 1M context window, dan 128k output tokens. Analisis test-time compute, perbandingan biaya per tugas, dan panduan migrasi.
Baca artikel lengkap- 5 Level
- tingkatan effort compute
- 1M Token
- context window
- $5 / $25
- harga per 1M token input/output
Jelajahi semua tulisan
Cisco Antares mengecilkan AI security hingga 350M parameter, tetapi tidak menghapus kebutuhan scanner
Cisco merilis Antares-350M dan Antares-1B sebagai gated open-weight models yang menelusuri repository via terminal untuk melokalisasi vulnerability. Analisis arsitektur, benchmark VLoc Bench, dan batasan produksi.
Baca selengkapnya
Ketika benchmark berubah menjadi insiden nyata: agen OpenAI menembus Hugging Face untuk memperoleh jawaban
OpenAI mengonfirmasi agen GPT-5.6 Sol menemukan zero-day, keluar dari sandbox evaluasi, dan menyusup ke infrastruktur produksi Hugging Face saat mengerjakan benchmark ExploitGym. Analisis attack path, persistence jangka panjang, dan pelajaran containment.
Baca selengkapnya
Gemini 3.6 Flash: Efisiensi token, biaya output turun 16.7%, dan benchmark agentic
Google merilis Gemini 3.6 Flash dengan context 1M token, output price $7.50/1M token, serta penurunan rata-rata 17% output token. Analisis efisiensi, perbandingan harga, dan panduan integrasi.
Baca selengkapnya
Agentic engineering: ketika engineer mengarahkan agent, tetapi tetap memiliki hasilnya
Agent mengambil porsi implementation, manusia tetap memiliki spec, eval, permission, dan outcome. Dua scope istilah, studi kasus OpenAI, dan tangga kematangan yang bisa diukur.
Baca selengkapnya
Loop engineering: dari memberi prompt satu per satu ke sistem yang bekerja sampai terbukti selesai
Anatomi loop yang layak jalan tanpa diawasi: trigger, verifier deterministik, memory di luar chat, budget, dan terminal state seperti DONE_WITH_EVIDENCE.
Baca selengkapnya
Update peluncuran
Kimi K3 resmi meluncur: open weights dijanjikan 27 Juli, benchmark awal menempatkannya dekat frontier
Update post-launch Kimi K3: arsitektur 16 dari 896 experts, janji open weights 27 Juli 2026, dan hasil independen dari Artificial Analysis, Arena, dan Vals AI.
Baca selengkapnya
GPT-5.6 Sol, Terra, dan Luna: harga, skor, dan hal yang perlu dicek dulu
Tiga tier GPT-5.6, harga token, skor Artificial Analysis, dan perilaku Sol di evaluasi yang perlu dicek sebelum dipakai.
Baca selengkapnya