AI FRONTIER
Signals worth understanding before they become obvious.
Qwen merilis Qwen-Image-2.1-Turbo: checkpoint dipercepat 8 langkah untuk text-to-image dan pengeditan gambar
Qwen-Image-2.1-Turbo adalah checkpoint dipercepat dari Qwen-Image-2.1 untuk pembuatan text-to-image dan pengeditan gambar dengan 8 langkah denoising, memakai arsitektur generasi visual 7B yang sama dan dimuat langsung dengan QwenImage21Pipeline di Diffusers.
- Jadwal sampling 8 langkah yang direkomendasikan disimpan bersama checkpoint dan dimuat otomatis; mengatur num_inference_steps saja tidak menimpanya.
- Generasi memakai CFG=1 secara default, dan prefix KV caching memakai ulang konteks teks dan gambar referensi di seluruh langkah denoising.
- Kartu model mencantumkan ukuran model 7B parameter, tipe tensor BF16, dan lisensi Qwen Research License Agreement.
- Memerlukan Diffusers dengan dukungan sigmas sampling yang dikonfigurasi pipeline (PR #14950), serta build PyTorch yang kompatibel dengan CUDA, transformers>=5.17.0, accelerate, dan pillow.
Karena jadwal 8 langkah disertakan dalam checkpoint, pengembang mendapat lebih sedikit langkah inferensi dan latensi lebih rendah, tetapi perlu mencatat bahwa jadwal tersebut berlaku secara default dan jadwal lain belum dievaluasi untuk che...
Microsoft merilis Microsoft-Decision-1, model khusus keputusan agen, dan OpenAI meluncurkan Decisions API
Microsoft merilis Microsoft-Decision-1, model AI yang dikhususkan untuk tugas keputusan terstruktur. Versi awalnya dibangun di atas Qwen3.5-9B, dengan rencana perluasan ke MAI milik Microsoft dan model OpenAI lainnya.
- Versi awal dibangun di atas Qwen3.5-9B, dengan rencana perluasan ke MAI milik Microsoft dan model OpenAI lainnya.
- Model ini memproses konteks masukan panjang hingga 32.000 token dalam satu inferensi.
- Pada 8 variasi masukan, tingkat perubahan penilaian rata-rata 1,3%; mengubah deskripsi opsi atau membalik dan mengacak urutannya tidak mengubah penilaian.
- Tersedia melalui MS Foundry dan OpenRouter, dengan harga 0,042 dolar per juta token masukan dan token keluaran gratis.
Bagi pengembang agen, Decision-1 mengembalikan probabilitas terkalibrasi dalam satu inferensi sehingga dapat dipakai sebagai lapisan kendali berbasis keyakinan yang mengeksekusi kasus jelas secara otomatis dan mengeskalasi kasus ambigu.
LegalOn memangkas separuh biaya Codex sambil mempertahankan kecepatan pengembangan
LegalOn memangkas 65% estimasi biaya Codex harian sambil mempertahankan kecepatan pengembangan. Perusahaan mencocokkan Astra, Sol, dan Luna dengan tugas serta mengelola anggaran secara strategis.
- LegalOn memangkas 65% estimasi biaya Codex harian.
- Perusahaan mempertahankan kecepatan pengembangan sambil menekan biaya.
- Perusahaan mencocokkan Astra, Sol, dan Luna dengan tugas serta mengelola anggaran secara strategis.
Bagi pembangun AI, ini menunjukkan bahwa mencocokkan model dengan tugas dan mengelola anggaran secara strategis dapat menekan biaya agen pengkodean secara tajam tanpa mengorbankan kecepatan pengembangan.
Google Research merilis laporan masalah terbuka privasi dan keamanan agen dari sudut pandang kontekstual
Google Research merilis laporan lokakarya yang disusun bersama lebih dari 50 peserta akademisi dan industri, yang memaparkan tantangan dasar privasi dan keamanan agen AI otonom serta mengusulkan pendekatan berlapis berbasis Contextual Integrity pada tingkat sistem, model, pengguna, dan ekosistem.
- Laporan ini berasal dari Google Contextual Agent Privacy and Security (CAPS) Workshop yang digelar pada akhir 2025 di New York City, dengan lebih dari 50 peneliti dan pemimpin industri sebagai peserta.
- Laporan menganjurkan mesin kebijakan kontekstual sebagai bagian dari lapisan pengawas yang mengevaluasi apakah aliran data yang diminta sesuai sebelum informasi apa pun meninggalkan ruang kerja pengguna.
- Laporan menyerukan tolok ukur multi-agen terstandar, yang digambarkan sebagai lingkungan “Agent Gym” dinamis untuk menyimulasikan secara aman interaksi kompleks dan berjenjang dalam periode panjang.
Bagi pembangun AI, laporan ini mengubah Contextual Integrity menjadi arah desain lapisan pengawas dan mesin kebijakan yang dapat diimplementasikan, sekaligus menandai belum adanya tolok ukur keamanan multi-agen bersama.
Setelah menelaah 1.933 makalah IROS, kami melihat enam perubahan baru di robotika
Leiphone menelaah 1.933 makalah IROS dan mengidentifikasi enam perubahan baru dalam penelitian robotika.
- Telaah mencakup 1.933 makalah IROS.
- Leiphone melaporkan enam perubahan baru di bidang robotika.
Bagi peneliti robotika, telaah makalah berskala besar ini menjadi acuan untuk melacak tren penelitian IROS.
Studi baru Ant×Universitas Zhejiang: membuat AI 'membaca' emosi dalam dialog streaming | EMNLP'26
Studi baru dari Ant dan Universitas Zhejiang mengusulkan metode agar AI mengenali emosi selama dialog streaming, dan karya ini diterima di EMNLP'26.
- Penelitian dilakukan bersama oleh Ant dan Universitas Zhejiang.
- Karya ini diterima di EMNLP'26.
- Studi berfokus pada pemahaman emosi dalam dialog streaming.
Bagi pengembang sistem dialog waktu nyata, pengenalan emosi dalam konteks streaming layak dimasukkan ke evaluasi dan desain produk.
Model besar open source Zidong Taichu memimpin 8 dari 9 benchmark internasional yang otoritatif
Menurut Departemen Ekonomi dan Teknologi Informasi Provinsi Hubei, model besar open source Zidong Taichu meraih peringkat pertama dalam 8 dari 9 benchmark internasional yang otoritatif.
- Menurut Departemen Ekonomi dan Teknologi Informasi Provinsi Hubei, model besar open source Zidong Taichu meraih peringkat pertama dalam 8 dari 9 benchmark internasional yang otoritatif.
Bagi pengembang AI, peringkat pertama Zidong Taichu dalam 8 dari 9 benchmark internasional yang otoritatif menambah titik pembanding yang kuat saat mengevaluasi model open source.
Perbaikan yield “tidak cukup hanya dengan LLM”: startup AI AS menggabungkan AI konvensional untuk memverifikasi jawaban
Menurut EE Times Japan, sebuah startup AI AS berpendapat LLM saja tidak cukup untuk perbaikan yield dan menggabungkannya dengan AI konvensional untuk memverifikasi jawaban.
- EE Times Japan melaporkan bahwa perbaikan yield “tidak cukup hanya dengan LLM”.
- Startup AI AS tersebut menggabungkan LLM dengan AI konvensional dan memverifikasi jawaban.
Bagi pembangun AI, ini menandakan perbaikan yield memerlukan arsitektur hibrida LLM dan AI konvensional dengan verifikasi jawaban.