Mari Membuat AI Terkuat dengan AI — Bot Shadowverse WB yang Makin Lemah Setelah Melihat Tiga Turn Kini Menalar Mundur dari Jalur Menang, Jalur Kalah, dan Hasil “Paksa” dengan Batas Bukti yang Jelas

Bahan: Shadowverse: Worlds Beyond

Mengulang kesalahan sepuluh ribu kali tidak membuatnya menjadi kebenaran.

Cara memakai fitur membaca

Dengarkan membacakan artikel. Baca cepat menampilkan frasa berurutan dengan kecepatan pilihan Anda. Latihan bahasa membandingkan terjemahan yang tersedia. Simpan menambahkan penanda di browser ini; buka kembali dari daftar tersimpan di pemutar.

Bagikan artikel ini

Bagikan artikel ini

Iklan
Iklan

1. Awalnya cuma mau Storm ke muka, malah jadi laboratorium

Tujuannya sederhana: pakai AI untuk mencari deck terkuat saat ini. Set 8, database 826 kartu, engine commit, environment hash, deck legal, dan seed dibekukan. Baseline historis 12.480 game punya rule coverage 100%, unsupported 0, rule gap 0, tetapi AI mentah masih memberi hasil aneh seperti Sword ~79,8% dan Rune ~25,6%.

Mengulang kesalahan sepuluh ribu kali tidak membuatnya menjadi kebenaran.

2. Nasihat manusia membuat bot melemah dan rata-rata menyembunyikan kebakaran

human-prior-v1 diuji pada 2.016 paired units / 4.032 games: baseline 50,99%, baru 49,36%, -1,64pt. Adaptive v2 naik +0,74pt secara total tetapi Runecraft turun -6,25pt dan gagal leader floor; T11 juga gagal termasuk Abysscraft -16,67pt.

Nasihat manusia bergantung konteks; fixed weight bisa membunuh konteks. Nilai rata-rata lulus tidak berarti semua leader aman.

3. Analisis akar masalah menemukan bug di laboratorium sendiri

Kontrak max_nodes=160 yang tidak tersambung dan kesalahan perspektif actor/fixed-player yang membalik interpretasi kausal telah diperbaiki. Kualitas platform naik, tetapi performa luas belum pulih.

Riset kebijakan Set 8 berhenti setelah 20 eksperimen dan 31.406 engine games di PAUSED_COMPLETE_NO_PROMOTION: 439 discordant units, 0 penjelasan kausal lengkap, 11 parsial, 428 belum selesai. human-prior-v1 tetap aktif dan final unseen holdout 8.064 game tetap disegel.

4. 52 deck bertarung 46.900 game dan lahirlah “ranking sesama otak mati”

Corpus pasar berisi 52 decks / 25 archetypes / 7 leaders. Analisis pasar memakai 46.900 game; direct 7×7 terpisah memakai 1.512. Rata-rata: Buff Forest 71,99%, Rally Sword 65,97%, Midrange Abyss 54,17%, Artifact Portal 54,17%, Ramp Dragon 53,70%, Evolution Haven 31,71%, Calgidensula Witch 18,29%.

Ini nilai simulator-direct, bukan ladder WR. Deck yang aksi kuat sekarang biasanya tetap kuat nanti tampak lebih mudah bagi AI saat ini.

5. Di turnamen manusia, Witch hidup di alam semesta lain

Pada Dexel Rising Cup #2 tanggal 8 Agustus 2026, Hand Witch muncul 116 dari 384 daftar, ~30,2%, terbanyak. Calgidensula Witch justru terakhir di direct 7×7 AI dengan 18,29%. Kita tidak boleh menganggap keduanya identik 40 kartu, tetapi gap manusia-AI jelas besar.

Rally Sword kuat di kedua dunia, memberi hipotesis praktis bahwa strategi yang tahan terhadap keputusan kurang sempurna mungkin lebih ramah untuk pemain biasa.

6. Future Optionality: aturan ada, urutan dan rencana hampir tidak ada

Audit 7 leaders / 24 mechanics pada RULE, STATE, VISIBILITY, IMMEDIATE VALUE, FUTURE VALUE, SEQUENCE, SEARCH, PLAN. Dari 27.810 decisions / 118.575 root candidates, hanya 8.878 atau 7,49% punya future value eksplisit. rule/state/immediate 24/24 supported, tetapi sequence MISSING 23/24 dan plan MISSING 20/24.

Witch menunjukkan efek urutan draw; Dragon menunjukkan PP dan Awakening membuka opsi masa depan. Dua belas MYOPIC_REVERSAL Dragon = ramp 6 + Awakening 6, tetapi tidak dijadikan bonus hard-code.

7. Planner closed-loop tiga turn benar-benar dibangun

Engine maju minimal 3 future turn boundaries, menjalankan satu action, mengamati draw/random/opponent action, lalu merencanakan ulang. Hidden hand dan future draw order tidak dilihat.

Ablation 56 game: 3.979/3.979 root actions, 3-turn completion 100%, hidden-info 0, replans 81.621, plan changes 35.821. Implementasi berhasil, performa turun -25,0 sampai -37,5pt vs human-prior-v1. Bisa melihat lebih jauh hanya membuat bot salah lebih jauh.

8. Leaf calibration memisahkan tempat ranking rusak

Terekam 3.979 root-action leaves, 1.009 unique leaves, 54.208 terminal rollout rows. Dari 73 first divergence: leaf weighting 59, chance aggregation 12, opponent backup 2.

Masalah utama bergeser ke evaluasi leaf. Dari 12 proxy Dragon lama, hanya 1/12 yang benar-benar berubah ke ramp pada search tiga turn nyata.

9. Learned value memprediksi lebih baik tetapi memilih aksi terbaik lebih buruk

Holdout v1.1 baru: 727 leaves / 104 roots / 22.768 terminal rollouts, tujuh leaders. Brier 0,1144→0,0972 dan pairwise 75,7→78,9% membaik.

Namun root argmax 59,6→39,4%, top2 73,1→64,4%, top3 82,7→76,0%, mean regret 4,42→5,29pt; Forest/Haven/Portal gagal floor. HOLD_OFFLINE.

Prediksi probabilitas yang lebih bagus tidak sama dengan memilih tombol yang benar.

10. Sekarang menalar mundur dari lethal

LETHAL ← damage ← PP ← cards ← threshold Spellboost/Awakening/Rally ← current action. Ramp tidak bernilai karena “+8 poin”; ia bernilai ketika jalur menang nyata membutuhkan 8PP tepat waktu.

Goal menghasilkan syarat ke belakang, lalu engine nyata menguji jalur ke depan.

11. Jalur kematian sendiri juga dihitung mundur

Dari SELF_LOSS diturunkan kebutuhan damage lawan, board damage, tambahan hand damage, syarat menghapus Ward, PP, dan informasi publik. Setiap action dilihat dari jalur menang lawan yang dipotong.

Keamanan absolut menciptakan AI yang heal terus sampai kalah dengan sopan. RISK_REQUIRED mengizinkan jalur berisiko non-forced-loss ketika jalur aman hampir tidak menyisakan peluang menang.

12. Kata “forced” wajib punya batas bukti

Label menang: PROVEN_WIN_NOW, FORCED_WIN_FULLY_OBSERVABLE_SUBTREE, FORCED_WIN_WITHIN_ENUMERATED_RESPONSE_SET, ROBUST_WIN_BELIEF, CONDITIONAL_WIN. Kalah juga dipisah menjadi proof, belief, dan conditional.

Dalam proof search, self=OR dan opponent=AND. Kepastian pada chance harus mencakup semua reachable outcomes. Hidden-hand truth, future draw order, dan strategy fusion dilarang; replan hanya setelah observasi.

13. Prioritas action menjadi gate bertahap

Urutan: proven win now → fully observable forced → enumerated forced → buang forced loss yang bisa dihindari → maksimalkan expected final win probability → near-tie safety → robustness → route progress/cut → validated continuation value.

belief/conditional bukan forced. Hanya action yang lebih buruk baik dalam peluang menang maupun loss risk yang boleh dibuang sebagai strictly dominated.

14. Tiga turn adalah jarak minimum, bukan tembok

Konfigurasi awal H_MIN=3, selective H_MAX=5. Hanya branch dengan lethal, forced response, threshold penting, delayed payoff, atau near tie yang belum selesai diperpanjang.

Rollout mulai 32/candidate; top yang ambigu mendapat 64→128→256. Root menjadi UNIQUE_BEST / PRACTICAL_TIE / UNRESOLVED. epsilon 0,02/0,03/0,05 dipilih hanya pada development lalu dibekukan sebelum holdout baru.

15. QC baru: tangkap kesalahan penuh percaya diri sebelum mengejar AI terkuat

Primary menuntut 0 hidden-info, future-draw, rule gap, strategy fusion, false proven, forced-scope mislabel, chance-completeness violation, lethal miss, avoidable forced loss, dan leakage. Setelah itu cek coverage 7 leaders, argmax, mean/p90/p95 regret, leader floors, dan top2 best-set.

Brier/pairwise/calibration adalah Secondary dan tidak menyelamatkan kegagalan Primary. Holdout v1.1 sudah habis dipakai selamanya.

Kita memberi masa depan pada bot dan ia melemah. Kita mengajarinya probabilitas dan prediksi membaik tetapi pilihan terbaik memburuk. Sekarang ia menalar mundur dari menang dan kalah, dan hanya menyebut sesuatu “forced” jika bukti benar-benar mendukungnya.

Mari membuat AI terkuat dengan AI. Untuk sementara QC mungkin lebih kuat daripada bot game; itu justru sehat.


Bagikan artikel ini

Iklan

Satu lagi? Ada yang seru?

Mumpung sudah selesai membaca: beberapa cerita yang mirip dan beberapa yang beda sama sekali tapi seru.

  1. Topik serupaKenapa Semua Seranganku Kalah?Pemain Pyra/Mythra Melawan Intangibility Kazuya dan Perut Buaya
  2. Rasa “Ada yang Aneh” Adalah Laporan BugDari “Jangan Suruh Saya Bertarung di Luar Pertandingan” ke Layanan, Lingkungan, dan Relasi yang Lebih Matang
  3. Beda sama sekali, tapi seruBagaimana “balik modal” saat makan malam di Shabu-yo?Benarkah 12 piring daging sapi adalah batasnya, dan mengapa Gusto serta Shabu-yo memakai merek berbeda padahal sama-sama milik Skylark?
  4. Pikiran Berkata “Lanjut”, Tubuh Berkata “Tunggu”Gairah Seksual yang Bergantung pada Konteks, Keintiman, dan Sistem Saraf Otonom
  5. Tubuh manusia ribet bangetkenapa tidak ada satu stat “stamina +1”?
  6. Tuan Daya Pertimbangan!?Memahami keputusan melalui “keluasan × daya dorong” dan “poros diri × poros orang lain”

Baca ini hari ini

Masing-masing menjawab pertanyaan yang biasanya muncul setelah membaca artikel ini.

Lihat semua artikelLebih banyak tentang Game kartu dan papan

Cari artikel lain

Semua artikel

Mendoi-chan

Pengelola situs

Mendoi-chan

Mengubah kerepotan di tempat kerja dan kehidupan sehari-hari menjadi struktur yang jelas dan langkah berikutnya.

Iklan

Artikel terbaru

  1. 1Pastor pencuri pakaian dalam ditangkap, tapi “Om Penanam Benih” jadi pahlawan? Manga memangkas fetish yang paling niche, sementara web novel membangkitkan “Kehamilan Imajinatif”
  2. 2Manusia Tidak Akan Menang — Saya Menikmati PRAGMATA Seperti Museum Bulan, Lalu Menyadari Betapa Menyeramkannya Produksi Massal Peradaban Mesin
  3. 3Untuk yang Sulit Melakukan Sesuatu Sendirian: Bongkar “Kalau Tak Ada Teman, Aku Tak Jalan” dan Bangun “OS Aksi Solo”
  4. 4fasilitas Bulan belum selesai rusak, sistem kontrol saya sudah menyerah duluan
  5. 5KPR 50 tahun tidak membuat rumah lebih murah — utang, risiko bunga, dan pengawasan FSA Jepang
Iklan