LingVo.club
Level
Mengapa model sulit mengalikan empat digit — Level B1 — brown wooden blocks on white surface

Mengapa model sulit mengalikan empat digitCEFR B1

29 Des 2025

Level B1 – Menengah
3 mnt
141 kata

Penelitian ini menguji bagaimana metode pelatihan memengaruhi kemampuan model untuk menyimpan dan menggunakan kembali hasil perhitungan antara. Tim membandingkan fine-tuning standar dan Implicit Chain of Thought (ICoT), serta mengamati masalah ketergantungan jangka panjang yang muncul pada perkalian empat digit.

Pada fine-tuning standar, model dengan dua sampai dua belas lapis mencapai akurasi yang sangat rendah karena terjebak pada pola permukaan dalam data. Sebaliknya, model ICoT mencapai 100% akurasi. Analisis keadaan internal menunjukkan bahwa ICoT mengkode dan menyimpan nilai antara; peneliti bahkan berhasil mendekode jumlah berjalan dari hidden states tersebut.

Lebih jauh, ICoT mengatur mekanisme perhatian melintasi waktu: lapisan awal menghitung dan menyimpan produk pasangan digit di lokasi tertentu, sedangkan lapisan akhir mengambil kembali nilai itu untuk membentuk digit jawaban akhir. Menambahkan tujuan pelatihan untuk melacak jumlah berjalan pada model sederhana meningkatkan akurasi secara dramatis tanpa supervisi chain-of-thought eksplisit.

Kata-kata sulit

  • akurasitingkat benar dalam hasil atau prediksi
  • ketergantungan jangka panjangketergantungan selama periode waktu lama
  • jumlah berjalantotal sementara yang terus diperbarui
  • keadaan internalinformasi tersembunyi di dalam model
  • mengkodemengubah informasi menjadi bentuk tersimpan
  • mendekodemengubah kembali informasi tersimpan menjadi data
  • mekanisme perhatiancara model fokus pada bagian informasi penting
  • lapisanbagian bertumpuk atau tingkat dalam model
    lapisan awal, lapisan akhir

Tips: arahkan kursor, fokus, atau ketuk kata yang disorot di dalam teks untuk melihat definisi singkat sambil membaca atau mendengarkan.

Pertanyaan diskusi

  • Bagaimana menurut Anda menyimpan nilai antara di keadaan internal bisa membantu model menyelesaikan perkalian panjang? Jelaskan dengan satu atau dua alasan.
  • Apakah menambahkan tujuan pelatihan untuk melacak jumlah berjalan bisa berguna untuk tugas lain selain perkalian? Beri contoh singkat.
  • Mengapa fine-tuning standar mungkin membuat model 'terjebak pada pola permukaan' menurut teks? Apa konsekuensinya bagi akurasi?

Artikel terkait

Perdebatan Penilaian dalam Kendo — Level B1
27 Agu 2025

Perdebatan Penilaian dalam Kendo

Skor kendo ditentukan oleh hakim berdasarkan ki-ken-tai no icchi: waktu, bentuk, dan niat. Keluhan soal keputusan tidak konsisten memicu diskusi tentang teknologi, senioritas, dan kebutuhan memperkuat teknik dasar serta standar penilaian.