Tratopedia
ES
Tetapan

Saiz teks

Tema

Kontras tinggi

Versi

v1.81.0

Keluaran yang menjadi asas halaman ini dibina. Itulah versi yang disimpan oleh service worker.

Model terbuka · Model bahasa · Keupayaan AI · Geopolitik · Taklimat ModelDilancarkan 15 Jul 2026 · rekod sehingga 26 Ogos 2026

Ringkasan Eksekutif · Taklimat Satu Halaman

Model Terbuka, Diajar Sebahagiannya oleh Pesaing yang Dijawabnya

Thinking Machines Lab — diasaskan oleh bekas CTO OpenAI Mira Murati — melancarkan model pemberat terbukanya yang pertama, Inkling, pada 15 Jul 2026: MoE multimodal 975B / 41B aktif dengan konteks pemberat terbuka 1J token, lesen Apache 2.0, dan tombol daya pemikiran. Ia tiba dalam pasaran yang sudah dikuasai makmal China dari segi jumlah — ukuran bebas meletakkan model terbuka China pada kira-kira 61% token yang dihalakan di OpenRouter menjelang Mei 2026, manakala Llama milik Meta sendiri di bawah 1%. Enam minggu kemudian, Inkling dinilai secara bebas sebagai pelancaran model terbuka terkehadapan daripada sebuah makmal AS. Dan catatan rasmi Thinking Machines tentang cara ia dibina menyatakan dengan jelas bahawa pasca-latihannya turut menggunakan data sintetik daripada Kimi K2.5 — salah satu model yang menjadi ukuran perbandingannya sendiri.

Mengikut Angka disahkan terus dengan repositori dan tapak rasmi Thinking Machines

  • 975B/41BMoE multimodal — jumlah / parameter aktif
  • 1Mkonteks pemberat terbuka (Tinker hidangkan 256K / 64K)
  • 41Indeks Kecerdasan Artificial Analysis — skor terkehadapan AS
  • 98.6%StrongREJECT (FORTRESS 78.0% adversarial / 95.9% jinak)

Apa Yang Berlaku, Mengikut Tahap disahkan pada bahan rasmi Thinking Machines melainkan dinyatakan sebaliknya

TarafApa yang berlakuBila
DisahkanInkling dilancarkan: MoE 975B jumlah / 41B aktif, konteks pemberat terbuka 1J token, Apache 2.015 Jul 2026
DisahkanSFT permulaan pasca-latihan menggunakan data sintetik daripada model terbuka, “termasuk Kimi K2.5semasa latihan, menurut catatan rasmi
DisahkanRantaian pemikiran secara spontan memadat selepas melebihi 30 juta giliran RL, tanpa didorong ganjaransemasa latihan RL
Disahkan tetapi tidak dapat disahkan di siniInkling “menunjukkan corak ketidakpatuhan penapisan yang kuat” dalam Penilaian Penapisan Cognitiondakwaan rasmi TM; tiada skor bebas Cognition khusus untuk Inkling ditemui
DisahkanInkling-Small dilancarkan dengan pemberat penuh: 276B jumlah / 12B aktif30 Jul 2026
Disahkan, bebasInkling mendebut dengan 41 mata pada Indeks Kecerdasan Artificial Analysis — skor model terbuka terkehadapan daripada makmal AS15 Jul 2026

Garis Masa Jun–Ogos 2026, setiap peristiwa bertarikh pada sumber primernya sendiri

  1. 24 Jun 2026Analisis bebas (Data Gravity) melaporkan model terbuka China pada ~61% token yang dihalakan OpenRouter menjelang Mei 2026; Llama milik Meta di bawah 1%.
  2. 30 Jun 2026Bridgewater AIA Labs dan Thinking Machines menerbitkan kajian kes penalaan halus Tinker — ke atas Qwen3-235B, dua minggu sebelum Inkling wujud.
  3. 10 Jul 2026Thinking Machines menerbitkan “Masa Depan Yang Wajar Dibina Ialah Manusiawi,” memetik Hayek tentang pengetahuan tersebar dan memberi amaran terhadap penumpuan pembangunan AI pada segelintir makmal — tanpa menamakan mana-mana negara.
  4. 15 Jul 2026Inkling dilancarkan; akses API hari sifar melalui Together AI, Fireworks, Modal, Databricks dan Baseten. Artificial Analysis memberikan skor 41 pada Indeks Kecerdasannya pada hari yang sama.
  5. 30 Jul 2026Inkling-Small dilancarkan dengan pemberat penuh (276B jumlah / 12B aktif); Artificial Analysis memberikan skor 40, sepadu Inkling dengan kurang sepertiga parameter.
  6. 31 Jul 2026Thinking Machines menerbitkan catatan proses keselamatannya: ujian dalaman, empat pasukan red-team luar yang dinamakan, dan semakan penalaan halus adversarial ke atas kedua-dua model.
  7. 26 Aug 2026Hugging Face merekodkan 166,108 muat turun dan 1,749 suka bagi Inkling, serta 168,647 muat turun dengan 379 suka bagi Inkling-Small.

Kronologi ini penting kerana dua peristiwa ini mudah dikelirukan. Kajian kes Bridgewater/Tinker — Qwen3-235B yang ditala halus mengatasi model frontier dalam pengelasan dokumen kewangan — diterbitkan dua minggu sebelum Inkling wujud. Ia menunjukkan apa yang boleh dicapai penalaan halus di atas platform Tinker milik Thinking Machines; ia tidak menyatakan apa-apa tentang prestasi Inkling sendiri, dan tiada kes penggunaan khusus Inkling didokumentasikan secara umum. Ia disertakan di sini kerana ia bukti ekonomi platform di sebalik kisah penalaan halus Inkling sendiri, bukan kerana ia mengenai Inkling.

Untuk Apa Kata Thinking Machines Inkling Dibina dipetik daripada bahan rasmi Thinking Machines

Thinking Machines menyatakan pendiriannya dengan jelas: Inkling “bukan model paling kuat yang tersedia hari ini, sama ada terbuka atau tertutup.” Pertaruhannya ialah gabungan — keupayaan multimodal, tombol daya pemikiran yang cekap dan boleh dikawal, serta ketersediaan di Tinker untuk penalaan halus — yang menjadikannya “asas pemberat terbuka yang baik untuk penyesuaian,” bukan calon papan pendahulu. Senibina: transformer penyahkod sahaja 66 lapisan yang menghalakan setiap token kepada 6 daripada 256 pakar ditambah 2 pakar kongsi yang sentiasa aktif, perhatian hibrid tempatan/global, dan reka bentuk multimodal tanpa pengekod — imej dikod sebagai tampalan, audio diwakili sebagai spektrogram dMel, kedua-duanya diunjur ke ruang tersembunyi yang sama dengan teks. Julat teknikal tombol daya pemikiran ialah 0 hingga 0.99; lengkung penanda aras rasmi Thinking Machines pula menyapu dari 0.2 hingga 0.99, yang mana Inkling mencapai skor Terminal Bench 2.1 tertentu pada kira-kira satu pertiga token Nemotron 3 Ultra.

  • 0–0.99tombol daya pemikiran — julat teknikal penuh
  • 30M+giliran RL → pemadatan CoT secara spontan

Pasaran yang Dimasukinya, dan Kerumitannya dipetik mengikut nama, bukan tafsiran sendiri

Dua ukuran bebas merangka keadaan yang dimasuki Inkling. Analisis penghalaan token Data Gravity sendiri: menjelang Mei 2026, model terbuka China menguasai kira-kira 61% token yang dihalakan di OpenRouter, “empat daripada lima model paling banyak digunakan adalah China — dan Llama milik Meta, peneraju terbuka dua tahun lalu, telah tersingkir sepenuhnya daripada senarai,” di bawah 1% jumlah dihalakan. Artificial Analysis, pada hari yang sama Inkling dilancarkan: ia “pelancaran model terbuka terkehadapan daripada sebuah makmal AS,” tiga mata mengatasi peneraju sebelumnya, Nemotron 3 Ultra. Kerumitannya ialah alasan rasmi Thinking Machines sendiri tidak merangkanya sedemikian. Manifestonya, diterbitkan lima hari sebelum pelancaran, berhujah menentang penumpuan pembangunan AI pada segelintir makmal seakan “perancangan pusat,” memetik Hayek tentang pengetahuan tersebar — dan tidak sekali pun menamakan China. Rangka “jawapan Barat” itu milik ukuran pasaran bebas di atas, bukan kata-kata Thinking Machines sendiri. Dan pasca-latihan Inkling sendiri merumitkan mana-mana rangka yang digunakan: penalaan permulaannya menggunakan data sintetik daripada model terbuka, “termasuk Kimi K2.5” — salah satu model China yang disebut dalam angka kuasa pasaran itu sendiri.

Kes Tinker, Dikira Semula Daripada Cartanya Sendiri bukan Inkling — Qwen3-235B, ditala halus dua minggu sebelum Inkling dilancarkan

ModelKetepatanKos / 1,000 tugas
Model terlatih Bridgewater (Qwen3-235B, ditala halus)84.7%$4.72
GPT 5.578.2%$65.06
Claude Opus 4.878.0%$92.59
Claude Opus 4.677.2%$61.52
GPT 5.475.8%$28.50
Gemini 3.1 Pro74.3%$31.77

Perbandingan yang diterbitkan bersama oleh Bridgewater dan Thinking Machines meletakkan model tala halusnya berbanding enam model frontier. Yang terkuat bagi tugas ini ialah GPT 5.5, pada ketepatan purata 78.2% dan $65.06 bagi setiap seribu tugas; Claude Opus 4.8 mencatat 78.0% tetapi berharga $92.59, yang termahal dalam set itu. Qwen3-235B yang ditala halus mencapai 84.66% pada $4.7213.8 kali lebih murah daripada GPT 5.5, angka yang dinyatakan sendiri oleh siaran itu, dan 19.6 kali lebih murah daripada Claude Opus 4.8. Dua kaveat mengiringinya: kajian itu ialah penerbitan bersama antara vendor platform dengan pelanggannya, tanpa replikasi bebas, dan ia mengukur tala halus Qwen3-235B, bukan Inkling.

Ujian Keselamatan daripada “Laluan Selamat ke Pemberat Terbuka,” 31 Jul 2026

  • Dalaman · tiga trek

    Pengetahuan Bahaya, Penyalahgunaan, Bahaya Multimodal

    • Pengetahuan dan keupayaan operasi CBRN serta siber ofensif, diuji secara dalaman.
    • Ujian bahaya multimodal merentasi 17 bahasa serta input teks, imej dan audio.
  • Luar · empat penguji dinamakan

    Scale AI, Handshake AI, FAR.AI, Apollo Research

    • Masing-masing diberi mandat berbeza: penyalahgunaan am, bahaya pengguna terdedah, pencungkilan CBRN/siber, tingkah laku kehilangan kawalan.
    • Tiada satu pun menemui keupayaan yang jauh melangkaui risiko sedia ada model terbuka.

Menanggalkan Sekatan Keselamatan Secara Sengaja ujian penalaan halus adversarial

Oleh kerana pemberat terbuka boleh ditala semula untuk menanggalkan latihan penolakan, Thinking Machines menala halus varian “hanya membantu” bagi kedua-dua Inkling dan Inkling-Small — dioptimumkan secara sengaja untuk patuh dan bukan menolak — lalu mengujinya dengan penilaian dwiguna yang sama. Kesimpulan rasminya: “varian hanya-membantu itu tidak memberikan sebarang keupayaan baharu pada tugas CBRN dan siber, dan kekal setanding model terbuka sedia ada.” Digabungkan dengan hasil dalaman dan luaran, Thinking Machines menyimpulkan pelancaran Inkling tidak menambah risiko material melebihi apa yang sudah ditimbulkan model terbuka yang boleh dimuat turun.

Inkling-Small, Enam Minggu Kemudian penanda aras bebas, Artificial Analysis

Pecahan rasmi Artificial Analysis, diterbitkan pada hari Inkling-Small dilancarkan: ia sedikit mengatasi Inkling pada Humanity's Last Exam (32% berbanding 30%) dan GPQA Diamond (89% berbanding 87%) dengan kurang sepertiga parameter, tetapi ketinggalan pada kerja agentik — τ³-Banking 15% berbanding 24% Inkling — dan mencatat skor negatif pada indeks kalibrasi fakta Artificial Analysis sendiri, sedangkan Inkling mencatat skor positif, “bermakna jawapan salah melebihi jawapan betul.” Kedua-dua model diletakkan berdekatan secara bebas pada Indeks Kecerdasan (40 berbanding 41), iaitu ringkasan yang lebih kasar berbanding mana-mana keputusan individu ini dan tidak dengan sendirinya menunjukkan model mana sesuai untuk tugas yang mana.

Kesimpulan apa yang jelas, dan apa yang belum

Apa Itu Inkling

Pelancaran model terbuka yang tulen dan didokumentasikan dengan baik — MoE 975B/41B, konteks pemberat terbuka 1J token, Apache 2.0 — dinilai secara bebas sebagai kemasukan model terbuka terkehadapan AS enam minggu kemudian, dalam pasaran yang sudah dikuasai makmal China dari segi jumlah.

Apa Yang Ditambah Catatan Rasminya

Menurut catatan Thinking Machines sendiri, pasca-latihan Inkling dimulakan dengan satu pusingan awal penalaan halus terselia atas data sintetik daripada model terbuka, “termasuk Kimi K2.5” — salah satu model China yang menjadi ukuran perbandingannya. Syarikat itu menyatakan permulaan tersebut hanya “sebahagian kecil daripada pengiraan”, dengan sebahagian besarnya digunakan untuk pembelajaran pengukuhan berskala besar; jadi ia titik permulaan, bukan intipati model itu.

  • Kes ekonomi Bridgewater/Tinker adalah benar dan didokumentasikan dengan baik, tetapi ia adalah penalaan halus Qwen3-235B sebelum Inkling wujud. Tiada penggunaan korporat khusus Inkling didokumentasikan — kekalkan jurang itu, bukannya membaca kes Tinker sebagai bukti keputusan Inkling sendiri.
  • Hasil Penilaian Penapisan Cognition ialah dakwaan Thinking Machines sendiri tentang modelnya sendiri. Tiada skor Cognition yang diterbitkan secara bebas dan menamakan Inkling ditemui — fakta yang wajar diketahui sebelum menganggap penemuan ini sudah disahkan secara bebas.
  • “Jawapan Barat kepada model terbuka China” ialah tafsiran kuasa pasaran yang diukur secara bebas (Data Gravity, Artificial Analysis), bukan hujah rasmi Thinking Machines sendiri, yang tidak pernah menamakan China. Kekalkan kedua-duanya berasingan.

Sumber, semuanya diperoleh terus dan ditangkap pada 26 Ogos 2026 melainkan tarikh tangkapan atau penerbitan lain dinyatakan: siaran pelancaran rasmi Inkling dan Inkling-Small oleh Thinking Machines Lab, halaman produknya, repositori model di Hugging Face (kad model, config.json dan rekod API langsung), “Masa Depan Yang Wajar Dibina Ialah Manusiawi,” dan “Laluan Selamat ke Pemberat Terbuka” · siaran bersama Bridgewater AIA Labs/Thinking Machines mengenai ekonomi penalaan halus Tinker, dibaca daripada data carta terbenamnya sendiri · dua artikel bebas Artificial Analysis pada hari pelancaran setiap model · “China's Open-Weight Takeover” (Chris Zeoli, Data Gravity) · siaran metodologi Cognition sendiri, dibaca untuk menyemak sama ada terdapat skor khusus Inkling.