Argument Mining

How Argumentree Turns a Transcript Into an Argument Tree

AT
Argumentree Team
Decision Science
July 29, 2026
9 min oku
How Argumentree Turns a Transcript Into an Argument Tree

Argumentree, Bir Transkripti Nasıl Bir Argüman Ağacına Dönüştürür | Argumentree

Argumentree, yapılandırılmamış bir transkripti veya belgeyi artı ve eksi argüman ağacına dönüştürmek için argüman madenciliği kullanır. Çıkarma dört şey yapar: iddiaları veya nedenleri taşıyan metin parçalarını bulur, her birinin ne olduğunu etiketler, hangi nedenin hangi iddiaya bağlı olduğunu belirler ve her bağlantının yukarıdaki şeyi destekleyip desteklemediğine karar verir. İki tasarım seçeneği çıktıyı şekillendirir. İlk olarak, argümanlar Maliyet, Risk, Zaman Çizelgesi veya Hukuki gibi tek kelimelik kategorilere gruplandırılır ve her kategori için tam olarak bir argüman, o kategorinin ana iddiası olarak öne çıkarılır. İkinci olarak, ana iddia modelin kendi güven puanı tarafından seçilmez. Güven, çıkarımın ne kadar kesin olduğunu ölçer, argümanın ne kadar merkezi olduğunu değil ve sözlü LLM güveninin kötü kalibre edildiği bilinmektedir. Bunun yerine, ana iddia birden fazla sinyalden bir arada seçilir; bunlar arasında en güçlü olanı merkezilik — ona kaç tane diğer argümanın bağlı olduğu — ve soyutluktur, çünkü ana iddia genel bir pozisyondur, destekleyici kanıtları ise spesifiktir. Yüzde, para birimi veya adlandırılmış bir çalışmayı içeren bir argüman, iddia olarak değil, bir iddianın kanıtı olarak değerlendirilir. Her çıkarılan argüman, kaynağı kelimesi kelimesine alıntı yapmalıdır; orijinal metinde bulunamayan herhangi bir şey, ağaç gösterilmeden önce düşürülür. Çıktı, insanların düzeltmesi, yeniden yapılandırması ve derecelendirmesi için bir taslaktır, bir hüküm değil.

Share:
Kısa Özet

Çıkarma kolay kısımdır. Zor kısım ise yapı — ana noktanın ne olduğunu, bunun için yalnızca kanıt olanın ne olduğunu ve aslında buna karşı argüman sunan şeyin ne olduğunu belirlemektir.

  • Argümanlar tek kelimelik kategorilere gruplandırılır — Maliyet, Risk, Zaman Çizelgesi, Hukuki — ve her kategori için tam olarak bir tanesi o kategorinin ana iddiası haline gelir.
  • Ana iddia, modelin en çok güvendiği iddia değildir. Güven ölçüleri, çıkarımın kesinliğini değil, önemini ölçer.
  • Ana iddialar genel; kanıtlar ise spesifiktir. Bir yüzdelik veya adlandırılmış bir çalışmayı içeren bir argüman, bir iddianın destekleyicisi olarak değerlendirilir, iddianın kendisi olarak değil.
  • Her argüman, kaynağı kelimesi kelimesine alıntı yapmalıdır. Orijinal metinde bulunmayan herhangi bir şey, onu görmeden önce atılır.
  • Sonuç bir taslaktır. İnsanlar bunu düzeltir, yeniden yapılandırır ve değerlendirir — makine yapıyı oluşturur, grup ise yargıyı korur.

En Kendine Güvenen Cevap Yanlış Olandı

Doksan dakikalık bir bütçe toplantısını bir çıkarım motoruna yükleyin ve hangi argümanın en önemli olduğunu sorun, genellikle size bir istatistik verir. "finans modeli, operasyonel harcamalarda %20'lik bir azalma öngörüyor" gibi bir şey — kesin, iyi kanıtlanmış ve model bu konuda oldukça emin.

Bu da yanlış bir cevaptır. O cümle argüman değildir. O, kırk dakika önce birinin yaptığı ve çok daha gevşek bir şekilde ifade ettiği bir argümanın kanıtıdır: iki takımı birleştirmeliyiz çünkü bu para tasarrufu sağlayacak. Belirsiz cümle iddiadır. Kesin olan ise onu destekleyendir.

Bu ayrım, bir konuşmayı bir yapıya dönüştürmenin tüm sorununu oluşturur ve kendi toplantı notlarınızı okuduğunuzda aklınızda tutmaya değer. En alıntı yapılabilir görünen cümleler genellikle en az tartışma işlevi görenlerdir.

Çıkarımın Doğru Yapması Gerekenler

Argüman madenciliği — 2019'da John Lawrence ve Chris Reed tarafından incelenen bu araştırma alanı — genellikle dört işe ayrılır ve ilerledikçe zorlaşır.

  • İddialı kısımları bulun. Gerçek bir toplantıdaki çoğu cümle lojistik, selamlaşma veya tekrar ifade etmedir. Sadece bazıları bir iddia veya neden taşır.
  • Her bir kısmı etiketleyin. Bir iddia bir pozisyondur. Bir önermenin nedeni vardır. Kanıt, nedenin arkasındaki veridir. Aynı cümle bir belgede bir iddia, başka bir belgede ise bir önermedir.
  • Neyin neye yanıt verdiğini belirleyin. Bir neden belirli bir iddiaya bağlıdır; bir itiraz belirli bir nedene bağlıdır. İşte bu, bir listeyi bir ağaca dönüştüren şeydir.
  • Destekle veya saldırıya karar ver. Her bağlantı için: bu, bağlı olduğu şeyi güçlendiriyor mu yoksa zayıflatıyor mu?

İlk ikisi büyük ölçüde çözüldü. Son iki sorun ise çözülmedi ve yayımlanan karşılaştırmalar bu farkı açıkça gösteriyor: Christian Stab ve Iryna Gurevych'in anotasyon yaptığı ikna edici makale veri kümesinde, bileşen tespiti yaklaşık %73 F1'e ulaşırken, ilişki tespiti %48 civarında kalıyor. Joonsuk Park ve Claire Cardie'nin oluşturduğu CDCP veri kümesinde, ilişki tespiti yaklaşık %34'e düşüyor.

Yani ilginç tasarım kararları bulmada değil. Onlar yapılandırmada — ve işte burada kategoriler devreye giriyor.

Neden Tartışmalar Kategorilere Ayrılır

Gerçek bir tartışma tek bir şeyle ilgili değildir. İki ekibi birleştirme kararı, aynı anda maliyet, moral, hukuki riskler ve ne kadar sürdüğü ile ilgilidir. Bunlar aynı odada gerçekleşen farklı tartışmalardır ve bunları tek bir listeye indirgemek, kimsenin okuyamayacağı bir şey üretir.

Bu nedenle her çıkarılan argüman, tek kelimelik bir kategori ile etiketlenir — Maliyet, Risk, Zaman Çizelgesi, Hukuki, Güvenlik, Kapsam. Tek kelime, kasıtlı olarak. Kategoriler cümle haline geldiği anda, aynı tema neredeyse kopyalara bölünür: Bütçe Etkisi ve Maliyet Değerlendirmeleri ve Finansal Risk üç farklı şapka takan tek bir tartışmadır ve ağaç, bir olması gereken dallara ayrılır.

Kısıtlama talep edilmekten ziyade zorunlu kılınır. Kategoriler tek bir kanonik forma normalleştirilir ve bir kategori, bir dalın tepe noktasının bir özelliğidir — ana iddianın altındaki her şey, o ana iddianın kategorisini miras alır. Bir maliyet argümanı Risk kategorisinde bir çocuk edinmez; eğer çocuk gerçekten riskle ilgiliyse, bunun yerine Risk ana iddiasının altına ait olur.

Her Kategori İçin Bir Ana Argüman

Her kategori içinde, tam olarak bir argüman ana iddia olarak yükseltilir — o kategorideki her şeyin desteklediği veya saldırdığı merkezi konum. Kategorideki diğer her şey, doğrudan veya dolaylı olarak onun bir çocuğu haline gelir.

Bu, tüm süreçteki en önemli seçimdir. Doğru yaparsanız, dal bir argüman gibi okunur: işte maliyetle ilgili pozisyon, işte bunun için üç neden, işte ikinci nedene itiraz. Yanlış yaparsanız, bu makalenin en üstündeki tersine dönüşü alırsınız — bir istatistik, desteklemesi gereken iddianın altında sarkıyormuş gibi bir detaymış gibi bir dalın en üstünde durur.

Açık bir yaklaşım işe yaramıyor.

Sezgisel cevap, modelin en çok güvendiği argümanı desteklemektir. Bu, anlaşılması gereken bir nedenle başarısız olur.

Güven, çıkarımın gerçek bir argüman bulduğuna ne kadar emin olunduğunu ölçer. Bu, o argümanın tartışmadaki merkeziliğini ölçmez. İsimli bir kaynağa sahip net bir şekilde ifade edilmiş istatistik, kolay ve yüksek güvenilirlikte bir çıkarımdır. Gerçek tez olan belirsiz, temkinli bir cümle ise zor ve düşük güvenilirlikte bir çıkarımdır. Güvene göre sıralama, sistematik olarak kanıtı öne çıkarır ve iddiayı geri planda bırakır.

Birinci problemin altında ikinci bir problem var. Saurav Kadavath ve Anthropic'teki meslektaşlarının çalışmaları, dil modellerinin ifade edilen güveninin ham token olasılıklarından daha iyi kalibre edildiğini buldu — ancak sonraki değerlendirmeler, bunun hala mutlak terimlerde iyi kalibre edilmediğini defalarca göstermiştir. Kullanılabilir bir sinyal. Güvenilir bir sıralama değildir.

Ana İddianın Gerçekten Ne Seçtiği

Bir sinyal yerine, birkaç sinyal birleştirilir — ve bunların en güçlüsü yapısal olup dilsel değildir.

  • Merkezilik. Bu argümana kaç tane başka argüman ekleniyor? Diğer her şeyin yanıt verdiği iddia neredeyse her zaman merkezi iddiadır. Bu, tartışmadaki argümanın konumunun bir özelliği olduğu için güvenilir bir sinyale en yakın şeydir, kelime seçiminden ziyade.
  • Soyutluk. Ana iddialar genel; kanıtlar ise spesifiktir. Bu doğrudan Toulmin'dir: 1958 tarihli açıklamasında, iddia sonuçtur ve gerekçeler onun altındaki somut gerçeklerdir.
  • İkna edici dil. Söylem işaretleri — bu nedenle, ana mesele, iddia ediyorum — bir konuşmacının bir pozisyon belirttiğini, ayrıntı vermek yerine bunu ifade ettiğini gösterir.
  • Kısalık. Merkez iddialar genellikle kısadır. Uzun bir cümle genellikle nitelikler taşır, bu da destekleyici materyalin işlevidir.
  • Pozisyon. Zayıf bir sinyal, ama gerçek bir sinyal: tezler genellikle erken ortaya çıkar.

Soyutluk, belirginliğin izlerini arayarak ölçülür. Bir yüzde, bir para miktarı, nicel bir varlık, bir alıntı ifadesi, bir adlandırılmış kurum — her biri bir argümanın daha az ana iddia olma olasılığını artırır, çünkü her biri bir sonucun değil, gerekçelerin bir işareti olarak kabul edilir. Uzaktan çalışma verimliliği artırır bir iddiadır. 500 çalışanın katıldığı bir anket %78 memnuniyet gösterdi ise birisi nedenini sorduğunda söylediğinizdir.

Birden fazla zayıf sinyali birleştirmek, tek bir güçlü görünen sinyale güvenmekten daha iyidir — bu, farklı bakış açılarına sahip bir grubun kendine güvenen bir bireyden daha iyi performans göstermesinin aynı nedenidir; bu durum neden çeşitliliğin yetenekten daha iyi olduğunu inceleyen bir örüntüdür.

Bunu kendi son toplantınızda deneyin.

Takımınızın verdiği son kararı alın. Ona karşı en güçlü tek argümanı isimlendirebilir misiniz — ve bunu kimin söylediğini de belirtebilir misiniz? Eğer bunu yapamıyorsanız, bu bir hafıza sorunu değildir. Bu bir yapı sorunudur: kaydınız neyin kararlaştırıldığını yakalamış ama neyin tartışıldığını değil, bu da tam olarak çıkarımın kapatmaya çalıştığı boşluktur.

Kaynağın içinde olmayan hiçbir şey hayatta kalmaz.

Gerçekten yapılmamış ama mantıklı görünen bir argüman, eksik olandan daha kötüdür — bu, ekibinizin söylediklerinin yanlış bir kaydıdır. Bu nedenle, her çıkarılan argüman, geldiği tam ifadeyi taşır ve alıntılanan kanıtın kaynak belgede bulunamadığı herhangi bir argüman, ağaç kimseye gösterilmeden önce kaldırılır.

Bu, göz alıcı değil ve geri kalanını kullanılabilir kılan kısımdır. Bir transkripte geri izleyemediğiniz bir ağaç, ekstra adımlarla birlikte bir özet demektir.

Ama bu sadece ek adımlarla özetleme değil mi?

Bu, bariz bir itirazdır ve cevap, her birinin attığı şeydedir.

Bir özet sıkıştırır. Toplantının neyi kapsadığını kabaca söyler ve eğer iyiyse, neyin kararlaştırıldığını belirtir. Ancak koruyamadığı şey, anlaşmazlığın şeklidir — bu belirli itirazın o belirli gerekçeye karşı dile getirildiği, bunun yanıtlandığı ve ikinci bir itirazın asla yapılmadığıdır. Özler, kararın sekiz ay sonra yeniden gözden geçirildiği ve kimsenin neden açık alternatifin reddedildiğini hatırlayamadığı durumda önemli olan kısmı tam olarak kaybeder.

Ayrım, argüman madenciliğini, tutumu ölçen duygu analizinden de ayırır; bu, akıl yürütme yerine tutumu ölçer. Bir cümle, bağlı olduğu noktayı desteklerken olumsuz bir şekilde ifade edilebilir — "zaman baskısı riski artırır" ifadesi, projenin riskli olduğu iddiasını güçlendirir. Bunu tonla puanlarsanız, her seferinde ters sonuç alırsınız.

Çıktı bir taslaktır ve mesele de budur.

Çıkarımın sonucunda bir öneri ortaya çıkar: burada neyin savunulduğunu düşündüğümüz, bunun nasıl bir araya geldiğini düşündüğümüz. İnsanlar daha sonra bunu düzeltir — yanlış bir iddiaya bağlı olan bir argümanı yeniden yapılandırır, iki noktayı birleştiren bir argümanı ayırır, puanlamanın yanlış değerlendirdiği bir şeyi öne çıkarır ve ikna edici buldukları şeyleri değerlendirir.

Bu bölünme kasıtlıdır. Yapıyı elle inşa etmek, ekiplerin bunu tamamen yapmasını engelleyen zahmetli bir iştir. Bir argümanın ne kadar iyi olduğunu yargılamak — kanıtın geçerli olup olmadığı, belirtilmemiş varsayımın kabul edilebilir olup olmadığı — zahmetli değildir. Bu, gerçek düşünmedir ve grup ile birlikte kalır.

Kendi Toplantı Kayıtlarınızı Okuyorsanız Bu Ne Anlama Geliyor

  • Alıntılanabilir cümle genellikle iddia değildir. Kesin, iyi kaynaklanmış cümleler genellikle kanıttır. Destekledikleri iddia genellikle daha belirsizdir ve gözden kaçması daha kolaydır.
  • Neyin neye bağlı olduğunu sayın. Diğer herkesin yanıt verdiği nokta, kimin en kendinden emin bir şekilde söylediği önemli olmaksızın, önemli olan noktadır.
  • Kategorileri adlandırın. Eğer bir kararın hangi iki veya üç tema hakkında olduğunu söyleyemiyorsanız, tartışma yapılandırılmamıştır — sadece transkribe edilmiştir.
  • Cevap verilmeyen itirazı arayın. Bu, herhangi bir tartışma kaydındaki en faydalı şeydir ve düz bir özetin yok ettiği ilk şeydir.

Belirsiz Cümle Tartışmaydı

İstatistik asla mesele değildi. Bu, daha önce yapılmış bir iddia hakkında birinin sorduğu bir sorunun cevabıydı — gevşek bir şekilde, erken ve asla tutanaklara geçmeyen bir cümle içinde.

Bir tartışmayı yapılandırmak, o cümleyi ait olduğu dalın en üstüne geri koymak, altına kanıtlarını yerleştirmek ve itirazlarını tartıştıkları belirli nedenlere eklemektir. Ağaç bunun içindir. Ve bu, en kendinden emin cevabın çoğu zaman yanlış olmasının nedenidir.

Argüman madenciliği serisi

Bu gönderi, argüman madenciliğini nasıl uyguladığımızı kapsıyor. Serinin geri kalanı, bu alanın nereden geldiğini ve neden zor problemlerinin zor olduğunu ele alıyor.

Sıkça Sorulan Sorular

Argumentree, bir transkripti nasıl bir argüman ağacına dönüştürüyor?

Argüman madenciliği uygular: iddiaları veya nedenleri taşıyan metin parçalarını bulma, her birinin ne olduğunu etiketleme, hangi nedenin hangi iddiaya bağlı olduğunu belirleme ve her bağlantının yukarıdaki noktayı destekleyip desteklemediğine karar verme. Sonuç, insanların gözden geçirip düzelttiği bir artı ve eksi ağacıdır.

Argüman kategorileri nedir ve neden tek kelimeler?

Kategoriler, bir tartışmayı ayrı tartışmalara ayırır — Maliyet, Risk, Zaman Çizelgesi, Hukuki. Tek kelimelerle sınırlıdırlar çünkü ifade uzunluğundaki kategoriler parçalanır: Bütçe Etkisi, Maliyet Değerlendirmeleri ve Finansal Risk, üç şapka takan tek bir tartışmadır ve ağaç, tek olması gereken dallara ayrılır.

Her kategori için bir ana argüman ne anlama geliyor?

Her kategori içinde, tam olarak bir argüman merkezi iddia olarak öne çıkarılır ve o kategorideki diğer her şey onun altına eklenir. Bu, bir dalı okunabilir bir argüman haline getirir — bir pozisyon, onun gerekçeleri ve bu gerekçelere yönelik itirazlar — düz bir ilgili cümleler listesi yerine.

Ana argüman neden sadece en yüksek güvene sahip olan değil?

Çünkü güven, çıkarımın ne kadar kesin olduğunu ölçer, argümanın ne kadar merkezi olduğunu değil. Kesin bir şekilde ifade edilmiş bir istatistik, kolay ve yüksek güvenilirlikte bir çıkarımdır; aslında tezi temsil eden belirsiz cümle ise zordur. Güvene göre sıralama, sistematik olarak kanıtları öne çıkarır ve iddiaları geri planda bırakır.

Bu, toplantı özetlemesinden nasıl farklı?

Bir özet, kapsananları sıkıştırır ve size neyin ele alındığını anlatır. Anlaşmazlığın şeklini koruyamaz — bu itirazın o gerekçeye karşı yapıldığı, bunun yanıtlandığı ve diğerinin yanıtlanmadığı gibi. Özetler, bir karar daha sonra gözden geçirildiğinde önemli olan kısmı tam olarak kaybeder.

AI'nin kimsenin yapmadığı argümanları icat etmesini ne engelliyor?

Her çıkarılan argüman, geldiği tam ifadeyi taşır ve alıntılanan kanıtı kaynak belgede bulunamayan herhangi bir argüman, ağaç gösterilmeden önce kaldırılır. Mantıklı gibi görünen ama asla yapılmamış bir argüman, eksik olandan daha kötüdür.

Çıkarımın ürettiğini değiştirebilir miyim?

Evet — bu, amaçlanan iş akışıdır. Çıktı bir taslaktır. İnsanlar yanlış iddiaya eklenmiş argümanları yeniden düzenler, birleştirilmiş noktaları ayırır, puanlamanın yanlış yaptığı bir şeyi öne çıkarır ve ikna edici buldukları şeyleri değerlendirir. Makine yapıyı oluşturur; grup yargıyı korur.

AT

Argumentree Team

Decision Science

The Argumentree team explores the science of better decisions—from ancient philosophy to modern AI.

Bir sonraki toplantınızı bir tartışma ağacına dönüştürün.

Gerekçeyi yapılandır, sadece kaydı değil — böylece kimsenin yanıtlamadığı itiraz altı ay sonra hala görünür olsun.

Ücretsiz başla

İlgili okumalar