Takipkit veri raporu

Sosyal medya tavsiyelerinin kaçı istatistiksel testi geçiyor?

Otonom bir araştırma motoru X üzerinde biçim hipotezlerini kendisi üretip gerçek gönderi verisinde test ediyor: hangi saatte paylaşmak, kaç kelime yazmak, medya koymak, zincir kurmak. Motorun kendi kaydı açık. 3.492 hipotez test edildi, 1.158’i çoklu karşılaştırma düzeltmesini geçti, yayına giren bulgu sayısı sıfır. Ayrıntısı yayınlanan 500 hipotezin tamamı aynı sonuçla kapandı: "ölçüldü, %10’dan büyük bir fark yok". Bu 500 testte ölçülen farkın medyanı %1,89, en büyüğü %8,03.

Yayın tarihi 3 Eylül 2026. Ölçüm penceresi 21 Mayıs - 31 Ağustos 2026. Global katalog ölçümüdür, ülke kırılımı içermez. Kaynak gösterilerek serbestçe alıntılanabilir.

Bu sonuçlar dev hesaplar için geçerli, sıradan bir hesap için değil

Tamamlanan tek koşu 3.294 hesabı havuzladı ve bu havuzun takipçi tabanı 1.644.259. Yani her rakam, 1,6 milyondan fazla takipçisi olan hesaplarda ölçüldü. Veri altyapısının kendi belgesi de bu uyarıyı taşıyor: bu alandan alınan bir oran, taban belirtilmeden normal bir hesaba uygulanırsa büyüklük sırası yanlış olur. Aşağıdaki hiçbir sayı küçük hesaplara genellenemez.

Test edilen

3.492

Hipotez, tek koşuda

Düzeltmeyi geçen

1.158

Testlerin %33,2’si

Yayına giren

0

Terfi eden bulgu yok

Medyan fark

%1,89

Elenen 500 hipotezde

Motor tam olarak ne yapıyor?

Sıradan bir sosyal medya tavsiyesi şöyle doğar: birisi kendi hesabında bir şey dener, işe yaradığını düşünür ve genelleştirir. Bu motor tersini yapıyor. Önce bir hipotez uzayı üretiyor, sonra o uzaydaki her hipotezi 90 günlük bir gönderi havuzunda ölçüyor, sonra hangilerinin yayına layık olduğuna önceden yazılmış bir kurala göre karar veriyor. Hipotezleri motor kendisi üretiyor; kimse "şunu test et" demiyor.

Her hipotezin makine okunur bir kimliği var ve altı parçadan oluşuyor: boyut, kova, katman, akran grubu, metrik ve tür. Örneğin word_count|w20_39|nomedia~withmedia|*|views|interaction kimliği şunu soruyor: 20 ile 39 kelimelik gönderilerin erişim üzerindeki etkisi, medyasız ve medyalı gönderilerde birbirinden farklı mı? Boyut kelime sayısı, kova 20 ile 39 aralığı, katman medyasız ile medyalı karşılaştırması, akran grubu yok, metrik erişim, tür etkileşim testi.

Yayına giren bir bulgunun geçmesi gereken dört kapı var. Bunlar sonradan değil, koşu başlamadan önce yazılmış durumda ve API kendi kapı ayarlarını da servis ediyor:

Kapı Eşik Ne demek
Anlamlılık düzeyi %5 Sonucun rastlantı olma payı en fazla yirmide bir. Çoklu karşılaştırma düzeltmesiyle birlikte uygulanıyor.
En az hesap 50 Farkı en az 50 bağımsız hesap desteklemeli. Tek bir hesabın alışkanlığı bulgu sayılmasın diye.
En az etki büyüklüğü %10 Fark küçükse anlamlı olması yetmiyor. %10, "kayda değer en küçük fark" olarak tanımlanmış durumda.
Ardışık koşu 3 Aynı sonuç üç koşuda üst üste çıkmalı. Tek seferlik tesadüfler böyle eleniyor.

Kaynak: kapı ayarlarını bulgu ucunun kendisi yayınlıyor. Bunlara ek olarak her testte hesaplar ikiye bölünüp iki yarının aynı yönü gösterip göstermediğine de bakılıyor.

Neden hiçbir bulgu yayına girmedi?

Bu sorunun cevabı sanıldığı kadar istatistiksel değil. Dört kapının hangisinde kaç hipotezin takıldığına tek tek bakınca tablo şöyle çıkıyor.

Anlamlılık kapısı beklenenden az eledi. 3.492 testin 1.158’i, yani %33,2’si çoklu karşılaştırma düzeltmesinden sağ çıktı. Bu hipotezler rastlantıyla açıklanamayacak bir sinyal taşıyor.

Hesap kapısı hiç devreye girmedi. Ayrıntısı yayınlanan 500 testin hiçbirinde hesap sayısı 50’nin altına düşmedi. En dar testte 106 hesap vardı, en az gönderi gören test 500 gönderiye baktı, medyan test 305 hesap ve 4.437 gönderi gördü, en genişi 3.204 hesabı kapsadı. Yani "örneklem yetersiz" gerekçesi bu koşuda hiç kullanılmadı.

Büyüklük kapısı çok eledi. Yayınlanan 500 sonucun en büyüğünde bile fark %8,03. Kapı %10 istiyor. Ama burada bir uyarı gerekiyor: bu 500 satır zaten "elendi" etiketli olanlar, ve o etiketin tanımı gereği güven aralığı artı eksi %10 bandının içindedir. Dolayısıyla "hiçbiri %10’a ulaşmadı" cümlesi bu alt küme için tanım gereği doğrudur, bir bulgu değildir. Bulgu olan şey, bu farkların ne kadar küçük olduğu: medyanı %1,89, dörtte üçü %3,27’nin altında.

Asıl engel dördüncü kapı ve sebebi aritmetik. Terfi için üç ardışık başarılı koşu gerekiyor. Bugüne kadar tamamlanan koşu sayısı bir. Yani bu kapı hiçbir hipotezin geçemeyeceği şekilde kapalı; sıfır terfi, verinin keşfettiği bir sonuç değil, kuralın zorunlu kıldığı bir sonuç. Sayfayı bu ayrım olmadan okumak yanlış olur.

İki koşu yapıldı, biri çöktü

Motorun koşu geçmişi de açık yayınlanıyor ve başarısız koşular gizlenmiyor. Bu iyi bir tasarım kararı: yalnızca başarılı koşuları gösteren bir kayıt, bir bulgunun art arda doğrulanıp doğrulanmadığını okunamaz hale getirir.

Koşu Durum Hesap Gönderi Takipçi tabanı Test Terfi
19 Ağustos 2026 21 Mayıs - 19 Ağustos 2026 Tamamlandı 3.294 201.968 1.644.259 3.492 0
31 Ağustos 2026 2 Haziran - 31 Ağustos 2026 Çöktü 33.266 1.595.070 996 0 0

İkinci koşunun hata notu API’de aynen şöyle geçiyor: "temporary file size exceeds temp_file_limit (5242880kB)". Yani veritabanı geçici dosya sınırı aşıldı.

Çöken koşunun ne yapmaya çalıştığına bakmak gerekiyor, çünkü bu raporun en büyük sınırını tam olarak o koşu kaldıracaktı. İkinci koşu 33.266 hesap ve 1.595.070 gönderi hedefliyordu: birincinin on katı hesap, sekiz katı gönderi. Daha önemlisi takipçi tabanı 1.644.259’dan 996’ya iniyordu. Yani ölçüm dev hesaplardan çıkıp sıradan hesaplara ulaşacaktı. Üç saate yakın çalıştıktan sonra teknik nedenle durdu ve tek bir test bile üretemedi. Bu yüzden elimizdeki bütün rakamlar hâlâ yalnızca milyonluk hesaplara ait.

500 hipotez tam olarak neyi test etti?

Ayrıntısı yayınlanan 500 sonucun her biri farklı bir hipoteze ait, tekrar eden kimlik yok. Kimlikleri parçalarına ayırınca 17 farklı değişken, 49 kova ve 58 ayrı değişken-kova çifti çıkıyor. Testlerin 457’si ana etki testi, 43’ü etkileşim testi. Ana etki testi tek bir şeyi soruyor: bu kovadaki gönderiler diğerlerinden farklı mı? Etkileşim testi bir kat daha derin: bu farkın kendisi, alt gruplar arasında değişiyor mu?

Paylaşım saati (UTC)
109
Günün bölümü
102
Önceki gönderiden geçen süre
99
Metin uzunluğu bandı
57
Haftanın günü
47
Kelime sayısı bandı
31
O günün kaçıncı gönderisi
25
Hafta sonu mu
8
Yayın aracı türü
4
Hashtag var mı
4
Yayın aracı ailesi
3
Fotoğraf sayısı
3
Video var mı
2
Medya var mı
2
Medya bileşimi
2
Zincir mi
1
Etiketlenen hesap sayısı
1

Yayınlanan 500 test sonucunun değişkene göre dağılımı. Toplam 500.

Dağılım dengeli değil ve bu tesadüf değil. Zaman değişkenlerinin kovası çok: 24 saat, 7 gün, 4 zaman dilimi. İçerik değişkenlerinin kovası az: medya var veya yok, zincir evet veya hayır. Motor her kovayı ayrı bir hipotez olarak sayıyor, dolayısıyla saat ailesi tek başına test uzayının yarısından fazlasını kaplıyor. Aynı değişkenleri gruplayınca yedi aile çıkıyor.

Aile Değişken Test Medyan fark En büyük fark Sıfırı dışlayan
Saat ve gün 4 266 %1,77 %7,51 36
Paylaşım ritmi 2 124 %1,76 %8,03 19
Metin uzunluğu 2 88 %2,93 %7,75 38
Medya 4 9 %1,14 %4,66 1
Yayın aracı 2 7 %2,98 %7,11 3
Etiket ve bağlantı 2 5 %3,77 %7,47 3
Zincir 1 1 %0,67 %0,67 0

Medyan fark, ailedeki testlerin mutlak fark medyanıdır. "Sıfırı dışlayan", güven aralığı sıfırı içermeyen, yani yönü kesin olan test sayısıdır.

Ailelerin kendi aralarındaki fark burada okunabilir tek şey değil, ama bir tanesi dikkat çekiyor: metin uzunluğu ailesinde 88 testin 38’inin aralığı sıfırı dışlıyor, oran %43,2. Saat ve gün ailesinde bu oran 266 testte 36, yani %13,5. Uzunluk farkları daha sık ölçülüp yönü daha sık belirlenebiliyor. Bunun sebebi büyük olasılıkla ölçümün kendisi değil, örneklem: uzunluk testleri havuzun tamamında çalışırken saat testlerinin çoğu takipçi dilimlerine bölünmüş durumda ve bölününce belirsizlik büyüyor. Bu mekanizma aşağıda ayrı bir bölümde ölçülüyor.

Bu ailelerdeki tek tek fark rakamları bu sayfanın konusu değil; onlar ayrı ölçümlerde yayınlanıyor. Bağlantı ve hashtag boyutları link paylaşımı ölçümünde ve hashtag ve etiket ölçümünde, uzunluk, medya, zincir ve yayın aracı boyutları gönderi biçimi ölçümünde, saat kırılımları ise en iyi paylaşım saati ölçümünde. Bu sayfa o rakamların neden "kesin bulgu" sayılmadığını anlatıyor.

Ölçülen farklar ne kadar büyük?

Yayınlanan 500 sonucun tamamında ölçülmüş bir fark var. Bu farkların yarısından fazlası %2’nin altında. 146 testte fark %1’i bile bulmuyor. Dağılımın işareti de dengeli: 272 testte fark negatif, 225’inde pozitif, 3’ünde tam sıfır. Yani biçim tercihlerinin yarısı ölçümde iyi, yarısı kötü görünüyor ve ikisi de küçük.

%1’den küçük
146
%29,2
%1 ile %2 arası
120
%24,0
%2 ile %3 arası
85
%17,0
%3 ile %5 arası
100
%20,0
%5 ile %8 arası
48
%9,6
%8 ile %10 arası
1
%0,2

Farkın mutlak değerine göre dağılım, 500 test. Medyan %1,89, çeyrekler %0,89 ile %3,27.

Metriğe göre de benzer bir tablo çıkıyor. Motorun ölçtüğü dört metrik var ve hepsinde medyan fark %2 civarında. Metriklerin ne ölçtüğünü söylemek gerekiyor, çünkü isimleri yanıltıcı olabilir: erişim, gönderinin kaç kez gösterildiği; etkileşim, beğeni ve benzeri tepkilerin toplamı; görüntülenme başına etkileşim, bu ikisinin oranı; kaydetme ise gönderiyi sonra okumak üzere işaretleme sayısı.

Metrik Test Medyan fark Medyan aralık Sıfırı dışlayan
Görüntülenme başına etkileşim engagement_per_view 190 %1,93 10,6 puan 37
Erişim (görüntülenme) views 151 %1,80 10,7 puan 29
Kaydetme bookmarks 97 %1,84 9,1 puan 18
Etkileşim engagement 62 %2,04 7,9 puan 16

Medyan aralık, %95 güven aralığının yüzde puanı cinsinden genişliğidir. Küçük olması ölçümün daha kesin olduğunu gösterir.

Bir hipotezin "elenmesi" etkisi yok demek mi?

Hayır, ikisi ayrı şey ve bu ayrım sayfanın en önemli yeri. Bu motorda "elendi" etiketinin kesin bir tanımı var: %95 güven aralığının tamamı artı eksi %10 bandının içinde kalıyor. Yani motor "ölçemedim" demiyor, "%10’dan büyük bir değişim yok" diyor. Bu bir sonuç, bir başarısızlık değil. İstatistikte bunun adı denklik testi: bir farkın yokluğunu değil, küçüklüğünü kanıtlamaya çalışırsınız.

Ama "sıfır etki" de demiyor. Elenen 500 hipotezin 100’ünde güven aralığı sıfırı dışlıyor. Bu 100 testte gerçek bir fark var, yönü de belli, sadece kapının istediği büyüklüğe ulaşmıyor. Geri kalan 400’ünde aralık sıfırı içeriyor, yani farkın artı mı eksi mi olduğu bile söylenemez. Aynı "elendi" etiketi bu iki çok farklı durumu birden taşıyor ve bir okuyucu bunu bilmeden tabloyu okursa yanlış anlar.

Üçüncü ve en az konuşulan grup ise hiç yayınlanmıyor. Koşuda 3.492 test yapıldı, ama olay kaydına yalnızca durum değişikliği yazılıyor. Geri kalan testler geçici veya desteklenmedi durumunda kaldı ve API bunları bilerek servis etmiyor; gerekçesi, binlerce satırlık bu kümenin düzeltmeyi yeniden hesaplanabilir kılmak için var olduğu, iddia olarak okunmak için değil. Asıl "bilinmiyor" kümesi orada. Yani bu sayfada gördüğünüz 500 satır, motorun en kesin konuştuğu satırlar.

Yedi hipotez, ölçüldüğü gibi

Aşağıdaki satırlar tavsiye değil, ölçüm çıktısı. Seçim bilerek karışık yapıldı: en büyük fark, en dar aralık, en geniş aralık, sıfıra en yakın sonuç ve bir etkileşim testi bir arada. Motorun kendi cümleleri İngilizce geliyor, buradaki iddia sütunu Türkçeye çevrilmiş halidir. Sonuç sütunundaki her satır aynı etiketi taşıyor: elendi.

Test edilen iddia Fark %95 aralık Hesap Gönderi
Günün üçüncü ve sonraki gönderisi kaydedilmeyi düşürür Kaydetme En büyük ölçülen fark. Aralık sıfırı dışlıyor: fark gerçek, ama %10’un altında. -%8,03 -%9,7 / -%5,9 2.838 118.139
20 ile 39 kelimelik gönderiler daha az erişir Erişim En dar aralık: 2,3 puan. Örneklem büyüdükçe belirsizlik böyle daralıyor. -%7,28 -%8,4 / -%6,1 2.973 59.243
Gece paylaşımı, linksiz gönderilerde etkileşim payını yükseltir Görüntülenme başına etkileşim En büyük pozitif fark. Üst sınır %9,7, yani kapıya 0,3 puan kala eleniyor. +%7,51 +%4,9 / +%9,7 1.999 20.802
Hafta sonu paylaşımları daha çok kaydedilir Kaydetme Sıfırı dışlıyor, yön kesin, büyüklük yetersiz. +%6,96 +%4,7 / +%9,1 2.883 47.138
Hafta sonu etkisi medyalı ve medyasız gönderilerde farklıdır Görüntülenme başına etkileşim Etkileşim testi: iki alt grubun farkının farkı. Aralık sıfırı içeriyor. -%4,42 -%8,5 / +%0,3 948 5.276
17.00 UTC’de paylaşım, dördüncü takipçi diliminde kaydetmeyi değiştirir Kaydetme En geniş aralık: 19,1 puan. Yönü bile belli değil, sadece "%10’dan büyük değil". -%2,39 -%9,5 / +%9,6 206 1.040
Medyalı gönderilerde zincir kurmak etkileşim payını değiştirir Görüntülenme başına etkileşim Sıfıra en yakın örneklerden. Zincir boyutunda tek test var. +%0,67 -%3,7 / +%6,1 553 3.205

Yedi satırın yedisi de "elendi" sonucuyla kapandı, yani hiçbirinde %10’dan büyük bir değişim ölçülmedi.

Birinci ve altıncı satırı yan yana koymak öğretici. İlkinde 2.838 hesap ve 118.139 gönderi var, aralık -%9,7 ile -%5,9 arasında ve sıfırı dışlıyor: fark gerçek. Altıncıda 206 hesap ve 1.040 gönderi var, aralık -%9,5 ile +%9,6 arasında: aynı ölçüm, ama farkın artı mı eksi mi olduğu bile söylenemiyor. İkisi de "elendi" etiketiyle kapanıyor. Etiket aynı, bilgi içeriği tamamen farklı.

Üçüncü satır ise kapının ne kadar keskin olduğunu gösteriyor. Gece paylaşılan linksiz gönderilerde görüntülenme başına etkileşim +%7,51 yüksek ölçülmüş, aralık +%4,9 ile +%9,7. Üst sınır %10’a 0,3 puan uzakta. Kapı bir puan aşağıda olsaydı bu hipotez "elendi" değil "belirsiz" olurdu. Eşiğin yeri sonucu değiştiriyor ve eşiğin yeri bir tercih.

Belirsizlik nereden geliyor?

Güven aralığının genişliği bir ölçümün ne kadar kesin olduğunu söyler ve bu 500 testte genişliği belirleyen tek şey neredeyse örneklem büyüklüğü. Aralığı 5 puandan dar olan 100 testin medyan örneklemi 2.518 hesap; aralığı 15 puandan geniş olan 74 testin medyan örneklemi 210 hesap. Aradaki fark on iki kat.

Aralık genişliği Test Medyan hesap Medyan gönderi Sıfırı dışlayan
5 puandan dar 100 %20,0 2.518 35.800 50 %50
5 ile 10 puan 142 %28,4 1.010 10.348 50 %35
10 ile 15 puan 184 %36,8 245 2.203 0 %0
15 puan ve üzeri 74 %14,8 210 1.221 0 %0

Örneklem sütunları, o genişlik grubuna düşen testlerin medyan hesap ve gönderi sayısıdır.

Tablonun son iki satırı birlikte okunuyor: aralığı 10 puandan geniş olan 258 testin sıfırı dışlayan sayısı tam olarak sıfır. Bu testler yapıldı, sonucu kaydedildi, "%10’dan büyük fark yok" denebildi, ama farkın yönü bile söylenemedi. Test uzayının yarısı bu durumda.

Belirsizliğin nereden geldiği de ölçülebiliyor. Testlerin 233’ü havuzun tamamında çalışıyor, 267’si hesapları takipçi sayısına göre on dilime bölüp tek bir dilim içinde çalışıyor. Havuzun tamamında çalışan testlerde medyan örneklem 1.414 hesap ve 21.284 gönderi, medyan aralık genişliği 5,5 puan ve 92’si sıfırı dışlıyor, yani %39,5’i. Dilime bölünmüş testlerde medyan örneklem 237 hesap ve 1.763 gönderi, medyan aralık 12,7 puan ve yalnızca 8’i sıfırı dışlıyor, yani %3,0’ı. Aynı soruyu daha dar bir kitleye sormak, cevabı on üç kat daha az bulunabilir hale getiriyor.

Bu, sosyal medya tavsiyelerinin neden bu kadar bol ve bu kadar çelişkili olduğunu da açıklıyor. Tek bir hesabın birkaç yüz gönderisiyle bakıldığında belirsizlik payı zaten on puanı aşıyor; o aralığın içine "sabah paylaş" da sığıyor, "akşam paylaş" da. Farkı gerçekten görebilmek için binlerce hesap gerekiyor ve o zaman da fark küçülüyor. Aynı gerilim platform metriklerinin neden karşılaştırılamadığını anlatan ölçümde başka bir yüzüyle görünüyor.

3.492 test yapınca şansa kaç tanesi geçer?

Bu, çok test yapan her ölçümün baş belası ve adı çoklu karşılaştırma sorunu. %5 anlamlılık düzeyi, "bu sonuç rastlantıysa yirmide bir ihtimalle böyle görünürdü" demek. Tek test yaparken makul. Ama 3.492 test yaparsanız, hiçbir gerçek etki olmasa bile yaklaşık 175 tanesinin şansa anlamlı çıkması beklenir. Yeterince çok soru sorarsanız veri size mutlaka bir hikaye anlatır.

Motor bunu iki şekilde kapatıyor. Birincisi, ham anlamlılık yerine düzeltilmiş bir değer kullanıyor: aynı aile içindeki bütün testler birlikte değerlendirilip eşik sıkılaştırılıyor, böylece kontrol edilen şey tek tek yanılma payı değil, yanlış bulguların oranı oluyor. Bu düzeltmeyi 3.492 testin 1.158’i geçti. İkincisi, düzeltmeyi geçen bir sonucun yayına girmesi için üç ardışık koşuda tekrar etmesi ve her koşuda hesapların iki yarısında aynı yönü göstermesi isteniyor. Bu ikinci şart, düzeltmeden sağ çıkan tesadüfleri de eliyor: rastlantıyla anlamlı çıkan bir sonucun üç koşu üst üste aynı yönde çıkma ihtimali çok küçük.

Buradaki dürüst uyarı şu: sıfır terfinin ne kadarı bu sıkı kurallardan, ne kadarı gerçekten etki olmamasından geliyor, tek koşuluk bir kayıtla ayrılamaz. Üç ardışık koşu kuralı, tamamlanmış koşu sayısı bir olduğu sürece tek başına terfiyi imkansız kılıyor. Yayınlanan 500 sonucun hiçbirinde farkın %10’a ulaşmaması ise güçlü bir işaret, ama o 500 zaten "aralığı %10’un içinde" tanımıyla seçilmiş bir alt küme. İkisi birlikte söylenmezse sayfa yanlış olur.

Yöntem ve sınırlar

Aşağıdakiler bu rapora özgü sınırlar. Bütün raporlarda ortak olan ölçüm zinciri, örneklem kuralları, doğrulama adımları ve düzeltme kaydı için bu veriler nasıl ölçülüyor sayfasına bakabilirsiniz.

Veri nasıl toplandı

Araştırma motorunun dört ucu da imleçle sonuna kadar yürütüldü. Koşu geçmişi tek sayfada 2 satır döndü. Bulgu ucu üç durum için ayrı ayrı soruldu: yayında, geri çekilmiş ve hepsi. Üçü de 0 satır döndürdü, yani ne yayında bir bulgu var ne de geri çekilmiş bir bulgu. Olay akışı üç sayfada 500 satır verdi ve dördüncü sayfa yok. Elenen bir hipotezin kimliği tek kayıt ucuna sorulduğunda 404 döndü; ucun kendi açıklaması, yalnızca yayına girmiş, geri çekilmiş veya tersine dönmüş hipotezlerin adreslenebilir olduğunu söylüyor. Bütün çağrılar 3 Eylül 2026 tarihinde yapıldı, hiçbiri hata döndürmedi.

Sık sorulanlar

Sosyal medya tavsiyeleri gerçekten işe yarıyor mu?

Bu ölçüm o soruya "hayır" demiyor, "bu eşikten geçmiyor" diyor. Otonom bir araştırma motoru X üzerinde 3.492 biçim hipotezini test etti. 1.158’i çoklu karşılaştırma düzeltmesini geçti, yani rastlantıyla açıklanamayacak bir sinyal taşıyordu. Buna rağmen hiçbiri yayına girmedi, çünkü yayın kapısı ayrıca en az %10 büyüklük ve üç ardışık koşuda tekrar istiyor. Ayrıntısı yayınlanan 500 hipotezin tamamı "ölçüldü, %10’dan büyük bir fark yok" diye kapandı ve bu 500’de medyan fark yalnızca %1,89. Kısacası biçim tercihlerinin ölçülebilir etkisi var ama küçük: hesaplar arası değişkenliğin yanında kayboluyor.

Bir hipotezin "elenmesi" etkisi yok demek mi?

Hayır, ikisi ayrı şey. Bu motorda "elendi" etiketinin kesin bir tanımı var: %95 güven aralığının tamamı artı eksi %10 bandının içinde kalıyor. Yani motor "ölçemedim" demiyor, "%10’dan büyük bir değişim yok" diyor. Bu bir ölçüm sonucu. Ama sıfır etki de demiyor: elenen 500 hipotezin 100’ünde aralık sıfırı dışlıyor, yani gerçek ve yönü belli bir fark var, sadece kapının istediği büyüklüğe ulaşmıyor. Geri kalan 400’ünde aralık sıfırı içeriyor, orada yönü bile söylenemez.

Neden hiçbir bulgu yayınlanmadı?

Asıl sebep istatistik değil aritmetik. Kapı dört şart istiyor: %5 anlamlılık düzeyinde çoklu karşılaştırma düzeltmesi, en az %10 etki büyüklüğü, en az 50 bağımsız hesap ve üç ardışık koşuda üst üste aynı sonuç. Bugüne kadar tamamlanmış koşu sayısı bir. Üç ardışık koşu şartı tek başına terfiyi imkansız kılıyor. İkinci koşu 33.266 hesap ve 1.595.070 gönderiyle çok daha büyük bir örneklem hedeflemişti ama teknik nedenle çöktü: geçici dosya boyutu sunucu sınırını aştı.

Bu sonuçlar benim hesabım için de geçerli mi?

Büyük ihtimalle değil. Tamamlanan tek koşu 3.294 hesabı havuzladı ve bu havuzun takipçi tabanı 1.644.259. Yani ölçüm yalnızca 1,6 milyondan fazla takipçisi olan hesaplarda yapıldı. Veri altyapısının kendi belgesi de bunu açıkça uyarıyor: bu alandan alınan hiçbir oran, taban belirtilmeden sıradan bir hesap için kullanılamaz. Çöken ikinci koşu tabanı 996 takipçiye indirecekti, yani bu sınırın çözümü tam da tamamlanamayan koşuydu.

Güven aralığı ne anlama geliyor?

Güven aralığı, ölçülen farkın etrafındaki belirsizlik payıdır. "Fark %7,5, aralık %4,9 ile %9,7" cümlesi şunu söyler: elimizdeki veriyle uyumlu gerçek fark değerleri kabaca bu iki sayı arasındadır. Aralık sıfırı içermiyorsa farkın yönü bellidir. Aralık ne kadar darsa ölçüm o kadar kesindir ve darlığı belirleyen şey örneklem büyüklüğüdür: bu 500 testte aralığı 5 puandan dar olan 100 testin medyan örneklemi 2.518 hesap, aralığı 15 puandan geniş olan 74 testin medyan örneklemi 210 hesap.

En iyi paylaşım saati diye bir şey var mı?

Bu motorun kaydında yok. Test edilen 500 hipotezin 266’sı saat ve gün ailesinden geliyor: paylaşım saati, günün bölümü, haftanın günü ve hafta sonu. Bu ailede ölçülen farkların medyanı %1,77, en büyüğü %7,51 ve hiçbiri yayın kapısını geçmedi. Saat kırılımları takipçi dilimlerine bölündüğünde örneklem düşüyor, güven aralığı genişliyor ve fark yönü bile belirsizleşiyor. Saatin hiçbir etkisi olmadığı sonucu çıkmaz; çıkan sonuç, bu veride saat farkının %10’luk eşiğin altında kaldığıdır.

İlgili raporlar

Bu sayfada test sürecinin kendisi ölçüldü. Test edilen boyutların ham fark rakamları ayrı raporlarda: link paylaşımı ve etkileşim, hashtag ve etiket etkisi, gönderi biçimi etkisi ve X’te en iyi paylaşım saati.

Etkileşim oranının nasıl hesaplandığı ve neden platformdan platforma değiştiği X etkileşim oranı ve platform metrikleri karşılaştırması raporlarında. Ölçüm zincirinin tamamı yöntem belgesinde, diğer bütün ölçümler veri raporları bölümünde.

Alıntı

Bu rapordaki veriler kaynak gösterilerek serbestçe kullanılabilir. Alıntılarken ölçümün global bir X kataloğunda ve 1,6 milyon takipçi tabanının üzerindeki hesaplarda yapıldığını belirtmenizi rica ediyoruz. Önerilen künye:

Takipkit, "3.492 Sosyal Medya İddiası Test Edildi: 0 Geçti", 3 Eylül 2026. https://takipkit.com/veri/sosyal-medya-iddialari-test-sonuclari

Bu sayfa bir ürün tanıtımı değildir, ölçülmüş bir test kaydını kamuya açmak için hazırlandı. Sosyal medya hizmetlerimiz hakkında bilgi için Takipkit ana sayfasına bakabilirsiniz. Buradaki hiçbir rakam bir hesabın nasıl paylaşım yapması gerektiğine dair tavsiye değildir.