Yapay zeka aramasında görünürlük

llms.txt

Önerilmiş bir yöntem: web sitesinin kök dizinine konan ve yapay zeka modellerine sitenin en önemli içeriğine dair kısa, seçilmiş bir kılavuz sunan Markdown dosyası.

SİTE KÖKÜNDEKİ ÜÇ DOSYA/robots.txttarayıcılara nereye girebileceklerini söyler/sitemap.xmltüm sayfaların listesini verir/llms.txtmodeller için en önemli içeriğin Markdown özetiBir öneridir, standart değil: büyük yapay zeka servislerinin dosyayı okuduğuna dair kanıt sınırlı.

şemanın tamamı için kaydırın →

MEmehmeterkek.com/sozluk/llms-txt

Sade anlatım

Bir web sitesi insanlar ve tarayıcılar için kurulur: menüler, betikler, bannerlar. Onu okuyan bir model, özü bunların arasından ayıklamak zorundadır. llms.txt, yapay zeka okurlar için kapıya bırakılmış sade bir nottur: bu site ne hakkında ve okunmaya değer sayfalar hangileri, temiz metin olarak.

Neden önemli

Eklemesi ucuzdur, çok konuşulur ve değeri kolayca abartılır. Bir öneridir; hiçbir büyük yapay zeka sağlayıcısı ürünlerinin tamamında buna uyacağını taahhüt etmiş değil ve yayımlanan kayıt analizleri bu dosyaların çoğunun nadiren istendiğini gösteriyor. Düşük maliyetli bir düzen işi olarak görün; en çok dokümantasyon siteleri ve geliştirici araçları için faydalıdır. Yapay zeka sistemlerinin zaten okuyabildiği içeriğin yerini tutmaz.

Örnek

Bir yazılım şirketi /llms.txt ekliyor; dosyada ürün özeti, API başvurusu ve fiyat sayfası, her biri tek satırlık açıklama ve Markdown sürümüne bağlantıyla listeleniyor. Dosyayı bir kodlama asistanına yapıştıran geliştiriciler API hakkında doğru yanıtlar alıyor. Herkese açık yapay zeka arama motorlarının dosyayı okuyup okumadığı ise belirsiz.

Bununla en çok karıştırılan kavram

llms.txt ve robots.txt arasındaki fark

llms.txtYol gösterir: nelerin okunmaya değer olduğunu söyler
robots.txtKural koyar: tarayıcıların nereye girebileceğini söyler

robots.txt, tarayıcılara hangi yolları getirebileceklerini söyleyen yerleşik bir standarttır ve itibarlı tarayıcılar ona uyar. llms.txt hiçbir şeyi denetlemez: önerilen bir okuma listesidir. Yapay zeka tarayıcılarına izin vermek ya da onları engellemek için yine robots.txt'yi, her yapay zeka şirketinin yayımladığı user-agent adlarıyla kullanırsınız.

Köken: Eylül 2024'te Answer.AI'dan Jeremy Howard tarafından önerildi.

Teknik katman

Biçim, belirli bir iskeleti olan Markdown'dır: site ya da proje adını taşıyan bir H1, alıntı bloğu içinde bir özet, isteğe bağlı açıklama, ardından bağlantı listeleri içeren H2 bölümleri; her bağlantıyı kısa bir açıklama izler. “Optional” adlı bölüm, bağlam darken atlanabilecek içeriği işaretler. Eşlik eden fikirler: her sayfanın .md sürümünü sunmak ve tüm metni tek dosyada toplayan llms-full.txt. En yaygın olduğu yer dokümantasyon platformları ve geliştirici aracı şirketleridir. Google, arama özellikleri için buna gerek olmadığını söylemiştir. Herhangi bir site dosyaya istediğini yazabileceği için, okuyan tarafın bunu güvenilmeyen girdi sayması yerinde olur.

Yazan Mehmet Erkek · Son güncelleme: