---
type: "Akademik Makale Analizi"
title: "Derin Pekiştirmeli Öğrenme ile Solo12 Dört Bacaklı Robotunun Denetimi"
description: "Dört bacaklı robot sistemleri, karmaşık ve zorlu arazi koşullarında yüksek hareket kabiliyeti sunma potansiyeline sahiptir. Geleneksel denetim yaklaşımları genellikle yörünge optimizasyonu, model öngörülü denetim (MPC) ve elle ayarlanan parametrelere dayanır. Ancak bu yöntemler, robotun karşılaşabil"
resource: "https://makaleanalizi.com/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/derin-pekistirmeli-ogrenme-ile-solo12-dort-bacakli-robotunun-denetimi"
doi: "10.1038/s41598-023-38259-7"
authors: ["Michel Aractingi", "Pierre‐Alexandre Léziart", "Thomas Flayols", "Julien Perez", "Tomi Silander", "Philippe Souères"]
citation: "Aractingi, M., Léziart, P., Flayols, T., Perez, J., Silander, T., Souères, P. (2023). Controlling the Solo12 quadruped robot with deep reinforcement learning. Scientific Reports, 13(1), 11945-11945. https://doi.org/10.1038/s41598-023-38259-7"
publicationType: "technical-engineering"
discipline: "Mühendislik ve Teknoloji"
subDiscipline: "Bilgisayar ve Elektrik Mühendisliği"
evidenceCount: 12
tags: ["Dört bacaklı robotlar", "Derin pekiştirmeli öğrenme", "Simülasyondan gerçeğe aktarım", "Solo12", "Hareket denetimi"]
timestamp: "2026-08-20T01:21:29.951Z"
---

# Derin Pekiştirmeli Öğrenme ile Solo12 Dört Bacaklı Robotunun Denetimi

Özgün başlık: Controlling the Solo12 quadruped robot with deep reinforcement learning
DOI: https://doi.org/10.1038/s41598-023-38259-7
Künye (APA 7): Aractingi, M., Léziart, P., Flayols, T., Perez, J., Silander, T., Souères, P. (2023). Controlling the Solo12 quadruped robot with deep reinforcement learning. Scientific Reports, 13(1), 11945-11945. https://doi.org/10.1038/s41598-023-38259-7

Bilim alanı: [Mühendislik ve Teknoloji](/okf/muhendislik-ve-teknoloji/index.md) › Bilgisayar ve Elektrik Mühendisliği

# Alan bağlamı

Dört bacaklı robot sistemleri, karmaşık ve zorlu arazi koşullarında yüksek hareket kabiliyeti sunma potansiyeline sahiptir. Geleneksel denetim yaklaşımları genellikle yörünge optimizasyonu, model öngörülü denetim (MPC) ve elle ayarlanan parametrelere dayanır. Ancak bu yöntemler, robotun karşılaşabileceği tüm çevre koşullarına uyarlanması zor olan hassas modeller ve yüksek anlık hesaplama yükü gerektirir. Derin pekiştirmeli öğrenme ise doğrudan veriden öğrenerek bu kısıtları aşmayı vaat etse de simülasyondan gerçek robota aktarımda (sim-to-real gap) dayanıklılık ve enerji verimliliği sorunları yaratmaktadır. Bu çalışma, açık kaynaklı Solo12 robotu üzerinde gerçek zamanlı ve yüksek enerji verimliliğine sahip uçtan uca pekiştirmeli öğrenme denetleyicilerinin nasıl geliştirilebileceği sorusuna odaklanmaktadır.

# Akademik özet

Dört bacaklı robotik sistemlerin karmaşık arazilerde dinamik hareket kabiliyeti sergilemesi, modern robotik araştırmalarının en kritik konuları arasında yer almaktadır. Geleneksel Yörünge Optimizasyonu ve Model Öngörülü Denetim (MPC) yöntemleri yüksek fiziksel doğruluk sağlasa da, çevre koşullarına uyarlanması gereken çok sayıda elle ayarlanmış parametre içermekte ve yüksek anlık hesaplama maliyetleri gerektirmektedir. Son dönemde veri odaklı bir alternatif olarak öne çıkan derin pekiştirmeli öğrenme yaklaşımları ise simülasyon ortamındaki fiziksel model ile gerçek dünya arasındaki uyumsuzluktan kaynaklanan sim-to-real aktarım engellerine takılmaktadır. Bu çalışma, açık kaynaklı Solo12 robot platformunda simülasyondan gerçeğe aktarım hatasını ek eyleyici modellemesine gerek kalmadan çözen ve enerji verimliliği yüksek bir uçtan uca denetim mimarisi geliştirmeyi amaçlamaktadır.

Çalışmanın temel amacı, Solo12 robotunun kullanıcı tarafından iletilen 3 boyutlu hız komutlarını hassasiyetle takip etmesini sağlayan, Yakınsal Politika Optimizasyonu (PPO) tabanlı bir empedans denetleyicisi tasarlamaktır. Yöntem kapsamında, Markov Karar Süreci durum alanı robotun öz duyusal verileri, eklem açıları, hızları, geçmiş hata sinyalleri ve IMU ölçümleriyle oluşturulmuştur. Doğrudan tork denetimi yerine esnek bir yay-sönümleyici davranışı sergileyen eklem açısı hedef değişimleri eğitilmiştir. Eğitim sürecinde ödül fonksiyonuna Coulomb ve viskoz sürtünme ile Joule ısı kayıplarını hesaplayan fiziksel bir enerji cezası eklenmiştir. Ayrıca, eğitimin kararlılığını ve aktarılabilirliğini sağlamak amacıyla ödül, gürültü ve arazi zorluğuna dayalı kademeli müfredat öğrenimi (curriculum learning) ve alan rastgeleleştirmesi uygulanmıştır.

Deneysel bulgular, geliştirilen denetim politikasının Solo12 robotunu hem simülasyonda hem de gerçek dünyada başarıyla yönlendirebildiğini göstermiştir. Robot, Raspberry Pi 4 donanımı üzerinde yalnızca 10 mikrosaniyelik hesaplama süresiyle 100 Hz frekansta denetim kararları üretebilmiştir. Fiziksel enerji cezası ağırlığının artırılmasıyla, hız takip hassasiyetinde minimal bir kayıpla toplam enerji tüketiminde %30'un üzerinde tasarruf sağlanmıştır. Ayrıca yürüyüş frekansının komut edilen doğrusal hız ile orantılı olarak kendiliğinden adapte olduğu tespit edilmiştir. Alan ve dinamik rastgeleleştirmesi sayesinde, eyleyici bant genişliği veya karmaşık motor modelleri eklenmeksizin ilk denemede başarılı bir sim-to-real aktarımı gerçekleştirilmiştir.

Elde edilen sonuçlar, derin pekiştirmeli öğrenme modellerinde fizik tabanlı enerji kaybı cezalarının kullanılmasının ve durum geçmişinin doğru eklenmesinin aktarım başarısındaki rolünü kanıtlamaktadır. Literatürdeki diğer ANYmal veya Mini-Cheetah uygulamalarından farklı olarak, Solo12 platformunun hafif yapısı ve yüksek bant genişlikli eyleyicileri sayesinde karmaşık motor modeli öğrenme zorunluluğunun ortadan kalktığı gösterilmiştir. Bu çalışma, açık kaynaklı robotik topluluğu için hem üretilebilir hem de düşük hesaplama maliyetli bir kontrol altyapısı sunmaktadır. Gelecek araştırmalarda model tabanlı MPC denetleyicileri ile derin pekiştirmeli öğrenmenin doğrudan karşılaştırılması ve daha zorlu engebeli alanlarda robot performansının sınanması önerilmektedir.

# Araştırmanın amacı

Bu çalışmanın temel amacı, açık kaynaklı Solo12 dört bacaklı robotu için uçtan uca çalışan, kullanıcının hız komutlarını takip eden, yüksek enerji verimliliğine sahip ve simülasyondan gerçek ortama ek aktarım modellemesine ihtiyaç duymadan doğrudan aktarılabilen derin pekiştirmeli öğrenmeye dayalı bir eklem empedans denetleyicisi geliştirmektir.

# Yöntem ve tasarım

Bu çalışmada, Raisim fizik simülasyon ortamında eğitilen derin pekiştirmeli öğrenme politikalarının, eklem empedans referanslarını kullanarak Solo12 dört bacaklı robotu üzerinde uçtan uca kontrolünün sağlanması yöntemi benimsenmiştir. Politika ağı tarafından üretilen eklem açısı hedef yer değiştirmeleri, düşük seviyeli bir oransal türevsel (PD) denetleyici yardımıyla motor torklarına dönüştürülmüştür.

# Bulgular ve önermeler

1. Geliştirilen pekiştirmeli öğrenme tabanlı uçtan uca kontrolör, Solo12 robotunun gerçek ortamdaki hız takip performansını yüksek doğrulukla yerine getirmesini sağlamış ve bu durum hareket yakalama verileriyle doğrulanmıştır.
2. Durum ve dinamik rastgeleleştirme süreçlerinde uygulanan aşamalı gürültü müfredatı, kontrol politikasının simülasyondaki ideal koşullardan gerçek dünyadaki fiziksel sapmalara ve gürültülere uyum sağlamasını kolaylaştırmıştır.
3. Robotun ilerleme hızı ile bacak adım frekansı arasında eğitim sürecinde kendiliğinden gelişen doğrusal bir ilişki keşfedilmiş olup, bu dinamik uyarlama dışarıdan elle kodlanmış bir kural olmaksızın pekiştirmeli öğrenme ile elde edilmiştir.
4. Fiziksel modeldeki kaçınılmaz eksikliklere ve aktüatör gürültülerine rağmen, geliştirilen kontrol politikaları simülasyondan gerçek Solo12 robotuna hiçbir ek aktarım modellemesine ihtiyaç duymadan ilk denemede başarıyla aktarılmıştır.

# Yazarın tartışması

Çalışmada elde edilen bulgular, derin pekiştirmeli öğrenme ile eğitilen eklem empedans kontrolörlerinin Solo12 quadruped robotu üzerinde son derece dayanıklı ve kararlı bir hareket kabiliyeti ürettiğini göstermektedir. Geliştirilen uçtan uca ağ yapısı, robotun iç mekanlardaki düz zeminlerden dış mekanlardaki çakıl, çim ve eğimli arazilere kadar geniş bir yelpazede kararlı adımlar atmasını mümkün kılmıştır.

Yazarlar, simülasyon ortamı ile gerçek dünya arasındaki fiziksel uyumsuzlukların (sim-to-real gap) aşılması için ayrıntılı bir aktüatör modeli çıkarmak yerine, durumlara ve kontrolör kazançlarına aşamalı gürültü ekleyen bir müfredat öğrenimi tasarlamışlardır. Bu durum, Solo12 platformunun sahip olduğu düşük ataletli ve yüksek bant genişliğine sahip aktüatör yapısı sayesinde, basit rastgeleleştirme yöntemlerinin dahi başarılı bir sıfırıncı saniye (zero-shot) transferi gerçekleştirmek için yeterli olduğunu açıklamaktadır.

Elde edilen sonuçlar, literatürdeki benzer çalışmalarla karşılaştırıldığında önemli metodolojik katkılar barındırmaktadır. Örneğin, robotun durum tahmini ve kontrol ağlarının eş zamanlı olarak eğitilmesi yerine, durum tahmininin kontrol politikasından bağımsız olarak ardışık eğitilmesinin, simülasyon hızını düşürmeden ve performanstan ödün vermeden işlem maliyetlerini azalttığı deneysel olarak ortaya konmuştur.

Son olarak, literatürde tork, hız ve ivme için ayrı ayrı cezalandırma terimleri kullanılması yerine, Joule ısınması ve mekanik sürtünme kayıplarını birleştiren tek bir fiziksel güç cezası fonksiyonunun entegre edilmesi tartışılmıştır. Bu yaklaşım, sadece hiperparametre optimizasyonunu kolaylaştırmakla kalmamış, aynı zamanda robotun hız takip hassasiyetinde çok küçük sapmalar karşılığında yüzde otuzun üzerinde enerji tasarrufu yapmasını sağlayan yürüyüş stillerini başarıyla türetmiştir.

# Yazarın sonucu

Araştırmacılar, Solo12 quadruped robotu için geliştirdikleri derin pekiştirmeli öğrenme tabanlı uçtan uca kontrolörün, simülasyondan gerçek dünyaya doğrudan ve başarılı bir şekilde aktarılabildiğini; ayrıca eyleyici sürtünmesi ve Joule kayıplarını birleştiren fiziksel bir güç cezası terimi eklenerek, hız takibinde küçük ödünlerle yüzde 30'un üzerinde enerji tasarrufu sağlayan enerji verimli hareket politikalarının elde edilebildiğini ortaya koymuştur.

# Literatürdeki işlevi

Bu çalışma, bacaklı robotik sistemlerin dinamik yürüyüş yeteneklerini geliştirmeyi hedefleyen literatürde, klasik model öngörülü denetim (MPC) yaklaşımları ile veri güdümlü pekiştirmeli öğrenme (RL) yöntemleri arasında sağlam bir ampirik köprü kurmaktadır. Geleneksel yörünge optimizasyonlarının yüksek hesaplama yükü, karmaşık modelleme ihtiyaçları ve çevreye uyum zorluklarına karşın, uçtan uca öğrenme tabanlı bir eklem empedans kontrolörünün pratik ve kararlı bir alternatif olduğunu gösterir. Çalışma, simülasyon ortamından gerçek fiziksel sisteme aktarımda karşılaşılan uyuşmazlıkları (sim-to-real gap) aşmak için hafif ve yüksek bant genişliğine sahip Solo12 robotik donanımının dinamik özelliklerini avantaja çeviren sade bir rastgeleleştirme yaklaşımı önermektedir. Bu yönüyle literatürdeki aşırı karmaşık aktüatör modellemelerine olan ihtiyacı azaltmaktadır.

Önceki çalışmalarla ilişkisi: Çalışma, ANYmal ve Mini-Cheetah gibi platformlarda yürütülen öncü pekiştirmeli öğrenme tabanlı hareket denetimi çalışmalarını (örneğin Hwangbo vd., Miki vd. ve Ji vd. çalışmaları) doğrudan temel almaktadır. Ancak bu çalışmalarda kullanılan doğrudan tork denetimi yerine, kararlılığı artıran eklem empedans referanslarının (konum tabanlı empedans kontrolü) öğrenilmesini önermekte ve bu yolla metodolojik olarak ayrışmaktadır. Ayrıca önceki literatürde yaygın olan durum tahmini ve kontrol politikalarının eş zamanlı eğitilmesi yaklaşımının yarattığı yüksek işlem yükünü eleştirerek, durum tahmin ağının bağımsız bir denetimli öğrenme süreciyle ardışık olarak eğitilmesini savunur. Enerji tasarrufu sağlamak adına literatürde tork, hız ve ivme terimlerinin ayrı ayrı cezalandırıldığı sezgisel yaklaşımlar yerine, motorların Joule ve sürtünme kayıplarını birleştiren tek bir fiziksel güç kaybı cezası önermektedir.

Literatür taramasına katkısı: Bu makale, robotik hareket kontrolü üzerine yapılacak literatür taramalarına (review) çok yönlü bir metodolojik katkı sunmaktadır. İlk olarak, pekiştirmeli öğrenmede ödül fonksiyonu tasarımı (reward design) yaparken fiziksel kısıtların ve enerji verimliliğinin nasıl formüle edileceğini somut, fiziksel temelli bir güç kaybı denklemiyle standartlaştırmaktadır. İkinci olarak, simülasyondan gerçek dünyaya aktarımda (zero-shot transfer) aşamalı gürültü müfredatı (noise curriculum) kullanımının deneysel başarısını ortaya koyarak bu tekniğin etkinliğini ampirik olarak doğrulamaktadır. Üçüncü olarak, açık kaynak kodlu ve erişilebilir bir platform olan Solo12 quadruped robotunun kontrol çalışmalarındaki standardizasyon potansiyelini doğrulayarak, pahalı ve kapalı ticari robotlara olan bağımlılığı azaltacak alternatif bir bilimsel araştırma yolu açmaktadır.

# Tez ve makale araştırmalarında kullanım

- **Dört bacaklı robotik sistemlerde uçtan uca pekiştirmeli öğrenme temelli denetleyicilerin doğrudan gerçek robota aktarımında donanım özelliklerinin sim-to-real boşluğunu azaltmadaki etkisi tartışılabilir.** — Robotun fiziksel dinamiklerinin sim-to-real aktarım kolaylığına katkısı tartışılırken, Solo12 platformunun hızlı dinamikleri sayesinde basit rastgeleleştirme ile doğrudan aktarılabildiği kanıt olarak sunulacaktır.
- **Quadruped robotların enerji verimli hareket yetenekleri kazanmasında, fiziksel motor kayıplarını ve mekanik sürtünmeleri birleştiren güç cezası formülasyonlarının etkisi yüksektir.** — Geleneksel tork, hız ve ivme cezaları yerine fiziksel tabanlı güç kaybı formülasyonunun tercih edilmesinin hem enerji tasarrufu hem de hiperparametre optimizasyon kolaylığı sağladığı iddiasını desteklemek için kullanılır.
- **Dört bacaklı robotların hareket denetiminde pekiştirmeli öğrenme modellerinin sınır ağı mimarisi tasarımı ve çalışma frekanslarının belirlenmesinde empedans tabanlı denetleyiciler tercih edilmelidir.** — Çalışmada önerilen 3 gizli katmanlı MLP (256, 128, 32) mimarisi ve 100Hz frekanstaki kontrol döngüsünün yöntemsel kurulumunu temellendirmek için referans gösterilir.

# Türetilebilir araştırma soruları

- **Farklı zemin tiplerinde (kum, çakıl, çim) fiziksel güç cezasıyla eğitilmiş empedans kontrolörünün enerji tasarrufu performansı nasıl değişmektedir?**
  - Desen: Deneysel tasarımda, Solo12 veya benzeri bir quadruped robot simülasyon ortamında (Raisim) kum, çakıl ve çim zemin yükseklik haritaları tanımlanarak test edilecektir. Bağımsız değişken olarak güç kaybı katsayısı (c_E) 0 ile 10 arasında değiştirilerek, bağımlı değişkenler olan ortalama güç tüketimi (Watt) ve hız takip hatası ölçülecektir. Örneklem büyüklüğü simüle edilmiş 100 farklı deneme serisi ile belirlenecektir. Veriler ANOVA testi ile analiz edilecektir.
  - Gerekçe: Makalede c_E katsayısının artırılmasının güç tüketimini azalttığı fakat hız hatasını artırdığı bulgulanmıştır. Bu durumun farklı dış zemin pürüzlülüklerinde nasıl ölçeklendiği makalede açık bırakılmıştır.
- **Durum ve dinamik rastgeleleştirmedeki gürültü müfredatı katsayısının (k_c, noise) artış hızı, robotun gerçek dünyadaki yürüyüş kararlılığını nasıl etkiler?**
  - Desen: Kontrollü bir deneysel simülasyon ve fiziksel test tasarımı kurulacaktır. İki farklı grup oluşturulacaktır: Birinci grupta gürültü doğrusal ve hızlı artırılacak, ikinci grupta ise makaledeki gibi yavaş bir gürültü müfredatı uygulanacaktır. Gerçek robot üzerinde 20'şer deneme yapılarak gövde yalpalaması (roll-pitch sapmaları) ve düşme frekansları ölçülecektir. Grup karşılaştırmaları t-testi ile yapılacaktır.
  - Gerekçe: Makalede gürültü müfredatının sim-to-real transferini kolaylaştırdığı belirtilmiş, ancak bu gürültünün artış hızının veya profillerinin transfer başarısı üzerindeki hassas sınırları araştırılmamıştır.
- **Durum tahmin ağının kontrol politikasıyla eş zamanlı eğitilmesi ile sıralı (ardışık) eğitilmesinin eğitim yakınsama hızı ve tahmin doğruluğu üzerindeki etkisi nedir?**
  - Desen: İki farklı yazılımsal eğitim mimarisi tasarlanacaktır: Biri durum tahminini ve kontrol politikasını eş zamanlı optimize eden uçtan uca mimari, diğeri ise makalede önerilen sıralı eğitim mimarisidir. Her iki yaklaşım 10 farklı rastgele başlangıç tohumu (seed) ile 10.000 iterasyon boyunca eğitilecektir. Bağımlı değişkenler olarak toplam eğitim süresi (saat), ortalama ödül yakınsama hızı ve tahmin edilen hız ile gerçek hız arasındaki MSE hatası ölçülüp karşılaştırılacaktır.
  - Gerekçe: Yazarlar, durum tahmin ağının sıralı olarak eğitilmesinin performanstan ödün vermeden RL eğitimini hızlandırdığını savunmuş ancak bunu nicel olarak karşılaştıran ayrıntılı bir deney sunmamışlardır.

# Kaynak izleri

Her iddia, özgün yayının belirtilen sayfasındaki birebir alıntıya bağlıdır.

| Kanıt | Bölüm | PDF sayfası | Basılı sayfa | Alıntı |
|---|---|---|---|---|
| ev-o-1 | ABSTRACT | 1 | — | In this work, we present an implementation of a robust end-to-end learning-based controller on the Solo12 quadruped. |
| ev-s-1 | ABSTRACT | 1 | — | In this work, we present an implementation of a robust end-to-end learning-based controller on the Solo12 quadruped. |
| ev-s-2 | Method | 4 | — | The actions that define joint angle targets are then fed to a Proportional Derivative (PD) feedback controller in order to get the desired torques for commanding the robot joints. |
| ev-s-3 | Experimental Results | 9 | — | From the plots, we see that the real robot is able to follow the commanded velocity well, as indicated by the alignment between the motion capture plots |
| ev-s-4 | Curriculum learning | 7 | — | We also propose a curriculum on the injected noise for randomizing the state and dynamics. |
| ev-s-5 | Gait frequency | 12 | — | We see a proportional relationship between the velocity and gait frequency. This behaviour emerges naturally during learning and is not hand-designed. |
| ev-s-6 | Comment on the policy transfer to Solo12 | 12 | — | Despite these inevitable model inaccuracies, the policies were successfully transferred on the very first try. |
| ev-s-7 | Experimental Results | 8 | — | In our experiments, we didn't observe any advantage when training both networks together and decided to train the estimation network after the control policy |
| ev-s-8 | Comment on the policy transfer to Solo12 | 12 | — | The transfer did not require learning an actuator model, as done in other works ? , or modeling the actuation dynamics to include a bandwidth limitation through a low pass filter o |
| ev-l-3 | Experimental Results | 8 | — | The control policy is implemented as a multi-layer perceptron with three hidden layers of sizes 256, 128 and 32 with Leaky ReLU activations between each layer. |
| ev-l-4 | Experimental Results | 9 | — | This confirms that the power term on the learned policy makes intuitive sense and that it can be tuned to learn locomotion with different power profiles. |
| ev-l-5 | Comment on the policy transfer to Solo12 | 12 | — | This demonstrates how a simple randomization during training is enough for direct transfer to Solo12, probably by virtue of the fast dynamics of this robot |

# İlgili kavramlar

- [Perceval: Ayrık Değişkenli Fotonik Kuantum Hesaplama İçin Bir Yazılım Platformu](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/perceval-ayrik-degiskenli-fotonik-kuantum-hesaplama-icin-bir-yazilim-platformu.md)
- [Nükleer Manyetik Rezonans Deneylerinin İyon Tuzağı Kuantum Bilgisayarlarında Dijital Kuantum Simülasyonu](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/nukleer-manyetik-rezonans-deneylerinin-iyon-tuzagi-kuantum-bilgisayarlarinda-dijital-kuantum-simulasyonu.md)
- [Kuantum Varyasyonel Algoritmalar Tuzaklarla Doludur: Çorak Platoların Ötesinde Eğitilebilirlik Analizi](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/kuantum-varyasyonel-algoritmalar-tuzaklarla-doludur-corak-platolarin-otesinde-egitilebilirlik-analizi.md)
- [Yüzey Kodu Eşiğinin Altında Kuantum Hata Düzeltme: Süperiletken İşlemcilerde Üstel Hata Bastırma ve Gerçek Zamanlı Kod Çözme](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/yuzey-kodu-esiginin-altinda-kuantum-hata-duzeltme-superiletken-islemcilerde-ustel-hata-bastirma-ve-gercek-zamanli-kod-cozme.md)
- [Yapay Zeka ve Makine Öğrenmesi Yöntemleriyle Uçak Performansının İyileştirilmesi: Derleme Çalışması](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/yapay-zeka-ve-makine-ogrenmesi-yontemleriyle-ucak-performansinin-iyilestirilmesi-derleme-calismasi.md)
- [Kuantum Yineleyiciler: Kuantum Ağlarından Kuantum İnternetine Kapsamlı Bir İnceleme](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/kuantum-yineleyiciler-kuantum-aglarindan-kuantum-internetine-kapsamli-bir-inceleme.md)
- [Uzaktan Algılama Yöntemleri ile İmar Planları ve Kentsel Gelişim Arasındaki İlişkinin Belirlenmesi: Ankara Örneği](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/uzaktan-algilama-yontemleri-ile-imar-planlari-ve-kentsel-gelisim-arasindaki-iliskinin-belirlenmesi-ankara-ornegi.md)
- [Türkiye'nin Tarımsal Kredi Performansının K-ortalamalar Kümeleme Algoritması ile Analizi](/okf/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/turkiyenin-tarimsal-kredi-performansinin-k-ortalamalar-kumeleme-algoritmasi-ile-analizi.md)

# Şeffaflık

- Analiz tarihi: 2026-08-20T01:21:29.951Z
- Kanıt sayısı: 12
- Üretim sürümü: makale-analizi-v3.0.0
- Kanonik sayfa: https://makaleanalizi.com/muhendislik-ve-teknoloji/bilgisayar-ve-elektrik-muhendisligi/derin-pekistirmeli-ogrenme-ile-solo12-dort-bacakli-robotunun-denetimi
