<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Reinforcement Learning | The .NET Blog</title><link>https://thedotnetblog.com/ar/tags/reinforcement-learning/</link><description>Articles, tutorials and insights from the .NET community.</description><generator>Hugo</generator><language>ar</language><managingEditor>@thedotnetblog (The .NET Blog)</managingEditor><webMaster>@thedotnetblog</webMaster><lastBuildDate>Thu, 18 Jun 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://thedotnetblog.com/ar/tags/reinforcement-learning/index.xml" rel="self" type="application/rss+xml"/><item><title>OpenEnv وFoundry يدفعان الحوار إلى ما بعد الوكلاء الثابتين</title><link>https://thedotnetblog.com/ar/news/emiliano-montesdeoca/openenv-foundry-learning-systems-what-stands-out/</link><pubDate>Thu, 18 Jun 2026 00:00:00 +0000</pubDate><author>Emiliano Montesdeoca</author><guid>https://thedotnetblog.com/ar/news/emiliano-montesdeoca/openenv-foundry-learning-systems-what-stands-out/</guid><description>قصة OpenEnv وFoundry الجديدة تتجاوز بكثير مصطلحات reinforcement learning الرنانة. إنها في الحقيقة دفع نحو أنظمة وكلاء يمكن تقييمها وتحسينها وتطويرها بمرور الوقت وفق نتائج أعمال حقيقية.</description><content:encoded>&lt;blockquote&gt;
&lt;p&gt;&lt;em&gt;تمت ترجمة هذه المقالة تلقائيًا. لقراءة الأصل، &lt;a href="https://thedotnetblog.com/ar/news/emiliano-montesdeoca/openenv-foundry-learning-systems-what-stands-out/"&gt;انقر هنا&lt;/a&gt;.&lt;/em&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;ما زالت معظم أحاديث الوكلاء تتوقف عند الاستدلال.&lt;/p&gt;
&lt;p&gt;هل يستطيع النموذج الإجابة على الطلب؟ هل يستطيع استدعاء الأداة؟ هل ينجز المهمة مرة واحدة؟&lt;/p&gt;
&lt;p&gt;النقاش الجديد حول &lt;strong&gt;OpenEnv + Foundry&lt;/strong&gt; مثير للاهتمام لأنه يحاول نقل الحديث إلى مكان أكثر طموحًا: &lt;strong&gt;كيف تبني نظام وكلاء يتحسن فعلاً بمرور الوقت؟&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;هذا سؤال أفضل بكثير.&lt;/p&gt;
&lt;h2 id="التحول-الأساسي-هو-من-الردود-إلى-حلقات-التعلم"&gt;التحول الأساسي هو من الردود إلى حلقات التعلم&lt;/h2&gt;
&lt;p&gt;يطرح منشور Foundry المشكلة حول البيئات، والتقييمات، والمعايير، والتحسين، وما بعد التدريب.&lt;/p&gt;
&lt;p&gt;يمكن تلخيص كل ذلك في جملة واحدة:&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;الهدف لم يعد مجرد تشغيل وكيل، بل امتلاك حلقة تقيس الوكيل وتحسنه مقابل نتائجك الفعلية.&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;هذا هو الجزء الذي أعتقد أن على المطورين الانتباه إليه.&lt;/p&gt;
&lt;p&gt;لأنك عندما ترى الأمر بهذه الطريقة، تصبح الأصول الدائمة ليست النموذج أو الطلب فقط. بل النظام المحيط به:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;البيئة التي يعمل فيها&lt;/li&gt;
&lt;li&gt;المعيار الذي يقيّمه&lt;/li&gt;
&lt;li&gt;التتبعات التي تشرح ما حدث&lt;/li&gt;
&lt;li&gt;المُحسّن الذي يطوّر التهيئة&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;هذه طريقة أكثر جاهزية للمؤسسات للتفكير.&lt;/p&gt;
&lt;h2 id="لماذا-يهم-هذا-حتى-لو-لم-تكن-تعمل-على-أبحاث-rl"&gt;لماذا يهم هذا حتى لو لم تكن تعمل على أبحاث RL&lt;/h2&gt;
&lt;p&gt;لنكن صريحين: مصطلحات مثل OpenEnv، وما بعد التدريب، ونمذجة العالم قد تجعل كثيرًا من المطورين يتجاهلون الموضوع فورًا.&lt;/p&gt;
&lt;p&gt;لكن الخلاصة العملية أبسط من المصطلحات.&lt;/p&gt;
&lt;p&gt;حتى لو لم تلمس حلقة تدريب مباشرة، فإن هذا العمل يشكل قصة المنصة لتطوير الوكلاء في المستقبل:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;تصبح التقييمات من الدرجة الأولى&lt;/li&gt;
&lt;li&gt;يصبح التحسين مستمرًا بدل أن يكون متقطعًا&lt;/li&gt;
&lt;li&gt;تصبح البيئات أصولًا قابلة لإعادة الاستخدام&lt;/li&gt;
&lt;li&gt;يصبح سلوك الوكيل الأفضل شيئًا يمكن قياسه، لا مجرد &amp;ldquo;يبدو أفضل في العروض التوضيحية&amp;rdquo;&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;هذه خطوة كبيرة إلى الأمام.&lt;/p&gt;
&lt;h2 id="وجهة-نظري"&gt;وجهة نظري&lt;/h2&gt;
&lt;p&gt;أذكى ما في هذا الإعلان ليس أي تفصيل بحثي واحد.&lt;/p&gt;
&lt;p&gt;إنه الإطار الذي يقدمه.&lt;/p&gt;
&lt;p&gt;من الواضح أن Microsoft تحاول نقل النظام البيئي من هندسة الطلبات الثابتة إلى &lt;strong&gt;أنظمة وكلاء مدفوعة بالنتائج&lt;/strong&gt;. أنظمة يمكن تقييمها، وضبطها، وحوكمتها، وتحسينها تدريجيًا.&lt;/p&gt;
&lt;p&gt;هذا هو مكان القيمة الجادة للمنصة.&lt;/p&gt;
&lt;p&gt;وإذا كنت تبني وكلاء اليوم، حتى على مستوى التطبيق، فمن المفيد متابعة إلى أين يتجه هذا.&lt;/p&gt;
&lt;p&gt;المقال الأصلي: &lt;a href="https://devblogs.microsoft.com/foundry/outcome-driven-learning-systems-enterprise-rl-with-openenv-and-foundry/"&gt;أنظمة التعلم المدفوعة بالنتائج: RL للمؤسسات مع OpenEnv وFoundry&lt;/a&gt;&lt;/p&gt;</content:encoded></item></channel></rss>