MarkTechPost
مصدر أخبار الذكاء الاصطناعي. تُختار المقالات وتُعدَّل من قِبَل تحرير Hamidun News.
أحدث المنشورات

كشفت Meta عن Autodata — نظام قائم على الوكلاء لإنشاء بيانات تدريب عالية الجودة
كشفت Meta عن Autodata — إطار عمل تجمع فيه وكلاء LLM بيانات التدريب ويتحققون منها ويحسنونها بأنفسهم، لكي تتعلم النماذج الأقوى من أمثلة أكثر تعقيدًا ودقة.

NeuralSet و deep learning: فك ترميز السمات اللغوية من إشارات MEG الدماغية
يوضح تحليل جديد من NeuralSet كيف يمكن تحويل إشارات MEG الخام إلى نموذج يتنبأ بالسمات اللغوية، بما في ذلك طول الكلمة، مباشرة من نشاط الدماغ.

Microsoft OpenMementos: كيف تتعامل مع ضغط السياق وبيانات لتدريب النماذج
يوضح شرح خطوة بخطوة لمجموعة بيانات Microsoft OpenMementos كيفية بث reasoning traces، وتحليل الكتل وmementos، وقياس ضغط السياق، وتجهيز البيانات من أجل fine-tuning.

قدمت ستانفورد OpenJarvis — حزمة من وكلاء AI المحليين مع الذاكرة والتعلّم
قدمت ستانفورد OpenJarvis — منصة لوكلاء AI شخصيين يعملون مباشرة على الجهاز، ويستخدمون الذاكرة والأدوات، ويتعلمون من البيانات المحلية.

أطلق Harry Tan مشروع gstack — نظام workflow لـ Claude Code مع QA والمراجعة والإصدار
نشر Harry Tan مشروع gstack كمصدر مفتوح — وهو مجموعة أوضاع لـ Claude Code تفصل التخطيط والمراجعة وQA والإصدار إلى أوامر مستقلة وتضيف متصفحًا دائمًا.

أطلقت Zhipu AI نموذج GLM-OCR، وهو نموذج OCR صغير الحجم يضم 0.9 مليار معلمة للمستندات
قدمت Zhipu AI وجامعة تسينغهوا GLM-OCR، وهو نموذج OCR متعدد الوسائط يضم 0.9 مليار معلمة ويحلل المستندات المعقدة والجداول والصيغ من دون الاعتماد على حجم هائل.

أطلقت LangChain مكتبة Deep Agents لوكلاء AI متعددي الخطوات مع الذاكرة والعزل
أطلقت LangChain مكتبة Deep Agents، وهي مكتبة لوكلاء AI يحتاجون إلى التخطيط والذاكرة طويلة الأمد وسياق الملفات وعزل الوكلاء الفرعيين في المهام الطويلة.

أطلقت IBM Granite 4.0 1B Speech — نموذجًا صوتيًا متعدد اللغات ومضغوطًا لـ edge AI
قدمت IBM Granite 4.0 1B Speech، وهو نموذج خفيف للتعرّف على الكلام وترجمته، ومصمم للنشر السريع في سيناريوهات المؤسسات وedge ذات الموارد المحدودة.

قدمت Moonshot AI Attention Residuals — بديلاً عن residual connections في transformers
اقترحت Moonshot AI Attention Residuals كبديل لـ residual connections القياسية في transformers، حيث تختار الطبقة بنفسها الإشارات المفيدة عبر attention على امتداد عمق الشبكة.

أطلقت Mistral نموذج Small 4 — نموذج MoE يضم 119 مليار معلمة لـ reasoning والبرمجة وتعدد الوسائط
يجمع Mistral Small 4 الجديد بين instruct وreasoning والبرمجة والعمل مع الصور في نموذج MoE open-source واحد يضم 119 مليار معلمة وسياقًا بطول 256k.

أطلقت Google WAXAL، مجموعة بيانات كلامية مفتوحة للغات الأفريقية
أتاحت Google WAXAL، وهي مجموعة كبيرة من البيانات الكلامية للغات الأفريقية، ومن المفترض أن تسرّع التعرف على الكلام وتوليده في المجالات التي ظلّت البيانات المفتوحة فيها شحيحة بشكل حرج حتى الآن.

أتاحت Nvidia شيفرة OpenShell، وهي بيئة آمنة لوكلاء AI المستقلين
أطلقت Nvidia مشروع OpenShell كمصدر مفتوح: وهي بيئة تضم sandboxes وسياسات وصول وتوجيهاً خاصاً لكي تعمل وكلاء AI المستقلون مع الكود والشبكة بمزيد من الأمان.

Baidu تطلق Qianfan-OCR — نموذج 4B للتعرّف على المستندات وفهمها
قدّمت Baidu نموذج Qianfan-OCR، وهو نموذج 4B موحّد يحلل بنية المستند، ويتعرّف على النص، ويستخرج الجداول أو يجيب عن الأسئلة عند الطلب.

أظهر MarkTechPost كيفية بناء نظام LLM مزود بالتقييم الذاتي والثقة والبحث على الويب
عرض MarkTechPost مخططًا عمليًا لـ uncertainty-aware LLM: يجيب النموذج أولًا ويقدّر مستوى ثقته، ثم يراجع نفسه ويطلق بحثًا على الويب عند الشك.

GitAgent يطرح تنسيقًا موحدًا لوكلاء AI في LangChain وAutoGen وClaude Code
يقترح GitAgent تخزين منطق وكيل AI وذاكرته وقواعده في مستودع Git، ثم تصدير الوكيل نفسه إلى LangChain وAutoGen وClaude Code وبيئات أخرى.

Google تطلق colab-mcp: كيف تقوم الوكلاء بأتمتة دفاتر Colab في الإنتاج
قدمت Google خادم colab-mcp مفتوح المصدر لإدارة دفاتر Colab عبر MCP: يمكن للوكلاء إضافة خلايا وتنفيذ الأكواد وبناء سير عمل قوي دون روتين يدوي.

يان لوكن يقدم LeWorldModel — نموذج JEPA بدون انهيار التمثيلات من البيكسل
قدم فريق يان لوكن LeWorldModel — نموذج عالمي يتعلم مباشرة من البيكسل مع دالتي خسارة، ويتجنب انهيار التمثيلات، ويخطط بسرعة تصل إلى 48 مرة أسرع من البدائل.

تقدم HKUDS لـ OpenSpace بالتفصيل — محرك التطور الذاتي للمهارات لوكلاء الذكاء الاصطناعي
أوضحت HKUDS كيف يحول OpenSpace وكلاء الذكاء الاصطناعي إلى أنظمة ذاتية التعلم: يحافظ المحرك على المهارات بعد كل مهمة، ويعيد استخدامها، ويقلل بشكل كبير من استهلاك الرموز.

أعلنت Nvidia عن PivotRL — إطار عمل لوكلاء الذكاء الاصطناعي بتوفير 4x في خطوات rollout
أعلنت Nvidia عن PivotRL — منهج لضبط وكلاء الذكاء الاصطناعي الذي يحافظ على الجودة خارج مجال التدريب ويحقق دقة مماثلة لـ E2E RL مع خطوات rollout أقل بأربع مرات.

جوجل تقدّم TurboQuant: ضغط ذاكرة KV-cache بمعدل 6 مرات لنماذج اللغة الكبيرة بدون فقدان الدقة
قدّمت جوجل ريسيرتش TurboQuant — خوارزمية تضغط ذاكرة KV-cache لنماذج اللغة الكبيرة بما لا يقل عن ست مرات وتسرّع حساب الانتباه بحد أقصى 8 مرات بدون تدهور الجودة.

MolmoWeb-4B من Ai2: وكيل ويب يرى المواقع كما يراها البشر، بدون معالجة HTML
أطلقت Ai2 MolmoWeb-4B — وكيل ويب متعدد الأنماط مفتوح المصدر يتحكم في المتصفح باستخدام لقطات الشاشة فقط، بدون الوصول إلى HTML أو شجرة DOM.

تطلق Tencent Covo-Audio — نموذج 7B للحوارات الصوتية والتفكير الصوتي
أطلقت Tencent AI Lab كود مفتوح المصدر Covo-Audio — نموذج صوتي 7B يقبل الكلام المستمر، ويرد بالصوت، ويستهدف الحوارات والتفكير في الوقت الفعلي.

Qwen3.5: تشغيل نماذج Reasoning بتنسيق GGUF و4-بت عبر Colab
يتم عرض خط أنابيب Colab لتشغيل نماذج Qwen3.5 للمنطق، المقطرة بأسلوب Claude: بإعداد واحد يمكنك التبديل بين GGUF بـ 27B ونسخة خفيفة الوزن 2B بـ 4-بت.

أطلقت Google نموذج Gemini 3.1 Flash Live لوكلاء الذكاء الاصطناعي الصوتيين والحوار متعدد الأنماط
فتحت Google وصول معاينة إلى Gemini 3.1 Flash Live — نموذج لوكلاء الذكاء الاصطناعي الصوتيين والبصريين بزمن استجابة منخفض ودعم الأدوات وحوار أكثر طبيعية.

IWE و OpenAI: كيفية تحويل ملاحظات Markdown إلى رسم بياني للمعرفة لوكلاء الذكاء الاصطناعي
باستخدام IWE كمثال، أوضحنا كيفية بناء رسم بياني للمعرفة محلي من markdown، وربط استدعاءات دوال OpenAI، وبناء agentic RAG مع عبور العلاقات بين الملاحظات.

أوضحت Google الفرق بين Google-Agent و Googlebot للوصول والفهرسة بـ AI
وصفت Google كيفية اختلاف Google-Agent الجديد عن Googlebot: الأول ينفذ إجراءات على الموقع بناءً على طلب المستخدم، والثاني يزحف تلقائياً إلى الويب للفهرسة.

قدم الباحثون المنتسبون إلى Amazon نظام A-Evolve للتطور التلقائي لوكلاء الذكاء الاصطناعي
قدم الباحثون المنتسبون إلى Amazon نظام A-Evolve — وهو نظام يؤتمت تطوير وكلاء الذكاء الاصطناعي ويستبدل الضبط اليدوي بتطور الحالة والتصحيح الذاتي.

قدمت Agent-Infra بيئة AIO Sandbox — بيئة موحدة لوكلاء الذكاء الاصطناعي مع متصفح وـ Shell
أطلقت Agent-Infra بيئة AIO Sandbox مفتوحة المصدر — بيئة حاوية يتم فيها دمج المتصفح و Shell والطبقة المشتركة للملفات و MCP في وقت تشغيل واحد لوكلاء الذكاء الاصطناعي.

Cursor تطلق SDK TypeScript لوكلاء الترميز مع صناديق رمل سحابية وتسعير بالرموز
فتحت Cursor النسخة التجريبية العامة من SDK TypeScript: يمكن للمطورين الآن تشغيل وكلاء الترميز محليًا أو في السحابة أو على عمالهم الخاصين—مع VMs معزولة وsubagents وhooks والفوترة بالرموز.

أطلقت Alibaba نموذج Qwen3.5-Omni — نموذج متعدد الأنماط الأصلي للنصوص والصوت والفيديو
كشفت Alibaba عن Qwen3.5-Omni — نموذج شامل الأنماط الأصلي يفهم النصوص والصور والصوت والفيديو في بنية واحدة ويمكنه الرد بالصوت في الوقت الفعلي.