إنفيديا تطلق Switchyard: وسيط بلغة Rust يترجم بين واجهتي OpenAI و Anthropic

أطلقت NVIDIA أداة Switchyard برخصة Apache 2.0، وهي وسيط ومكتبة بلغة Rust توجّه حركة النماذج اللغوية وتترجم بين صيغتي OpenAI و Anthropic.

إنفيديا تطلق Switchyard: وسيط بلغة Rust يترجم بين واجهتي OpenAI و Anthropic

أطلقت NVIDIA أداة Switchyard برخصة Apache 2.0، وهي وسيط (Proxy) ومكتبة مكتوبة بلغة Rust لحركة النماذج اللغوية الكبيرة (LLM). توجّه الأداة الطلبات بين المزوّدين، وتترجم بين صيغتي OpenAI و Anthropic، وتسجّل مؤشرات التشغيل، وتوفّر خوارزميات توجيه ذات أنواع محددة وقابلة للتركيب. التوثيق متاح على docs.nvidia.com/nemo/switchyard.

المشكلة معروفة لدى الفرق التي تشغّل وكلاء البرمجة: أداة Claude Code تتحدث واجهة Anthropic Messages، وأداة Codex CLI تتحدث واجهة OpenAI، بينما النموذج الذي يريد الفريق تشغيله فعلياً يقع خلف vLLM أو NVIDIA NIM أو Ollama. وإعادة كتابة الوكيل ليست خياراً، لذا يجب أن تعمل طبقة الترجمة في موضع آخر.

طريقة العمل

يحتفظ العميل بواجهته الأصلية. يفكّ Switchyard الطلب الوارد إلى أنواع Rust محايدة تجاه المزوّد، ثم يشغّل خوارزمية توجيه لاختيار الخدمة الخلفية، ويعيد ترميز الطلب بصيغة تلك الخدمة، ويستدعيها، ثم يترجم الرد، بما في ذلك أحداث البث، إلى الشكل الذي يتوقعه العميل.

يقبل الخادم ثلاث صيغ واردة: OpenAI Chat Completions و OpenAI Responses و Anthropic Messages، وأي منها يمكن أن يخاطب أي مسار. المسار الواحد هو معرّف نموذج ظاهر للعميل مع الخوارزمية التي تقف خلفه. أما strong و weak و capable و efficient فهي أدوار داخل المسار لا خصائص ثابتة للنموذج، ويمكن للنموذج ذاته أن يؤدي أدواراً مختلفة في مسارات مختلفة.

هناك ثلاثة مسارات للتثبيت: مشغّل عبر uv tool install ينفّذ switchyard launch claude أو codex أو openclaw، ووسيط مستقل عبر cargo install --locked switchyard-server مع التحقق من الإعدادات بخيار --dry-run، ومكتبة switchyard-libsy التي تضمّن خوارزميات التوجيه دون امتلاك طبقة HTTP.

المؤشرات والإعداد

يعيد المسار GET /metrics نص Prometheus من مزوّد OpenTelemetry، ويغطي الطلبات والأخطاء وزمن الاستجابة وعائلات الرموز. ويُبلّغ switchyard_routing_overhead_ms عن زمن تشغيل الخوارزمية بعد خصم الاستدعاء الذي خدم الطلب، وتبدأ الفئات من 0.1 ميلي ثانية. ويتكوّن ملف الإعداد بصيغة TOML من ثلاث طبقات: llm_clients و targets و routes. لا تُخزَّن الأسرار في الملف، إذ يذكر api_key_env اسم متغير بيئة فقط، وقيمة max_retries الافتراضية 2 وتنطبق على أعطال النقل ومهل الانتظار وردود HTTP 408/429 و 5xx.

تصنّف NVIDIA الأداة بأنها ما قبل ألفا وتجريبية، وتحذّر من استخدامها في بيئات الإنتاج، وتتوقع تغييرات كبيرة في الواجهة والخوارزميات قبل الإصدار 1.0. التفاصيل في تقرير MarkTechPost.

Devamını oku

谷歌三周内再推Gemini 3.8 Flash:价格不变、编程能力逼近前沿大模型,网络安全版Flash Cyber仅向防御方开放

谷歌三周内再推Gemini 3.8 Flash:价格不变、编程能力逼近前沿大模型,网络安全版Flash Cyber仅向防御方开放

谷歌9月2日发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。距3.7 Flash仅三周,新Flash价格不变、速度相同,谷歌称其在DeepSWE v1.1等编程基准上逼近甚至超过更大的前沿模型。Flash Cyber专攻漏洞检测与自动修补,Chrome团队称其正确补丁数是顶级商用模型的2.6倍,但仅通过Fairwind计划向政府和关键基础设施等防御方开放。

GlobalFeed Editor tarafından
Google تطلق Gemini 3.8 Flash بالسعر نفسه وتحصر Flash Cyber في المدافعين عبر برنامج Fairwind

Google تطلق Gemini 3.8 Flash بالسعر نفسه وتحصر Flash Cyber في المدافعين عبر برنامج Fairwind

بعد 3 أسابيع فقط من 3.7 Flash، تعلن Google نموذجين جديدين: Gemini 3.8 Flash للجميع بسعر 3.7 نفسه ومكاسب كبيرة في البرمجة، و Flash Cyber لاكتشاف الثغرات وترقيعها، متاح حصراً للحكومات والبنى التحتية الحرجة عبر Fairwind.

GlobalFeed Editor tarafından