TGViewer
Channel Public Channel
DLeX: AI Python

DLeX: AI Python

@ai_python

هوش‌مصنوعی و برنامه‌نویسی

توییتر :

https://twitter.com/NaviDDariya

تا آزادی ایران از جمهوری اسلامی تبهکار، تبلیغات نداریم.
Subscribers
21.4K
Photos
5.2K
Videos
1.3K
Links
4.7K

Showing posts older than #18194 · Back to latest

Older Posts 20 shown
Post #18193 2.49K
در حال حاضر سه راه اصلی برای ایجاد محدودیت خواندن داده ها برای Agent های هوش مصنوعی در SharePoint وجود داره.

👉 @ai_python ✍️

نکته مهم درباره راه سوم اینه که نیاز به لایسنس اضافه داره.
  • ❤ 7
  • 👍 4
Post #18192 2.89K
قبلن در چانال به این موضوع اشاره کرده بودیم که اجنت های هوش مصنوعی به قدری در اکوسیستم Microsoft اینتگریت شدن که حتی در محصولی مثل Entra ، همون دسترسی هایی که به کاربران معمولی می دیم برای اجنت های خودکار هوش مصنوعی هم وجود داره و قابل تعریف هستند.

👉 @ai_python ✍️

حالا سوال اینجاست که دیتاهای ما چگونه باشند تا اجنت ها، موثر تر بتوانند آن ها را بخوانند و نتایج قابل اتکا تری به ما ارائه کنند؟ برای مثل در SharePoint ساختار مناسب برای داده ها چگونه است؟

این پست وبلاگ مایکروسافت درباره همین موضوع است :

Unlocking knowledge through intelligence: Lessons learned using SharePoint agents at Microsoft - Inside Track Blog
Microsoft News Unlocking knowledge through intelligence: Lessons learned using SharePoint agents at Microsoft Discover how we’re using SharePoint agents to scale enterprise knowledge internally here at Microsoft.
  • ❤ 9
  • 👍 3
Post #18188 2.35K

Forwarded from Reza Jafari

معرفی بنچمارک جدید ProgramBench : سخترین آزمون مهندسی نرم افزار برای LLMها

بنچمارک ProgramBench یه بنچمارک خیلی جدی و متفاوت برای ارزیابی توانایی LLMها در ساخت نرم‌افزار از صفره. ایده‌ی اصلیش اینه که ببینه آیا مدل‌های زبانی واقعاً می‌تونن فقط با داشتن یک executable و documentation، دوباره کل یک برنامه رو بازسازی کنن یا نه.

توی هر تسک، Agent فقط به فایل اجرایی برنامه و مستنداتش دسترسی داره؛ نه Source Code رو می‌بینه، نه اجازه‌ی decompile کردن داره و نه حتی اینترنت در اختیارشه. یعنی مدل باید دقیقاً مثل یه مهندس نرم‌افزار واقعی، رفتار برنامه رو بررسی کنه، Architecture طراحی کنه، Language انتخاب کنه، کل Source Code رو بنویسه و حتی Build Script هم بسازه.

این بنچمارک حدود ۲۰۰ تسک مختلف داره؛ از ابزارهای سبک command-line مثل jq و ripgrep گرفته تا پروژه‌های سنگین و پیچیده‌ای مثل PHP، FFmpeg و SQLite.

نکته‌ی مهم اینه که ProgramBench هیچ ساختار آماده‌ای به مدل نمی‌ده. خبری از method signature، class skeleton یا حتی توضیح درباره‌ی ساختار فایل‌ها نیست. Agent خودش باید تصمیم بگیره برنامه چطور modular بشه، چه abstractionهایی تعریف بشه و interfaceها چه شکلی باشن. همین باعث میشه این بنچمارک بیشتر از اینکه صرفاً coding رو بسنجه، توانایی واقعی software design و system architecture رو اندازه‌گیری کنه.

بعد از اینکه Agent برنامه رو تحویل می‌ده، یه test suite خیلی بزرگ رفتار نسخه‌ی ساخته‌شده رو با برنامه‌ی اصلی مقایسه می‌کنه. این تست‌ها با agent-driven fuzzing تولید شدن و در مجموع بیشتر از 248 هزار behavioral test روی ۲۰۰ تسک اجرا میشه. فقط وقتی همه‌ی تست‌ها پاس بشن، اون تسک «حل‌شده» حساب میشه.

یکی از جذاب‌ترین بخش‌های ProgramBench اینه که عمداً جلوی shortcutها و cheating گرفته شده. Agentها داخل sandbox اجرا میشن، اینترنت ندارن و حتی دسترسی read به binary هم ندارن؛ یعنی ابزارهایی مثل decompiler، disassembler یا objdump عملاً کار نمی‌کنن. هدف اینه که benchmark واقعاً توانایی “building from scratch” رو اندازه بگیره، نه سرهم کردن کدهای decompiled.

امتیازها فعلاً خیلی پایینن، ولی این خودش نشون می‌ده مسئله چقدر سخت و واقعی طراحی شده. با اینکه مدل‌ها روی خیلی از تسک‌ها partial progress دارن، ولی هنوز ساخت کامل و بدون نقص نرم‌افزارهای بزرگ برای AI یه چالش جدیه.

در کل، ProgramBench الان یکی از جدی‌ترین بنچمارک‌ها برای سنجش توانایی واقعی AI Agentها در Software Engineering محسوب میشه؛ جایی که فقط code generation مهم نیست، بلکه planning، architecture، debugging و understanding رفتار سیستم هم نقش اصلی رو دارن.

🔗 لینک سایت ProgramBench


👑 توضیحات در مورد دوره منتورینگ
🏆 نحوه ثبت‌نام در دوره منتورینگ
🤝 تجارب موفق قبلی بچه‌ها از منتورینگ

@reza_jafari_ai
  • ❤ 16
  • 👍 7
Post #18187 2K
Post #18186 2.76K
گوگل کروم هم قابلیت Skills اضافه کرده

👉 @ai_python ✍️

X
  • 👍 6
  • ❤ 5
Post #18185 2.88K
DLeX: AI Python این دوتا ربات با کمک هم اتاق رو مرتب می کنن. شرکت Figure 👉 @ai_python ✍️ لینک توییت : https://x.com/Figure_robot/status/2052770982214172892?s=20
آقای Corey Lynch در این باره خاطر نشان کردن که :

To be clear, there's no explicit messaging between these robots, they coordinate their actions fully visually, e.g. head nods.
  • ❤ 6
  • 👍 6
Post #18181 3.49K
به نظر می رسه که انتروپیک اداپتری به نام Introspection Adapters معرفی کرده که بهمون کمک می کنه مثل یک اسکن مغزی متوجه بشیم، مدل دقیقن از درون داره چیکار می کنه و چطور تصمیم می گیره

👉 @ai_python ✍️

لینک توییت :

https://x.com/bigsuey/status/2050002421259104281
  • ❤ 10
  • 👍 6
  • 🐳 3
Post #18180 3.85K
مدل Gemini Embedding 2 برای استفاده عرضه شد. این مدل از امبدینگ متن، تصویر، ویدیو و صدا، پشتیبانی می کند.

👉 @ai_python ✍️
  • ❤ 19
  • 💔 5
  • 👍 3
  • 😭 2
Post #18179 3.84K

Forwarded from ایلان ماسک به فارسی

در حالی که مدت زیادی هست که هواپیماها با اینترنت استارلینک به پهنای باند بالا متصل هستند، حکومت امام زمان از ترس مردم (الناس) کشور، اینترنت را برای مدت 54 روز است که قطع کرده است.

🖥 @elonfact 🙄
  • 💔 24
  • 😭 11
  • 🐳 4
Post #18178 3.31K
Post #18177 3.31K
Post #18176 2.62K
Post #18175 2.65K
Post #18174 2.82K
رباتی که پت سیتری هم بلده 💓

👉 @ai_python 🦁 ☀️

For an industrial robot built for the rigors of factories and power plants, tidying up a living room may seem like a light day at the office for Spot. Yet, this demonstration represents the promise of AI models in robotics. In this case, @GoogleDeepMind's visual-language model (VLM) Gemini Robotics-ER 1.5 was empowering Spot with embodied reasoning.
Go behind the scenes and watch the full demo in our blog: https://bosdyn.co/483K9JM

📎 Boston Dynamics (@ BostonDynamics) (https://x.com/BostonDynamics/status/2044069050347561172)
  • 🐳 7
  • ❤ 6
  • 👍 2
Post #18173 2.77K
با ویژگی btw که البته مخفف همون By the way هست، خیلی راحت می تونید وقتی که Claude Code داره کارش رو انجام می ده یه دونه /btw بذارید و ازش سوالات دیگه بپرسید :

👉 @ai_python 🦁 ☀️

https://x.com/trq212/status/2031506296697131352
X (formerly Twitter) Thariq (@trq212) on X We just added /btw to Claude Code! Use it to have side chain conversations while Claude is working.
  • 👍 7
  • 🐳 4
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →