Service Hotline
הסיבה לתחזית נועזת כל כך היא שעם השחרור האחרון של סדרת מוצרי AI פורצי דרך, תחושת המשבר בקרב מתכנתים התחזקה יותר ויותר. האבולוציה של AI הובילה למשימות רבות בקידוד להחלפה.
יש לציין, קלוד 3.7, ששוב דחק את גבולות יכולות הקידוד, ו-Wave 4 של Windsurf הם דוגמאות מצוינות. בעבר, מודל ה-o3 וה-Cursor של OpenAI, שהפך לקלאסיקה בקרב מפתחים עצמאיים, הם מוצרי מדד שהובילו חלק לזעוק: משרות של מתכנתים נמצאות בסיכון.
כדאי להדגיש שבדירוג ה-Agentic Coding Evaluation האחרון, Sonnet 3.7 השיגה ציון של 67%, במקום הראשון מבין כל המודלים בהערכת מיומנות מפתח זוטר. המקומות השני והשלישי, GPT-4.5 וסונט 3.5, היו גם הם קרובים מאחור, שניהם עלו על 60%. זה מדגים את יכולות התכנות האדירות של הדגמים הללו.
במציאות, לשני הדגמים העיקריים יש מוקדים מעט שונים בתכנות. GPT-4.5 מצטיין במשימות הכרוכות בארכיטקטורה ובאינטראקציות בין מערכות, בעוד ש-Claude 3.7 Sonnet מתפקד טוב יותר בקידוד גולמי ועריכת קוד.
עצם הצהרה של ציונים עשויה שלא להעביר באופן אינטואיטיבי את היכולות של הדגמים הגדולים הללו, אז בואו נשתמש בדוגמה מעשית להמחשה.
בעבר, מודל ה-o3 השיג ציון Elo של 2727, המקביל לדירוג של מקום 175 בתחרות מבחן תכנות אנושי. זה דומה לבחינת כניסה למכללה שבה אף אחד לא יודע את השאלות מראש, כך שאין אפשרות שהדוגמניות תרגלו את השאלות מראש.
בתחרות זו השתתפו בסך הכל 168,076 מתכנתים ברחבי העולם, ודירוג של מקומות 175 o3 ב-0.1% העליון של המשתתפים (1 - 175/168,076 = 99.9%). במילים אחרות, o3 כבר עלתה על 99.9% מהמתכנתים בעולם בתחרויות תכנות, וסביר להניח שקלוד 3.7 Sonnet יצליח אפילו יותר.
לא רק קידוד AI השיג קפיצת מדרגה משמעותית ברמת הדגם, אלא שחלו גם שדרוגים גדולים בפיתוח המוצר.
הגרסה של Trae בחו"ל של ByteDance שילבה דגמים גדולים בינלאומיים כמו Claude-3.7-Sonnet ו-GPT-4o, ויש לה גם יכולות IDE. המטרה לאפשר אפילו למתחילים לקוד היא כמעט בהישג יד, מה שמוריד עוד יותר את מחסום הכניסה למתכנתים.
והכי חשוב, הגרסה בחו"ל של Trae היא חינמית לחלוטין, ומאפשרת למשתמשים לגשת לכל התכונות שלה ללא עלות. לעומת זאת, Cursor דורש מנוי בתשלום במחיר של $20 לחודש.
משתמש בחו"ל השתמש ב-Trae ובקלוד 3.7 המובנה שלו כדי ליצור אוטומטית קוד עבור גלובוס מונפש בתלת-ממד עם רק סקיצה עיצובית והנחיה סופר פשוטה.
חלקם אפילו הרוויחו מכך רווחים אמיתיים. גורו טכנולוגי מעבר לים בשם Pieter Levels פיתח משחק שכולו שימוש בבינה מלאכותית תוך 3 שעות בלבד. תוך 13 ימים מהשקתו, המשחק כבר הרוויח $67,000, שווה ערך לכמעט 500,000 RMB. אפילו אילון מאסק נתן לזה אגודל!
היכולות של מודלים גדולים בקידוד משתפרות במהירות ומתקרבות לביצועים ברמת האדם במספר היבטים:
Sonnet 3.5 יכול להוציא 200 שורות של קוד, בעוד ש-Sonnet 3.7 יכול כעת להפיק 1,000 עד 1,500 שורות, מה שהופך אותו לדגם הראשון המסוגל ליצור באופן אמין קוד המשתרע על אלפי שורות.
בעתיד, הרבה תכנות מייגע וחוזר על עצמו לא ידרשו הקלדה שורה אחר שורה, ותפקידי מתכנת ברמת התחלה רבים יוחלפו. גם תרגול Leetcode יאבד את המשמעות שלו. חבר שנהג לסמוך על סיידר לסיוע בקידוד, מוציא יותר מאלף יואן בשנה, כבר לא צריך את זה ועכשיו משתמש ישירות בדגמים גדולים במקום.

יכולת קריטית נוספת היא קנה המידה של פעולה, המאפשר קריאות מתמשכות לפונקציות ושימוש בכלים, חוזר על סמך משוב סביבתי עד לפתרון בעיה פתוחה. אין לזלזל בפוטנציאל האבולוציוני הזה בעתיד.
כמובן, כמה חברים שואלים: האם בינה מלאכותית יכולה לדון בדרישות עם לקוחות? האם AI יכול להתווכח עם ראשי הממשלה? האם AI יכול לקחת את האשמה?
לאחר שחרורו של קלוד 3.7, אחד קרא שעבודתו עלולה להיות בסיכון. חברת מיקור החוץ שלו כבר פיטרה כמה עובדים בשנה האחרונה בגלל AI וגורמים מורכבים אחרים.
אין להכחיש שבינה מלאכותית עדיין לא שם, אבל מוצרים כמו Devin כבר מפגינים יכולות מסוימות של סוכן AI. היכולת שלהם להבין ולבצע משימות משתפרת במהירות, והעידן שבו כל אחד יכול להיות מנהל מוצר נמצא באופק.




粤公网安备44030002007346号