Tin tức
Tin tức
Dự đoán mới nhất của CEO Anthropic: 90% lập trình viên có thể mất việc trong năm nay | SLKOR Tin tức
2025-03-13 1418
Tin tức mới nhất: Dario Amodei, CEO của Anthropic, gần đây đã tuyên bố rằng trong vòng 3 đến 6 tháng tới, AI sẽ viết 90% mã và trong vòng 12 tháng, gần như toàn bộ mã có thể được viết bằng AI.

Lý do cho dự đoán táo bạo như vậy là, với việc phát hành gần đây một loạt các sản phẩm AI đột phá, cảm giác khủng hoảng trong giới lập trình viên ngày càng mạnh mẽ. Sự tiến hóa của AI đã dẫn đến nhiều nhiệm vụ trong mã hóa có thể thay thế được.

Đáng chú ý, Claude 3.7, một lần nữa đã đẩy lùi ranh giới của khả năng mã hóa, và Wave 4 của Windsurf là ​​những ví dụ điển hình. Trước đây, mô hình o3 của OpenAI và Cursor, đã trở thành một sản phẩm kinh điển trong số các nhà phát triển độc lập, là các sản phẩm chuẩn khiến một số người phải thốt lên: công việc của các lập trình viên đang gặp rủi ro.

Điều đáng chú ý là trong bảng xếp hạng Đánh giá mã hóa Agentic mới nhất, Sonnet 3.7 đạt điểm 67%, xếp hạng nhất trong số tất cả các mô hình trong đánh giá về trình độ của nhà phát triển mới vào nghề. Vị trí thứ hai và thứ ba, GPT-4.5 và Sonnet 3.5, cũng bám sát phía sau, cả hai đều vượt quá 60%. Điều này chứng tỏ khả năng lập trình đáng gờm của các mô hình này.



Trên thực tế, hai mô hình chính có trọng tâm hơi khác nhau trong lập trình. GPT-4.5 vượt trội trong các tác vụ liên quan đến kiến ​​trúc và tương tác giữa các hệ thống, trong khi Claude 3.7 Sonnet hoạt động tốt hơn trong mã hóa thô và chỉnh sửa mã.

Chỉ nêu điểm số có thể không truyền tải trực quan được khả năng của các mô hình lớn này, vì vậy chúng ta hãy sử dụng một ví dụ thực tế để minh họa.

Trước đây, mô hình o3 đạt điểm Elo là 2727, tương ứng với thứ hạng 175 trong cuộc thi kiểm tra lập trình của con người. Điều này giống như kỳ thi tuyển sinh đại học, nơi không ai biết trước các câu hỏi, vì vậy không có khả năng các mô hình đã luyện tập các câu hỏi trước.

1741837133578.jpg

Cuộc thi này có sự tham gia của tổng cộng 168,076 lập trình viên trên toàn thế giới và xếp hạng 175 đưa o3 vào top 0.1% số người tham gia (1 - 175/168,076 = 99.9%). Nói cách khác, o3 đã vượt trội hơn 99.9% số lập trình viên trên thế giới trong các cuộc thi lập trình và Claude 3.7 Sonnet có khả năng sẽ đạt kết quả tốt hơn nữa.


Không chỉ mã hóa AI đạt được bước tiến đáng kể ở cấp độ mô hình mà còn có những nâng cấp lớn trong phát triển sản phẩm.

Phiên bản Trae ở nước ngoài của ByteDance đã tích hợp các mô hình lớn quốc tế như Claude-3.7-Sonnet và GPT-4o, đồng thời cũng sở hữu các khả năng IDE. Mục tiêu cho phép ngay cả người mới bắt đầu cũng có thể viết mã gần như trong tầm tay, giúp giảm thêm rào cản gia nhập cho các lập trình viên.

Quan trọng nhất, phiên bản Trae ở nước ngoài hoàn toàn miễn phí, cho phép người dùng truy cập tất cả các tính năng của nó mà không mất phí. Ngược lại, Cursor yêu cầu đăng ký trả phí với giá 20 đô la một tháng.

Một người dùng ở nước ngoài đã sử dụng Trae và Claude 3.7 tích hợp sẵn để tự động tạo mã cho quả địa cầu hoạt hình 3D chỉ bằng một bản phác thảo thiết kế và một lời nhắc siêu đơn giản.

Một số thậm chí còn kiếm được lợi nhuận thực sự từ việc này. Một chuyên gia công nghệ ở nước ngoài tên là Pieter Levels đã phát triển một trò chơi hoàn toàn sử dụng AI chỉ trong 3 giờ. Trong vòng 13 ngày kể từ khi ra mắt, trò chơi đã kiếm được 67,000 đô la, tương đương với gần 500,000 RMB. Ngay cả Elon Musk cũng đã giơ ngón tay cái lên!
1741837190054.jpg

Khả năng mã hóa của các mô hình lớn đang được cải thiện nhanh chóng và đạt tới hiệu suất ngang bằng con người ở nhiều khía cạnh:

Sonnet 3.5 có thể xuất ra 200 dòng mã, trong khi Sonnet 3.7 hiện có thể xuất ra 1,000 đến 1,500 dòng, khiến nó trở thành mô hình đầu tiên có khả năng tạo ra mã dài hàng nghìn dòng một cách đáng tin cậy.

Trong tương lai, nhiều chương trình nhàm chán và lặp đi lặp lại sẽ không yêu cầu phải gõ từng dòng một, và nhiều vị trí lập trình viên mới vào nghề sẽ bị thay thế. Việc thực hành Leetcode cũng sẽ mất đi ý nghĩa của nó. Một người bạn từng dựa vào Sider để được hỗ trợ lập trình, chi hơn một nghìn nhân dân tệ mỗi năm, không còn cần đến nó nữa và hiện đang trực tiếp sử dụng các mô hình lớn thay thế.

1741836737653.jpg

Một khả năng quan trọng khác là Hành động mở rộng, cho phép các lệnh gọi hàm liên tục và sử dụng công cụ, lặp lại dựa trên phản hồi của môi trường cho đến khi giải quyết được vấn đề mở. Không nên đánh giá thấp tiềm năng tiến hóa này trong tương lai.

Tất nhiên, một số bạn hỏi: AI có thể thảo luận các yêu cầu với khách hàng không? AI có thể tranh luận với PM không? AI có thể chịu trách nhiệm không?

Sau khi phát hành Claude 3.7, một người đã thốt lên rằng công việc của anh ta có thể gặp rủi ro. Công ty gia công phần mềm của anh ta đã sa thải một số nhân viên trong năm qua do AI và các yếu tố phức tạp khác.

Không thể phủ nhận rằng AI vẫn chưa hoàn thiện, nhưng các sản phẩm như Devin đã chứng minh được một số khả năng nhất định của AI Agent. Khả năng hiểu và thực hiện nhiệm vụ của chúng đang được cải thiện nhanh chóng và kỷ nguyên mà mọi người đều có thể trở thành một nhà quản lý sản phẩm đang ở ngay trước mắt.

whatsapp

Đường dây nóng Dịch vụ

tel: +86 755 83044319

WhatsApp

Whatsapp:+8618073002950