- Đã dùng Claude và ChatGPT khoảng 2 năm, nhưng khi kết nối opencode với endpoint suy luận riêng, tác giả cảm thấy một sự giải phóng lớn hơn mong đợi
- Dữ liệu chỉ đi lại giữa laptop và endpoint do chính mình sở hữu, nên cảm giác kiểm soát và sở hữu tăng lên
- Thay vì nâng cấp gói Claude·ChatGPT cá nhân, tác giả quyết định dùng Kimi K3 mà Modal phát hành dưới dạng endpoint được quản lý cho các dự án phụ
- Chỉ trong khoảng 5 phút, tác giả đã cấu hình và chạy opencode để dùng endpoint Modal của mình
- Trải nghiệm gọn gàng như khi mở vim thay vì một trình biên tập hào nhoáng và cồng kềnh, đồng thời mang lại cảm giác tự do như vừa thoát khỏi các kết nối bị trói buộc vào nhà cung cấp khác
Lý do chọn endpoint riêng
- Không có gói Claude hoặc ChatGPT phù hợp với tài khoản cá nhân, nên thay vì nâng cấp gói cho dự án phụ, tác giả tìm một lựa chọn khác
- Modal, nơi tác giả đang làm việc, đã ra mắt Kimi K3 trên endpoint được quản lý, và vì nghe nói hiệu năng khá tốt nên tác giả quyết định tự dùng thử
- Tác giả không trực tiếp tham gia phát triển tính năng này nên trước đó chưa từng sử dụng
Trải nghiệm thay đổi khi kết nối opencode
- Chỉ trong khoảng 5 phút, tác giả đã kết nối opencode với endpoint Modal của mình và chạy được
- Cấu trúc dữ liệu chỉ di chuyển giữa laptop và endpoint do chính mình sở hữu làm tăng cảm giác kiểm soát và sở hữu
- Màn hình khởi đầu trống và đơn giản của opencode giống với trải nghiệm mở vim sau khi đã dùng trình biên tập lớn trong thời gian dài
- Cảm giác tự do như thể đã cắt đứt những kết nối bị ràng buộc với nhà cung cấp khác là một thay đổi ngoài mong đợi
1 bình luận
Ý kiến trên Hacker News
Lý do Claude Code được ưa chuộng là vì chỉ với những yêu cầu mơ hồ như “hãy làm cho tôi một SaaS trị giá một triệu đô”, nó cũng có thể tạo ra cùng lúc hàng nghìn dòng mã, nhiều xử lý ngoại lệ bề mặt và các tính năng
Các mô hình nhỏ và mở yếu ở những việc như vậy, nhưng phát triển thực tế không phải là yêu cầu cả ứng dụng một lần rồi xong. Nếu lặp lại việc cải thiện các hàm nhỏ, cụ thể như phát triển truyền thống, GLM cũng làm tốt ngang Claude, hoặc hơn; nếu cung cấp ngữ cảnh rõ ràng như khi debug kiểu rubber duck thì phần lớn kết quả rất gọn gàng
Với các phương pháp đã biết, chúng cũng có thể triển khai trong khoảng 1/100 thời gian so với làm thủ công, giúp nhanh chóng khám phá ý tưởng; đôi khi còn viết từ đầu các triển khai gần như không phụ thuộc thư viện bên thứ ba ngoài NumPy hay SciPy, cải thiện độ rõ ràng và hiệu năng
Ở giai đoạn lập kế hoạch, tôi đã chỉ định chi tiết trong vài ngày các dịch vụ và tính năng sẽ dùng, nhưng vẫn có những tính năng không được nêu rõ trong yêu cầu bị bỏ sót, chẳng hạn khi triển khai X thì quên chức năng sửa/xóa. Dù tôi đã có proof of concept cho chức năng cốt lõi, vẫn chưa có giao diện dễ dùng; nhờ Claude, trong hoàn cảnh thiếu thời gian, tôi có thể nhanh chóng tạo một ứng dụng tùy chỉnh. Nếu làm một mình, có lẽ phải mất hơn một năm mà kết quả còn kém trau chuốt hơn
Hiệu năng của DeepSeek V4 Flash tốt hơn kỳ vọng khá nhiều. Tôi chủ yếu dùng Claude Code dựa trên Claude 5 Opus và Codex dựa trên GPT-5.6 Sol, nhưng DS V4 Flash không cho cảm giác kém nhiều, và khi dùng cùng oh-my-pi hoặc pi mặc định thì khá tuyệt
Các mô hình tuyến đầu mạnh hơn nhiều ở gọi công cụ nên có lợi cho luồng trợ lý, nhưng khi tối ưu môi trường thực thi bằng cách viết lại công cụ theo cách mô hình suy luận, DS V4 Flash cũng hoạt động đủ tốt. Các mô hình nhỏ có độ trễ token đầu tiên và số token mỗi giây tốt hơn nhiều nên cạnh tranh được trong nhiều tác vụ, cảm giác tương tự Sonnet cuối năm ngoái, vì vậy khá xuất sắc
Nó có thể chụp hồ sơ khám bệnh để thêm vào lịch, gắn thẻ và OCR PDF để lưu trữ, cũng như tìm kiếm Internet và tra cứu dữ liệu Google Maps. Có thể tích hợp với Home Assistant và các hệ thống mã nguồn mở tương tự Alexa để trò chuyện với agent bằng giọng nói
Về cơ bản đây là quảng cáo khéo léo, nhưng đúng là cấu hình tôi đang tò mò nên nội dung cũng ổn. Tuy vậy, cần có chỉ số chi phí để đánh giá phải chịu thêm bao nhiêu chi phí nhằm không gửi thẳng cuộc trò chuyện cho NSA
Claude và OpenAI được biết là được trợ cấp đáng kể, nên tôi tò mò chi phí dùng Kimi K3 trên endpoint riêng sẽ đắt hơn hay rẻ hơn
Bài này là quảng cáo sản phẩm của chính mình. Dù tác giả hoạt động lâu năm và viết thẳng thắn, bài kiểu “tôi đã dùng sản phẩm của mình và thấy rất tốt” thì không khác tự quảng bá
Tôi không muốn nâng gói Claude, và nếu không thấy thú vị thì cũng đã không viết bài. Điều cốt lõi khiến tôi viết không phải là “Modal tuyệt”, mà là cảm giác được mô tả trong bài. Tôi còn cân nhắc xóa liên kết vì lo trông giống quảng cáo; việc công ty tôi đang làm có thứ hay ho chỉ là lợi thế phụ
GLM 5.2 cho cảm giác tốt hơn Opus, còn K3 tốt ngang Fable. Tôi hy vọng K3 được chưng cất xuống quy mô Qwen 3.6 27b hoặc Poolside S 2.1 để có một lựa chọn thay thế Composer 2.5 chạy cục bộ, nhanh
Khi chuyển từ mô hình tuyến đầu cỡ lớn sang một mô hình linh hoạt như Composer, đôi lúc cảm giác giống như mở vim thay vì một trình soạn thảo hào nhoáng và nặng nề
Với mô hình nhanh, vòng lặp suy nghĩ và hỏi đáp trơn tru hơn, giống luồng di chuyển nhanh giữa các tệp bằng vim
Tôi thích giao diện có vẻ trống trải của OpenCode. Nó gọn, nhẹ và mang tính thụ động, tạo cảm giác tốc độ khác với các công cụ Internet ngày nay tuy hào nhoáng nhưng chậm
Bài này trông như quảng cáo cho Modal. Nếu chỉ là thuê phần cứng, tôi cũng nghi ngờ liệu có thật sự gọi đó là hạ tầng của mình được không
Bất kể có phải của Trung Quốc hay không, điều cần lo là việc dùng mô hình được host và không biết bí mật kinh doanh của mình được gửi đi đâu
Tôi cũng đã thử mô hình cục bộ nhưng trên MPB M5 16GB bản cơ bản thì chậm, và trước mắt cũng không có kế hoạch nâng cấp laptop