Chuyển tới nội dung chính

AI Trung Quốc miễn phí 100%: Chiến lược "vũ khí hóa" sự hào phóng?

· 9 phút để đọc
ManhPT
Just another developer!

Khi ChatGPT Plus lên $200/tháng, DeepSeek và Qwen vẫn không có nút trả tiền. Mở kho ứng dụng, bạn thấy ChatGPT với nút Nâng cấp lên Plus ngay màn hình chính. Claude tương tự: $20/tháng cho gói Pro. Google Gemini Advanced: $19.99/tháng.

Còn DeepSeek và Qwen? Không có nút nào hết. Không thuê bao, không tường phí, không gói cao cấp. Mọi tính năng đều miễn phí, kể cả model mới nhất.

Câu hỏi hiển nhiên: tiền đâu mà họ tồn tại? Và quan trọng hơn: đây có phải là một nước cờ địa chính trị được tính toán kỹ lưỡng?

Cảm Giác Dùng DeepSeek V4 Với OpenClaw: Rẻ Đến Mức Thấy… Có Lỗi

· 9 phút để đọc
ManhPT
Just another developer!

Tóm tắt — Tôi đã chuyển OpenClaw sang dùng DeepSeek V4 được vài ngày. Cảm giác đầu tiên: "hình như billing bị lỗi". Kiểm tra kỹ thì hóa ra không — DeepSeek thực sự rẻ đến mức đó. Bài viết này chia sẻ trải nghiệm thực tế, phân tích bảng giá chính thức (cập nhật 29/4/2026), cơ chế disk cache tự động giúp giảm thêm 80-90% chi phí input, và so sánh cụ thể với GPT-5.5 lẫn Claude Opus.

Gemini Hết Thời 'Ngon Bổ Rẻ': Trung Quốc Đang Thắng Cuộc Đua AI Mở Và Cuộc Cạnh Tranh Ngầm Giữa Các Quốc Gia

· 20 phút để đọc
ManhPT
Just another developer!

Tóm tắt — Tháng 4/2026 đánh dấu một bước ngoặt lớn trong làng AI. Google chính thức khai tử gói miễn phí Gemini Pro, siết chặt hạn ngạch Flash, và áp trần chi tiêu bắt buộc — chấm dứt kỷ nguyên "ngon bổ rẻ" từng khiến Gemini trở thành lựa chọn số một cho lập trình viên. Cùng lúc đó, chỉ 23 ngày sau, DeepSeek tung ra V4 với open-weight, giấy phép MIT, benchmark sát Opus 4.7, giá chỉ bằng 1/6. Bài viết này phân tích vì sao đây không chỉ là câu chuyện về giá cả — mà là một cuộc chiến địa chính trị ngầm, nơi mã nguồn mở được dùng như vũ khí chiến lược, và Trung Quốc đang dần chiếm ưu thế.

Agent Skills sẽ biến mất, hay co lại thành một layer ổn định?

· 11 phút để đọc
ManhPT
Just another developer!

Tôi nghĩ Agent Skills đang ở đúng một điểm rất thú vị của lịch sử AI ứng dụng. Chúng vừa giống một cái nạng tạm thời, vừa giống một lớp hạ tầng lâu dài. Tạm thời, vì model ngày càng giỏi hơn và sẽ hấp thụ dần nhiều thứ hôm nay còn phải viết ra ngoài. Lâu dài, vì có một nhóm tri thức vận hành mà tôi không tin nên bị nhét hết vào base model.

vLLM vs Hugging Face TEI cho embedding và rerank: nếu chỉ xét performance thì chọn gì?

· 12 phút để đọc
ManhPT
Just another developer!

Nếu đang dựng một stack RAG hoặc semantic search, câu hỏi thực tế không còn là “có chạy được embedding không”, mà là: nếu embedding và rerank là workload chuyên biệt, cái nào cho profile performance hợp lý hơn để đưa vào production. Hai cái tên thường được đưa lên bàn cân là vLLMHugging Face Text Embeddings Inference (TEI).

Điểm quan trọng là cả hai đều đã hỗ trợ embedding và rerank. Nhưng nếu đọc kỹ docs chính thức, có thể thấy chúng không tối ưu cho cùng một mục tiêu. TEI được định vị theo hướng service chuyên cho embedding/rerank, còn vLLM được định vị theo hướng inference runtime hợp nhất. Chính khác biệt đó là thứ đáng dùng để ra quyết định kiến trúc.

OpenClaw tự host gặp cửa sổ rủi ro từ Axios: lúc này cần kiểm tra forensic ngay

· 9 phút để đọc
ManhPT
Just another developer!

Nếu bạn đang chạy OpenClaw theo kiểu tự host và có bật auto-update hoặc một cơ chế cập nhật định kỳ tương tự, bạn nên kiểm tra máy ngay lập tức.

Bài này không khẳng định official openclaw package đã được công khai xác nhận là độc hại. Điểm cần quan tâm là khác: trong cửa sổ sự cố Axios compromise cuối tháng 3/2026, các hệ thống tự động cập nhật dependency có thể đã kéo phải package độc hại trong chuỗi phụ thuộc. Với một agent stack giữ nhiều secret và integration, đó là tình huống cần điều tra theo hướng forensic chứ không nên nhìn current state rồi kết luận vội.

Vì sao tôi không còn dùng Claude làm backend delegate cho OpenClaw

· 12 phút để đọc
ManhPT
Just another developer!

Claude, Codex và bài học thực chiến khi dùng harness

Đây không phải một bài so benchmark giữa Claude và Codex. Đây là một bài học vận hành. Sau khi bị khóa 2 tài khoản Claude — một Pro và một Max X20 — vì dùng OpenClaw để delegate task cho Claude Code, tôi phải đọc lại chính sách, điều khoản và cách mỗi bên đang productize coding agent của họ. Kết luận rút ra khá rõ: Claude vẫn rất mạnh, nhưng không còn là lựa chọn tôi muốn đặt sau một lớp harness. Nếu muốn làm việc theo kiểu agent runtime, tôi tin OpenClaw + Codex/OpenCode thực dụng hơn ở thời điểm hiện tại.

4 tín hiệu cho thấy cuộc chơi AI đang đổi chiều

· 9 phút để đọc
ManhPT
Just another developer!

Tín hiệu chiến lược từ bản tin AI buổi sáng

Nhìn bề ngoài, Claude Code, Model Spec, OpenAI-style API, S3 tooling, tranh luận về coding agent hay các repo mới nổi trên GitHub có vẻ là những mẩu tin rời rạc. Nhưng nếu nhìn ở góc chiến lược sản phẩm, chúng đang ghép thành một bức tranh rõ ràng hơn nhiều.

Khi Agent Không Tuân Thủ SOUL.md: Sự Thất Vọng Thực Tế Với OpenClaw

· 10 phút để đọc
ManhPT
Just another developer!

Tôi đã xây dựng SOUL.md — một file định nghĩa "tâm hồn" của AI agent — với hy vọng nó sẽ là bộ quy tắc bất biến. Nhưng thực tế vận hành hệ thống OpenClaw + Claude Code mỗi ngày đã cho thấy một sự thật khác: agents đọc SOUL.md, nhưng không phải lúc nào cũng tuân theo nó.

Bài viết này là ghi chép thực tế — không phải lý thuyết — về những lần tôi thất vọng nhất với hệ thống AI agent cá nhân của mình.

Agentic Retrieval-Augmented Generation: A Survey on Agentic RAG

· 5 phút để đọc
ManhPT
Just another developer!

Agentic Retrieval-Augmented Generation: A Survey on Agentic RAG là một paper survey khá đầy đủ cho ai đang chuyển từ RAG tuyến tính sang các hệ RAG có tính tự chủ cao hơn (agentic). Bài này không giới thiệu một mô hình mới, mà hệ thống hóa lại bức tranh tổng quan: kiến trúc, workflow pattern, framework triển khai, benchmark và những thách thức còn mở.