Một cỗ máy dự đoán tuyên bố đánh bại nhóm siêu dự đoán của con người. Tuyên bố mạnh đến mức đáng mở sâm-panh. Nhưng khi đọc kỹ thông báo rời khỏi giai đoạn thử nghiệm công khai của FutureSearch, tôi không tìm thấy một con số kiểm chứng nào. Không Brier score. Không số lượng câu hỏi. Không chu kỳ đánh giá. Không bên thứ ba độc lập. Thứ duy nhất tôi nhận được là một lời khẳng định suông: hiệu suất vượt trội hơn con người.
Đây không phải suy đoán, mà là hiện trạng của một ngành đang bùng nổ. Năm năm điều hành bot giao dịch, audit hợp đồng thông minh và xây chiến lược on-chain dạy tôi một quy tắc: càng hét to về hiệu suất, càng cần kiểm tra số liệu gốc. Ở đây, tôi không có số liệu gốc. Tôi chỉ có một lời hứa.
Cần đặt FutureSearch vào đúng vị trí. Nó không phải một giao thức blockchain. Không có token, không có smart contract, không có DAO. Nó là một sản phẩm AI ứng dụng, kết hợp mô hình ngôn ngữ lớn, truy xuất thông tin, hiệu chuẩn xác suất và tổng hợp dự đoán. Nói thẳng: nó không tạo ra một mô hình nền tảng mới, nó đóng gói công nghệ sẵn có thành một dịch vụ trả lời câu hỏi xác suất xảy ra là bao nhiêu.
Vậy vì sao một trang tin blockchain lại dành sự chú ý cho thứ không phải blockchain? Ranh giới giữa dự đoán và thị trường dự đoán đang mờ đi từng ngày. Polymarket, Manifold, và hàng loạt protocol prediction market trên Ethereum đã chứng minh rằng đám đông có thể định giá sự kiện tương lai bằng tiền thật. Nếu một AI tốt hơn superforecaster, nó là một nguồn tín hiệu alpha khổng lồ cho bất kỳ ai chơi prediction market. Nó cũng có thể làm tiền đề cho một oracle trên chuỗi, nơi xác suất từ AI được đưa vào hợp đồng thông minh để thanh toán. Đó chính là lý do các trader crypto cần hiểu rõ, thay vì bỏ qua vì nó không có token.
Nhưng khoan đã. Tốt hơn superforecaster là một tuyên bố nặng ký, cần được định lượng. Siêu dự đoán không phải người thường. Họ là nhóm người được huấn luyện để đưa ra xác suất chính xác nhất, từng vượt trội so với chuyên gia tình báo Mỹ trong một nghiên cứu kéo dài nhiều năm. So với họ là một chiến lược PR thông minh, vì nó tạo ra cột mốc đầy uy lực. Càng uy lực, càng cần bằng chứng. Và bằng chứng đang nằm trong một cái hộp đen.
Hãy nhìn vào những gì FutureSearch không nói. Không nhắc đến Brier score, thước đo hiệu chuẩn xác suất phổ biến nhất trong giới nghiên cứu dự đoán. Không đưa ra số lượng câu hỏi đã dự đoán. Không phân biệt rõ đâu là dự đoán tương lai thực sự, đâu là hồi quy trên sự kiện lịch sử. Khe hở này là kẻ giết người thầm lặng. Bởi nếu mô hình được huấn luyện trên các sự kiện đã xảy ra, sau đó dự đoán lại chính các sự kiện đó, kết quả sẽ đẹp mỹ mãn. Tôi gọi đó là ảo giác backtest, một căn bệnh kinh niên của cả AI prediction lẫn quant trading.
Tôi từng trả giá 800 đô la cho bài học về ảo giác này. Năm 2022, tôi viết bot arbitrage cho Uniswap v3, dùng Python và Web3.py. Backtest hai tuần đẹp đến khó tin, lợi nhuận đều đặn, tôi mường tượng ra cảnh mua nhà. Đến khi chạy thật, gas và slippage ăn sạch biên lợi nhuận. Bot lỗ 800 đô la trong mười ngày trước khi tôi kéo phanh. Bài học vẫn còn nguyên giá trị: một mô hình ngược dòng quá khứ chưa bao giờ là một mô hình cho tương lai. Sau lần đó, tôi ra quy định cứng: bất kỳ chiến lược nào, kể cả AI, phải trải qua forward testing ít nhất 30 ngày trên mạng chính với số vốn tối thiểu, trước khi được mở rộng vị thế. Áp dụng vào FutureSearch: nếu không có nhật ký dự đoán công khai được thu thập theo thời gian thực, tôi không thể coi nó là vượt trội.
Trong nghề này, tôi giữ ba câu làm thước đo. FOMO là thuế của kẻ lười phân tích. Phân tích kỹ, giao dịch gọn. Lười phân tích, trả thuế ngay. Cảm xúc là kẻ thù số một. Cả ba đều quy về một quy tắc: không có dữ liệu kiểm chứng, không có vị thế. Một lời tuyên bố không thể soi vào bảng số liệu là thứ để kích thích bán lẻ, không phải để đặt lệnh.
Về kỹ thuật, sản phẩm gần như chắc chắn thuộc nhóm tổ hợp sáng tạo, ghép LLM, truy xuất dữ liệu, hệ thống hiệu chuẩn và tổng hợp từ nhiều nguồn. Mức độ đột phá ở tầng kiến trúc là thấp. Nếu họ thực sự có một mô hình nền tảng mới, bài PR sẽ đầy những thuật ngữ như self-supervised training hay reasoning architecture. Ở đây chỉ có hai chữ: exit beta. Điều đó có nghĩa là họ đã hoàn thiện vòng đời sản phẩm, nhưng chưa chứng minh được chất lượng dự đoán.
Phân tích sâu hơn vào đường lối kinh doanh. Rời beta là bước khởi động thương mại hóa, gần như luôn vậy. Sản phẩm dự đoán AI nhắm đến khách hàng B2B: quỹ đầu tư, phòng chiến lược, doanh nghiệp toàn cầu, tổ chức chính phủ. Nhưng không một hợp đồng khách hàng nào được công bố, không giá niêm yết, không đơn vị dùng thử đứng ra làm chứng. Thay vào đó, họ chọn phát hành qua một trang tin tiền mã hóa. Câu hỏi của tôi rất thẳng: đây là ra mắt sản phẩm hay là khởi động vòng gọi vốn? Khi không có số liệu vận hành, câu chuyện AI siêu dự đoán trở thành gia vị cho bản pitch deck.
Về hạ tầng, nếu FutureSearch dựa trên API của một mô hình nền tảng lớn, chi phí vận hành mỗi lần dự đoán là không nhỏ: truy xuất nhiều nguồn thời gian thực, triệu hồi multi-agent, chạy nhiều lần lấy mẫu xác suất. Nhưng những gì có trên giấy chỉ là phỏng đoán. Điều đáng chú ý cho dân đầu tư: tin này xuất hiện trên Crypto Briefing, kênh của cộng đồng tiền mã hóa. Nếu dự án đang nhắm đến quỹ crypto, khả năng hợp tác với prediction market trong tương lai là rất cao. Một AI dự đoán chính xác, kết hợp với Polymarket, có thể tạo ra câu chuyện AI chống lại thị trường, đẹp cho bảng cap table. Nhưng thiếu dữ liệu tài chính, mọi định giá lúc này chỉ là hào quang.
Cạnh tranh trong mảng này không ít. Metaculus dựa vào trí tuệ tập thể của cộng đồng, Polymarket dựa vào dòng tiền thật, Good Judgment dựa vào con người được đào tạo. FutureSearch tự xếp vào nhóm AI tự động, chi phí thấp, không cảm xúc. Nhưng lợi thế đó chỉ có ý nghĩa khi có bảng xếp hạng dự đoán dài hạn. Một nhà dự đoán không có thành tích, dù là AI hay người, cũng chỉ là một cái máy nói. Điểm yếu lớn nhất của các công cụ loại này là thiếu cơ chế chịu trách nhiệm. Trong DeFi, anh audit smart contract và xác định chính xác lỗ hổng. Trong AI prediction, anh không thể audit một lời hứa.
Giờ đến phần phản trực giác. Giả sử tuyên bố của FutureSearch đúng: họ có một AI vượt qua superforecaster. Nếu tôi sở hữu cỗ máy in ra xác suất chính xác đến vậy, tôi sẽ không bán nó theo dạng thuê bao 99 đô la một tháng. Tôi sẽ đưa nó vào thị trường dự đoán, đặt những vị thế khổng lồ, và để chuỗi thắng lợi tự nói lên tất cả. Việc họ chọn công bố qua Crypto Briefing thay vì công bố bản kiểm toán độc lập nói lên một điều: họ cần sự chú ý của dòng vốn tiền mã hóa, chưa cần sự xác nhận của khoa học. Một bài PR đắt giá không thay được một bảng số liệu dài hạn.
Mảng tối tiếp theo là chọn lọc dữ liệu. Mô hình AI dự đoán có thể chỉ khoe phần đúng, giấu phần sai. Họ có thể nói độ chính xác chín chín phần trăm nhưng quên rằng họ đã gạt đi các câu hỏi không đủ dữ liệu, mơ hồ, hoặc kết quả ngược nhau. Trong một thế giới ngày càng ô nhiễm thông tin, một con số xác suất nghe rất khoa học có thể là thứ nguy hiểm nhất. Nó biến sự bất định thực sự thành một con số giả tạo. Nếu anh là trader dùng AI để vào lệnh, câu hỏi quan trọng nhất không phải AI có giỏi không, mà là AI có nói cho anh biết khi nào nó không giỏi không. Chưa một hệ thống AI prediction thương mại nào trả lời thẳng câu đó.
Vậy, kết luận thực dụng. Đừng vội vào lệnh theo một siêu dự đoán chưa qua vòng kiểm chứng độc lập. Trong 12 đến 24 tháng tới, chúng ta sẽ thấy hàng loạt công cụ AI tự xưng vượt trội: dự báo thị trường, bầu cử, khủng hoảng chuỗi cung ứng. Bộ lọc của tôi gồm đúng ba bước: hỏi xem có nhật ký dự đoán công khai không; kiểm tra xem họ có dám đặt tiền thật vào dự đoán trên Polymarket hay không; và tìm xem họ có công bố cả dự đoán sai hay không. Một mô hình không có thành tích công khai, không chịu đặt cược vào chính mình, không đáng một giây chú ý. Còn nếu anh đang FOMO vì một tiêu đề sáng chói, anh biết rồi đấy: FOMO là thuế của kẻ lười phân tích. Đừng trả thuế.


