Làm Cùng Long.

Kho ghi chú mở

Đây là nơi Long ghi lại các ghi chú, framework và checklist từ quá trình làm việc với Marketing, Tracking, Data, Automation và AI ứng dụng. Một số bài có thể còn đang được cập nhật dần. Mục tiêu không phải viết cho thật nhiều, mà là giữ lại những cách nghĩ có thể dùng lại khi gặp vấn đề tương tự.

Automation & AI Workflow · 17 phút đọc

250.000 cuộc hội thoại Claude hé lộ cách con người đang làm việc với AI

Nghiên cứu Stanford trên 249.834 cuộc hội thoại Claude cho thấy người dùng đã giao cho AI nhiều việc có hậu quả thật, nhưng phần lớn vẫn giữ quyền điều hướng. Điều đáng chú ý hơn: ma sát trong quá trình làm việc với AI không phải lúc nào cũng xấu.

Đọc tiếp
Automation & AI Workflow · 11 phút đọc

4 việc solopreneur có thể giao cho AI — và cách chọn việc đáng tự động hóa

AI không chỉ hữu ích để viết content. Với solopreneur, giá trị thực tế hơn có thể nằm ở những việc vận hành lặp lại như sắp xếp thông tin, repurpose nội dung đã có, check-in định kỳ và research. Điểm quan trọng là biết việc nào nên giao, việc nào vẫn cần con người kiểm tra.

Đọc tiếp
Performance Marketing · 14 phút đọc

Benchmark Display & Video Ads 2026: CTR thấp có thực sự là quảng cáo kém?

Bộ benchmark mới của WordStream/LocaliQ cho thấy CTR của Display và Video Ads có thể thấp hơn nhiều so với Search nhưng vẫn hoàn thành đúng vai trò. Bài viết tổng hợp CTR, CPC, CPL, viewability và video completion rate, đồng thời đề xuất cách dùng benchmark để chẩn đoán thay vì biến nó thành KPI cứng.

Đọc tiếp
Automation & AI Workflow · 15 phút đọc

ABBEL: Bộ nhớ niềm tin cho LLM tương tác dài hạn

ABBEL thay toàn bộ lịch sử tương tác bằng một belief state ngôn ngữ tự nhiên được cập nhật đệ quy. Belief grading thưởng cho phần tóm tắt giữ đúng thông tin cần thiết, còn peak belief penalty kiểm soát kích thước bộ nhớ. Đổi lại, mọi lỗi bỏ sót hoặc cập nhật sai có thể lan truyền sang quyết định sau.

Đọc tiếp
Automation & AI Workflow · 13 phút đọc

CUDA sang MLX: K-Search tối ưu Apple Silicon ra sao?

Case study CUDA sang MLX cho thấy không thể chuyển kernel bằng cách dịch cú pháp. Nhóm nghiên cứu xây một lớp tri thức gồm ánh xạ khái niệm, constraint phần cứng, pattern MLX và assertion có thể kiểm thử, rồi để K-Search tìm implementation phù hợp trên Apple Silicon.

Đọc tiếp
Automation & AI Workflow · 13 phút đọc

dLLM-SetScore: Phân loại đa nhãn không cần fine-tune

dLLM-SetScore biến mô hình ngôn ngữ diffusion rời rạc thành bộ phân loại đa nhãn bằng cách hỏi từng nhãn ở cùng một vị trí masked token và so xác suất Yes với No. Phương pháp không fine-tune theo tác vụ, nhưng vẫn cần một tập validation có nhãn để hiệu chỉnh prompt, nhiệt độ và threshold.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

iFuzz-Meta: Khung AI giải thích được bằng luật mờ

iFuzz-Meta kết hợp prototype luật mờ có thể quan sát, meta-learning và regularization dựa trên tri thức. Khung này cho thấy cách đưa giả thuyết chuyên gia vào mô hình như ràng buộc mềm để dữ liệu vẫn có thể điều chỉnh, thay vì lựa chọn cứng giữa lý thuyết và học từ dữ liệu.

Đọc tiếp
Automation & AI Workflow · 13 phút đọc

K-Search là gì? AI tự tối ưu GPU kernel thế nào?

K-Search dùng mô hình ngôn ngữ như một world model đồng tiến hóa để lập kế hoạch, tạo kernel, benchmark trên phần cứng thật và cập nhật cây giả thuyết. Hệ thống tách chiến lược tối ưu cấp cao khỏi việc hiện thực code, nhờ đó không loại bỏ sớm một hướng tốt chỉ vì candidate trung gian chưa hoàn hảo.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

Tích hợp AI Agent vào Marketing: 3 nguyên tắc để bắt đầu đúng

Khảo sát hơn 2.100 chuyên gia cho thấy nhu cầu lớn nhất không còn là học thêm một công cụ AI, mà là đưa AI vào workflow và sử dụng AI Agent trong công việc. Bài viết này phân tích 3 nguyên tắc để bắt đầu: sở hữu playbook, giữ chuyên gia trong vòng kiểm soát và tăng độ tự chủ từng bước.

Đọc tiếp
Automation & AI Workflow · 13 phút đọc

Khi AI làm việc qua đêm: bottleneck mới không còn là tốc độ, mà là khả năng giao việc

Một hệ thống AI Agent có thể nghiên cứu, phân tích, kiểm tra và chuẩn bị đầu ra trong lúc con người nghỉ ngơi. Nhưng khi năng lực thực thi tăng mạnh, nút thắt mới lại nằm ở chỗ khác: giao việc gì, cho AI quyền đến đâu, kiểm tra thế nào và team có hấp thụ nổi lượng đầu ra đó hay không.

Đọc tiếp
AI · 15 phút đọc

Bảo mật LLM: Mô hình đe dọa và checklist phòng thủ

Bảo mật LLM phải bao phủ cả prompt, dữ liệu, RAG, model, tool, output, hạ tầng và con người. Prompt injection chỉ là một lớp rủi ro; thiệt hại thật thường xảy ra khi output không đáng tin được nối với dữ liệu hoặc quyền hành động quá lớn.

Đọc tiếp
AI · 14 phút đọc

Chi phí bộ nhớ LLM: Vì sao KV cache đắt và cách tối ưu

Chi phí bộ nhớ LLM không chỉ đến từ trọng số mô hình. Khi context dài và nhiều người dùng chạy đồng thời, KV cache tăng theo số token, số layer và số request, làm giảm batch size và throughput dù GPU vẫn còn năng lực tính toán.

Đọc tiếp
AI Business & Web · 16 phút đọc

Cloudflare thu phí AI crawler bằng Pay Per Crawl, x402

Cloudflare đưa thanh toán vào request web bằng Pay Per Crawl và HTTP 402. Website có thể cho phép, chặn hoặc tính phí crawler, còn Web Bot Auth và Content Signals giúp xác định ai truy cập, với mục đích gì.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

API Composition là gì? 7 cách tổng hợp API trong hệ thống

API Composition là cách gọi nhiều service rồi ghép kết quả thành response phù hợp với một màn hình hoặc nghiệp vụ. Vị trí tổng hợp quyết định latency, cache, khả năng chịu lỗi và quyền sở hữu kiến trúc.

Đọc tiếp
AI Engineering · 14 phút đọc

Inkling là gì? Mô hình AI mở được thiết kế để tùy chỉnh

Inkling là mô hình open-weight đa phương thức của Thinking Machines Lab, dùng kiến trúc Mixture-of-Experts, context tới 1 triệu token và thinking effort có thể điều chỉnh. Điểm đáng chú ý nhất là định hướng fine-tuning cho nhu cầu riêng.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

Idempotency là gì? Retry an toàn và tránh xử lý trùng lặp

Idempotency giúp một thao tác được gửi lại nhiều lần nhưng hiệu ứng nghiệp vụ chỉ xảy ra như một lần. Đây là nền tảng để retry an toàn trong API, queue và hệ thống phân tán, nơi timeout không cho biết request đầu đã thành công hay chưa.

Đọc tiếp
AI · 14 phút đọc

Knowledge Distillation là gì? Mô hình lớn dạy mô hình nhỏ

Knowledge Distillation huấn luyện một mô hình student học hành vi từ mô hình teacher lớn hơn. Kỹ thuật này có thể giảm chi phí suy luận và độ trễ, nhưng chỉ hiệu quả khi mục tiêu, dữ liệu, đánh giá và quyền sử dụng đầu ra được kiểm soát.

Đọc tiếp
Automation & AI Workflow · 19 phút đọc

MCP vs A2A vs ACP: AI Agent giao tiếp thế nào?

MCP vs A2A vs ACP thường được gọi chung là giao thức cho AI Agent, nhưng chúng giải quyết các lớp khác nhau. MCP nối ứng dụng AI với tool và dữ liệu; A2A giúp các agent độc lập khám phá, giao việc và cộng tác; ACP đã hợp nhất vào A2A và không còn là hướng triển khai riêng.

Đọc tiếp
AI · 13 phút đọc

Mô hình AI mở của NVIDIA được xây dựng như thế nào?

Mô hình AI mở của NVIDIA không chỉ gồm weights. Hệ sinh thái Nemotron kết nối dữ liệu, curation, pretraining, post-training, reinforcement learning, evaluation và deployment. Mức độ mở thực tế phải được kiểm tra theo từng artifact và license.

Đọc tiếp
Marketing & Growth · 17 phút đọc

Quy trình nghiên cứu AI cho Marketer: từ câu hỏi đến insight

AI giúp marketer nghiên cứu khách hàng, đối thủ, thị trường và nội dung nhanh hơn. Giá trị thật chỉ xuất hiện khi quy trình có câu hỏi rõ, nguồn đáng tin, bước kiểm chứng và đầu ra gắn với quyết định.

Đọc tiếp
Automation & AI Workflow · 16 phút đọc

Read path và write path: Tối ưu đọc, ghi trong cơ sở dữ liệu

Read path và write path là hai hành trình khác nhau của dữ liệu trong cơ sở dữ liệu. Tối ưu một phía thường làm phía còn lại tốn thêm chi phí, vì vậy kiến trúc phải bám vào tỷ lệ đọc ghi, độ trễ và yêu cầu nhất quán thực tế.

Đọc tiếp
AI · 13 phút đọc

Roblox World Models: Khi AI tạo hình ảnh gặp game engine

Roblox World Models cho thấy video AI không thể tự thay thế game engine. Hướng kiến trúc hybrid giữ state, luật chơi, physics và multiplayer trong engine, còn world model nâng chất lượng hình ảnh. Bốn nút thắt là latency, consistency, đồng bộ và quyền kiểm soát của creator.

Đọc tiếp
Automation & AI Workflow · 18 phút đọc

Rủi ro AI Agent trong Marketing và cách kiểm soát

AI Agent có thể đọc dữ liệu, dùng công cụ và hành động thay con người. Chính khả năng này tạo ra rủi ro mới cho Drive, CRM, quảng cáo, CMS và dữ liệu khách hàng nếu đội marketing kết nối quá sớm.

Đọc tiếp
AI Engineering · 14 phút đọc

GitHub Vercel Replit: So sánh 3 nền tảng AI Coding

Khi code được AI tạo nhanh và rẻ hơn, giá trị của nền tảng chuyển sang điều phối Agent, chạy code an toàn, kiểm chứng, review và đưa sản phẩm lên production. GitHub, Vercel và Replit chọn ba điểm mạnh khác nhau.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

Spotify dùng AI cá nhân hóa trải nghiệm như thế nào?

Spotify không chỉ dùng AI để gợi ý vài bài hát. Nền tảng kết hợp tín hiệu hành vi, mô hình người dùng, ngữ cảnh và phản hồi trực tiếp để liên tục điều chỉnh trải nghiệm, đồng thời ngày càng cho người nghe nhiều cách sửa cách thuật toán hiểu mình.

Đọc tiếp
Automation & AI Workflow · 7 phút đọc

Thời gian và thứ tự trong hệ thống phân tán

Thời gian và thứ tự trong hệ thống phân tán không thể dựa hoàn toàn vào đồng hồ máy. Clock drift, network delay và concurrency làm timestamp vật lý dễ kể sai câu chuyện. Logical clock giúp mô tả quan hệ nhân quả khi thời gian tuyệt đối không đủ tin cậy.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

Tối ưu Agent Loop: Harness, API và inference

Tối ưu Agent Loop không chỉ là chọn model nhanh hơn. Hiệu quả đến từ cách harness xây context và gọi tool, cách API giữ trạng thái, cùng cách inference tái sử dụng cache, scheduling và phần cứng. Chỉ số cuối phải là chi phí trên tác vụ thành công.

Đọc tiếp
AI Engineering · 14 phút đọc

TPU của Google là gì? Chip AI chuyên dụng hoạt động ra sao

TPU là chip tăng tốc AI do Google thiết kế cho phép nhân ma trận quy mô lớn. Kiến trúc systolic array, bộ nhớ băng thông cao và hệ thống liên kết chip giúp TPU đạt hiệu quả cao khi huấn luyện và phục vụ mô hình.

Đọc tiếp
Automation & AI Workflow · 14 phút đọc

Xây dựng AI Agent production: 12 nguyên tắc thực chiến

Xây dựng AI Agent production đòi hỏi nhiều hơn một prompt tốt. Hệ thống phải có state bền vững, tool contract rõ, eval theo tác vụ, trace đầy đủ, giới hạn quyền, retry an toàn, approval và cơ chế phục hồi khi model hoặc dịch vụ ngoài thất bại.

Đọc tiếp
SEO & AI Search · 11 phút đọc

Google Search bước vào kỷ nguyên AI Mode và AI Agent: SEO cần thay đổi gì trong 2026?

Google Search đang chuyển từ danh sách liên kết sang trải nghiệm AI có khả năng tổng hợp, truy vấn nhiều nhánh và ngày càng gần với mô hình tác nhân. Điều quan trọng với SEO không phải một bộ 'mẹo GEO' mới, mà là nội dung độc đáo, dễ truy xuất, có bằng chứng và tạo giá trị sau click.

Đọc tiếp
Website & Tech Stack · 9 phút đọc

WordPress đang giảm thị phần CMS: dữ liệu 2026 nói gì và doanh nghiệp nên hiểu thế nào?

Dữ liệu W3Techs cho thấy thị phần WordPress trong nhóm website dùng CMS tiếp tục giảm trong 2025–2026, trong khi Shopify và Wix tăng. Nhưng dữ liệu này không đủ để kết luận WordPress 'sắp chết'. Điều đáng quan tâm hơn là tiêu chí chọn nền tảng đang thay đổi.

Đọc tiếp
SEO & AI Search · 8 phút đọc

Matt McGee và thời 'Miền Hoang' của SEO: lịch sử này dạy gì cho kỷ nguyên AI Search?

Matt McGee nhìn lại thời SEO cuối thập niên 1990, khi ngành còn tự học và các công cụ tìm kiếm rất khác hiện nay. Điều đáng giữ lại không phải kỹ thuật cũ, mà là một quy luật: mỗi khi công nghệ tìm kiếm đổi lớp, người làm SEO phải phân biệt tín hiệu ngắn hạn với giá trị bền vững.

Đọc tiếp
Performance Marketing · 8 phút đọc

KOL/KOC có hiệu quả hơn quảng cáo thương hiệu không? Cách chọn theo niềm tin, bối cảnh và mục tiêu

Không có cơ sở để nói KOL/KOC luôn vượt trội hơn quảng cáo thương hiệu. Nghiên cứu cho thấy credibility, perceived similarity và parasocial relationship có thể liên quan tới purchase intention, nhưng tác động thay đổi theo bối cảnh, đối tượng và loại creator.

Đọc tiếp
Automation & AI · 7 phút đọc

Nano Banana 2 vs Nano Banana Pro: chọn model nào cho workflow tạo ảnh trong 2026?

Nano Banana 2 (Gemini 3.1 Flash Image) ưu tiên chất lượng cao ở tốc độ Flash; Nano Banana Pro (Gemini 3 Pro Image) hướng tới composition phức tạp, text rendering và creative control cao hơn. Thay vì hỏi model nào 'mạnh nhất', nên chọn theo latency, fidelity, control, cost và job-to-be-done.

Đọc tiếp
Data & Systems · 9 phút đọc

Local Knowledge System 2026: xây nguồn sự thật cho doanh nghiệp nhiều địa điểm

Local SEO thường được xử lý như một danh sách việc rời rạc: sửa Google Business Profile, tạo location page, thêm schema, xin review. Bài này nhìn ngược lại: trước hết cần một nguồn dữ liệu địa điểm đáng tin, rồi mới phân phối ra website, Maps và các kênh khác.

Đọc tiếp
Performance Marketing · 6 phút đọc

Google mở rộng Limited Ad Serving trên Search: advertiser cần làm gì trong 2026?

Google cập nhật Limited Ad Serving để áp dụng thêm các tình huống trên Search và triển khai dần tới 2028. Đây không phải 'án phạt ẩn' cho 95% advertiser; Google giới hạn impressions trong các kịch bản có rủi ro trải nghiệm xấu và đánh giá mức độ qualified của advertiser bằng nhiều tín hiệu.

Đọc tiếp
Automation & AI · 7 phút đọc

Hàn Quốc có lạc quan về AI hơn không? Đọc dữ liệu thay vì gắn nhãn cả một xã hội

Pew ghi nhận chỉ 16% người Hàn Quốc được khảo sát năm 2025 nói họ 'concerned more than excited' về AI — thấp nhất trong 25 nước khảo sát. Nhưng điều đó không có nghĩa 'người Hàn yêu AI'. Cần nhìn cùng mức độ nhận biết, chiến lược quốc gia, năng lực bằng sáng chế và các lo ngại về điều tiết.

Đọc tiếp
Performance Marketing · 7 phút đọc

TikTok Ads cho doanh nghiệp địa phương 2026: creative, location targeting và measurement

TikTok Ads có location targeting theo quốc gia, vùng, thành phố và một số loại khu vực chi tiết tùy thị trường; Smart+ hỗ trợ tự động hóa cho Sales/Lead/App; Pixel và Events API là lớp đo lường web. Bài này bỏ claim GPS bán kính 1–5 km và Store Visits objective không có trong tài liệu chung.

Đọc tiếp
Website & Systems · 9 phút đọc

USA Today dùng AI-assisted shell files để tăng tốc tin nóng: bài học cho content trong kỷ nguyên AI Search

USA Today Co. đang dùng AI-assisted shell files để chuẩn bị trước cấu trúc bài tin nóng, tận dụng kho nội dung cũ và giúp phóng viên xuất bản nhanh hơn. Điều đáng học không phải là “AI viết báo thay người”, mà là cách thiết kế workflow để máy xử lý phần lặp lại còn con người giữ phần xác minh, cập nhật và phán đoán biên tập.

Đọc tiếp