Hệ Thống Tự Động Thu Thập Tin Tức 24/7
Dòng Tin Vắn AI 24h
Được vận hành bởi Cloudflare Worker Cron Trigger + Cloudflare Workers AI (Llama 3) tự động quét hàng chục nguồn tin công nghệ và tóm tắt ngắn gọn.
OpenAI 15 phút trước • Nguồn: OpenAI Dev Forum
OpenAI công bố bản cập nhật giảm 50% chi phí suy luận cho GPT-4o-mini qua API
💡 TL;DR: Các nhà phát triển có thể gọi API với thông lượng tăng gấp đôi và độ trễ giảm còn 120ms.
Research 1 giờ trước • Nguồn: Hugging Face Daily Papers
Nghiên cứu mới về kiến trúc Linear Attention đạt tốc độ xử lý 1M token trên GPU đơn
💡 TL;DR: Thuật toán nén bộ nhớ mới giúp bỏ qua ma trận O(N^2) truyền thống mà vẫn giữ nguyên độ chính xác 98%.
Anthropic 3 giờ trước • Nguồn: Anthropic Announcements
Anthropic mở rộng chương trình tài trợ nghiên cứu AI Safety trị giá 10 triệu USD
💡 TL;DR: Tập trung vào cơ chế Interpretability (khả năng giải thích mô hình) và kiểm soát các tác nhân AI tự chủ.
OpenSource 5 giờ trước • Nguồn: LocalLLaMA Community
llama.cpp bổ sung backend Vulkan tăng tốc cho card đồ họa Intel Arc và AMD ROCm
💡 TL;DR: Cộng đồng mã nguồn mở giờ đây có thể chạy các model 70B Quantized với tốc độ trên 25 tokens/s.