Shreya Shankar@sh_reyaAI score3636用决策模型(如 Jev)逐行调用 API 处理数千行数据效率极低,无法利用查询规划。在单张 H100 上,Qwen3-4B 对 5k 条电影评论做一次 AI 过滤的理论最快速度约为 6.6 秒,目前包括开源 AI-SQL 引擎 Quail 在内的任何系统都远未接近。新博客文章介绍了 Quail 如何基于这一速度上限估算 AI 过滤器的成本。Awaiting translationPractice#Problems/pitfalls#Costs/usage limits#Local models
Sebastian Raschka@rasbtAI score3636Sebastian Raschka 用 Paint UI 复刻同一张图,对比 GPT-5.6 Astra 与 Qwen3.8 Max 的计算机使用(视觉)能力:Astra 默认用几何图形分层绘制,Qwen 则逐像素还原,后者结果天然更接近原图、得分会更高。但他认为不能据此断定 Qwen 的计算机使用或视觉理解更强,这恰恰说明只看最终结果的 benchmark 有多不可靠。Awaiting translationOpinion#Trends#Reviews/benchmarks#Code review