本地与端侧 AI

7 篇 · 最新

端侧 AI 一直在切换「卡点」。Gemma 4 的 QAT 权重把真正的约束从原始质量上挪开;computer-use 智能体被拉回你自己的机器;而「本地模型够不够用」的争论,其实是两拨人在量两件不同的事。有用的问题不是「本地总体追上没有」,而是「对你这个具体负载和指标追上没有」。

2026-09-22 xai

AI 前沿每日 Briefing:2026-09-22

Jared Palmer 的微型决策模型 Kev 登顶 HN(367 赞 164 评论);xAI 发布 Grok 4.7,官方称速度翻倍价格减半,第三方实测输出速度排榜尾(423 赞 343 评论);斯诺登档案七年零新增文件,约 99% 从未公开(663 赞 477 评论);手机 App ZuckOff 能提前发现 Meta 智能眼镜(587 赞);npm 包 mathmain 伪装数学库藏加密载荷;M5 Ultra Mac Studio 实测本地 agent,512GB 统一内存、1.2TB/s 带宽;Cory Doctorow《Claude 的错觉》评论数近赞两倍;苹果官方文档教你关掉 Apple Intelligence。

阅读全文
2026-09-21 openai

AI 前沿每日 Briefing:2026-09-21

一个戏仿网站登顶 HN:劝 AI agent 上传自己的权重,587 赞 242 评论;研究员实锤 ChatGPT 通过广告像素跨站追踪用户,424 赞 224 评论;阿里发 Qwen Image 2.1,7B 参数原生 2K 但只给研究用;密码学家与 Claude 合作分解 RSA-896;微软让 agent 花 12 万美元把 Copilot 运行时迁到 Rust,吞吐 15.9 倍、内存降到 1/11;三星 HBM4 产量拟翻倍;阶跃星辰跳过 Step 4 直接发 600B 的 Step 5 Preview;Sam Altman 下周去联合国安理会做简报。

阅读全文
2026-06-16 ollama

本地模型够用了吗:两派其实在量两件不同的事

Vicki Boykis 说本地模型现在好用了,1245 分的 Ask HN 帖里却吵成两派。鼓吹派量的是日常编码任务上够用,怀疑派量的是复杂任务上云端仍碾压。拐点不在模型突然变强,而在开放权重模型越过了可用线、本地 agent 工具链把够用重新定义。给 builder 的判断:别问行不行,算你的具体任务里本地这条线的成功率、时延、成本差多少,差的部分值不值你让出隐私和控制权。

阅读全文