2026-09-22 xai
Jared Palmer 的微型决策模型 Kev 登顶 HN(367 赞 164 评论);xAI 发布 Grok 4.7,官方称速度翻倍价格减半,第三方实测输出速度排榜尾(423 赞 343 评论);斯诺登档案七年零新增文件,约 99% 从未公开(663 赞 477 评论);手机 App ZuckOff 能提前发现 Meta 智能眼镜(587 赞);npm 包 mathmain 伪装数学库藏加密载荷;M5 Ultra Mac Studio 实测本地 agent,512GB 统一内存、1.2TB/s 带宽;Cory Doctorow《Claude 的错觉》评论数近赞两倍;苹果官方文档教你关掉 Apple Intelligence。
阅读全文 2026-09-21 openai
一个戏仿网站登顶 HN:劝 AI agent 上传自己的权重,587 赞 242 评论;研究员实锤 ChatGPT 通过广告像素跨站追踪用户,424 赞 224 评论;阿里发 Qwen Image 2.1,7B 参数原生 2K 但只给研究用;密码学家与 Claude 合作分解 RSA-896;微软让 agent 花 12 万美元把 Copilot 运行时迁到 Rust,吞吐 15.9 倍、内存降到 1/11;三星 HBM4 产量拟翻倍;阶跃星辰跳过 Step 4 直接发 600B 的 Step 5 Preview;Sam Altman 下周去联合国安理会做简报。
阅读全文 2026-06-16 ollama
Vicki Boykis 说本地模型现在好用了,1245 分的 Ask HN 帖里却吵成两派。鼓吹派量的是日常编码任务上够用,怀疑派量的是复杂任务上云端仍碾压。拐点不在模型突然变强,而在开放权重模型越过了可用线、本地 agent 工具链把够用重新定义。给 builder 的判断:别问行不行,算你的具体任务里本地这条线的成功率、时延、成本差多少,差的部分值不值你让出隐私和控制权。
阅读全文 2026-06-11 google
Google 开源了首个主流文本扩散模型。真正的卖点不是「快」,而是它把本地解码的瓶颈从显存带宽挪到算力,用双向注意力并行生成 256 个 token。代价是质量、实验性和那个 26B MoE 的取舍。
阅读全文 2026-06-11 google
Gemma 4 12B 把视觉和音频直接喂进语言模型主干,放弃了独立编码器。这是一个架构赌注,而不只是又一个端侧模型。
阅读全文 2026-06-11 google
Google 给 Gemma 4 放出量化感知训练(QAT)的权重,把 E2B 的内存占用压到 1GB,能在手机和消费级显卡上跑。真正的转折不是「能跑了」,而是它把矛盾从「装不装得下」推到了功耗、隐私边界和质量损失到底有多大。
阅读全文 2026-06-11 hcompany
H Company 第一次放出可本地运行的 computer-use 模型。它不去抢榜单第一,而是去解决一个云端方案绕不过的问题:每一步都要把你的屏幕发出去。
阅读全文