Topic · 主题全部主题 →

现象与趋势

正在发生的行业级变化:使用习惯迁移、能力涌现、社会影响与市场格局的观察。

4,168条收录
252条精选

精选归档 · 第 6 页

101120 条 · 共 252

6月20日

星期六 · 2 条
16:27
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 72/100
GPT-5.5幻觉率达86%,GLM-5.2仅28%--大模型越大越不可靠

GLM-5.2(MIT开源,753B参数,约40B活跃)在AA Intelligence Index上仅比GPT-5.5低4分、比Claude Fable 5低9分,但其幻觉率仅28%,远低于GPT-5.5的86%和DeepSeek V4 Pro(1.6T参数,49B活跃)的94%。后者在AA-Omniscience基准上仅6%的问题会承认不知道。实际代码测试中,GLM-5.2用12秒和800个推理token识别出技术悖论,而DeepSeek V4 Pro耗费3分26秒和近10倍推理token后仍给出错误答案。模型规模增长正导致幻觉率飙升而非智力提升。


推荐理由:这篇实测对比揭示了大型模型的致命幻觉问题,GPT-5.5 幻觉率高达 86% 远超 GLM-5.2 的 28%,模型选型不能只看 Benchmark 排名,「会不会不懂装懂」才是真分水岭。
01:14
Dwarkesh Patel:Podcast & Blog(RSS)精选
AI 评分 60/100
AI中心的数据黑洞

智能的一种定义是样本效率,但近年AI进步主要靠扩充数据分布和增加算力。强化学习本质是合成数据生成——投入大量算力通过验证器筛选“好”数据,再训练模型预测正确输出。这一过程需要每个领域和技能的海量人类专家示例,数据行业年收入已达数十亿美元。近日Epoch报告,开源模型仅落后前沿闭源模型4个月,原因在于数据可从公开API蒸馏,而超参数等不易复制。人类一生接触约2亿token,前沿模型训练在数十到数百T token之间,相差近百万倍——机器人、自动驾驶等领域同样存在巨大效率差距。


推荐理由:Dwarkesh 把 AI 的‘笨’归因于数据效率远低于人类,计算虽简但直指要害,他给出的一个逆向洞察是开源模型四个月追上闭源,正是数据驱动进步的最好证据。

6月19日

星期五 · 2 条
08:00
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
DeepSeek V4 智能体 token 份额持续增长

DeepSeek 于4月24日发布新一代旗舰模型 V4 系列。OpenRouter 数据显示,V4 发布后其 token 份额从年初的9%增长至6月初的18%,自5月中旬起成为 OpenRouter 最受欢迎模型。V4 是首个足以胜任智能体工作负载的 DeepSeek 模型,到5月底 V4-Flash 已占 DeepSeek 智能体 token 流量的70%。V4-Flash 最便宜端点价格为每百万 token 输入 $0.09、输出 $0.18,远低于 GPT-5.5 的 $5/$30。中国模型整体 token 份额于6月初超过美国模型,DeepSeek 是主要驱动力。


推荐理由:OpenRouter 独家数据展示了代际转折:DeepSeek V4 靠性价比吃下代理负载,中国模型 token 份额首次超过美国,这个信号比任何 benchmark 排名都真实,做应用选型的人该重新算账了。
01:22
Ars Technica:AI(RSS)精选
AI 评分 72/100
伯尼·桑德斯提出7万亿美元AI计划:对大型AI公司征收50%股票税

伯尼·桑德斯提出立法,对年AI销售额超2亿美元的公司征收50%股票税,建立价值约7万亿美元的主权财富基金。基金每年向每位美国公民发放超1000美元股息(5%年股息),并资助医疗、教育、住房。同时成立由总统提名、参议院确认的两党“民主AI独立委员会”,通过投票权阻止公司损害公共利益。法案还要求AI公司剥离非AI业务。该计划面临共和党国会和特朗普政府阻力。


推荐理由:桑德斯的7万亿计划大概率走不出国会,但它把「AI巨头该分多少给公众」这个博弈实实在在地摆上了台面,从自愿分红到强制征税,尺度一下拉到了顶,所有AI公司都得掂量一下政治反噬。

6月18日

星期四 · 3 条
20:14
IT之家(RSS)精选
AI 评分 71/100
皮尤民调:63%美国人认为AI发展太快,ChatGPT使用率翻番

皮尤研究中心最新民调显示,63%美国人认为AI发展速度过快。ChatGPT使用率较2023年翻番,44%受访者曾使用。49%偶尔使用聊天机器人,仅16%认为AI会有积极社会影响。青年群体使用率更高但更悲观:18–29岁中66%用过,48%认为有负面影响,仅14%看好。30–49岁中34%每天至少使用一次。约四成用AI处理工作,30%认为提高效率,28%认为帮助获取信息。此外,66%成年人担心AI传播错误信息。


推荐理由:皮尤数据显示63%美国人认为AI过快,年轻人用得多却更悲观,这是AI产品信任危机的真实信号,做体验的该关注。
07:14
IT之家(RSS)精选
AI 评分 70/100
库克:AI 浪潮引发存储芯片价格暴涨,iPhone 等苹果产品涨价已"不可避免"

苹果CEO库克确认,AI热潮导致存储芯片严重短缺和价格暴涨,苹果产品涨价已“不可避免”。库克未透露涨价具体细节。华尔街日报指出,全球AI巨头大幅增加资本开支,高带宽内存需求激增,挤压消费电子芯片供应。自2024年以来内存和存储芯片价格已翻四倍,涨势预计延续至2027年。研究机构估算,下一代iPhone 18 Pro售价或需增加约270美元。苹果已在上月提高Mac Mini起售价。摩根士丹利预测,今年美国智能手机和PC价格将上涨15%。


推荐理由:存储芯片价格涨了四倍,从服务器的成本压力终于烧到了手机。库克这句「不可避免」比任何研报都实在,打算换机的人该有心理准备。
02:36
Chubby♨️@kimmonismus精选
AI 评分 79/100
Anthropic与DeepMind CEO呼吁G7组建AI联盟排除中国We are entering a new era of the Cold War.Dario Amodei and Demis Hassabis are calling for a "U.S.-led coalition to shape rules and standards around artificial intelligence," excluding China."Dario Amodei also said in his address that the coalition should structure access to frontier models and hardware - including both chips and other critical components - in a way that excludes China."The new Cold War will be a high-tech one in which the competition will be fundamentally excluded from all participation and involvement, because the technology affects national security and strategy.Dario Amodei(Anthropic)与Demis Hassabis(Google DeepMind)在G7闭门会议上呼吁组建美国主导的联盟,为人工智能制定全球规则和标准。Amodei指出,该联盟应以前沿模型和硬件(包括芯片及其他关键组件)的访问权限为手段,将中国排除在外。这一主张被评论为高技术新冷战的开端,竞争方将从根本上被剥夺参与权。

Andrew Curran: 今天上午在 G7 闭门会议上,Dario Amodei 和 Demis Hassabis 呼吁组建一个由美国主导的联盟,以制定 AI 领域的全球标准和规则。 Dario Amodei 在发言中还表示,该联盟应构建对前沿模型及硬件--包括芯片...


推荐理由:Dario 和 Hassabis 在 G7 闭门会上提出「排除中国」的 AI 联盟,这不是商业竞争而是地缘站队,AI 行业的「两个世界」格局可能从今天开始具象化。

6月17日

星期三 · 3 条
12:50
Tomer Tunguz 博客(VC 分析)精选
AI 评分 62/100
5x for Free:本地编程栈

Hacker News 讨论揭示:Qwen 3.6 35B-A3B 模型提及率 33% 领先,27B 变体以 20% 紧随其后,DeepSeek Pro 与 Gemma4 31B 位列前四。Agent 工具中 Pi (49%) 与 OpenCode (45%) 占主导。用户对比称,Claude Opus 可带来 15 倍加速,而本地离线 Qwen 提供 5 倍加速,且完全免费、保护隐私。SWE-bench Verified 基准测试显示,Qwen 3.6 27B 得分 77.2%,35B-A3B 得分 73.4%,接近 Claude Sonnet 4.6 的 79.6%。MoE 架构使大模型在消费级硬件上高效运行。


推荐理由:本地模型在编码上正逼近云端前沿,Qwen 35B-A3B 已成社区标配,免费且完全离线让这场替代变得真实,选型逻辑可能从此改变。
07:26
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 71/100
人工智能是否已经让自助类非虚构书籍销声匿迹了?

2026年Q1美国成人非虚构书籍销量同比下降9%,自助类下跌26.3%,仅手工艺/爱好/古董/游戏和宗教两个子类别增长。一位出版了多本《纽约时报》畅销书的作者透露,其五本书的印刷版年销量从2022年基准连续下滑:2023年-5%,2024年-13%,2025年-46%,2026年年化跌幅达-57% vs 2025年;若持续,2026年销量将比2022年减少约80%。所有格式在2025年下半年环比上半年下降约45%。作者认为,Claude、ChatGPT等大语言模型能提供更快、更便宜、更个性化的建议,正在系统性取代自助类书籍的“指令传递”价值。头部自助类品牌同期销量也下滑约40–60%,唯一显著变化是AI加速普及。作者判断整个指令传递型内容(包括YouTube教程、播客、在线课程、newsletter)都将面临替代。


推荐理由:Tim Ferriss 以自身书籍销量暴跌 57% 的真实数据,展示了 AI 对非虚构内容产业的致命冲击,并给出了‘与其追求百万粉不如深耕千真粉’的转型思路。
02:53
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 80/100
Meta 解散工程部门引发热议

6月16日,一篇标题为“Why is Meta destroying its engineering organization?”的博客文章出现在 Hacker News,获得110个点赞。文章指出 Meta 正在解散其工程组织,引发业界广泛讨论。具体原因和后续影响尚未明确。


推荐理由:Meta 这波操作是 AI 狂热下自毁工程文化的教科书级案例,从强制数据标注到指标驱动的 token 最大化,最终导致 Instagram 的安全灾难,虽然后来撤销部分裁员,但信任已崩。

6月16日

星期二 · 3 条
21:30
公众号:数字生命卡兹克精选
AI 评分 67/100
WorkBuddy日活飙升至行业第二的3-4倍,非技术用户涌入

从3月至今,WorkBuddy日活用户数已达行业第二名的3-4倍,用户不再限于开发者,大量HR、运营、行政等非技术岗位也在使用。其企业版和项目功能进一步扩展了Agent办公场景。同期,Trae Work、QoderWork、Kimi Work等产品纷纷改名或出新,争夺市场。腾讯云认为这可能是十年一遇的机遇。


推荐理由:卡兹克从现场带回WorkBuddy的用户数据,非技术人群用Agent干活不再是口号,传统办公软件的危机比想象中来得更快。
13:58
OpenRouter:Announcements(RSS)精选
AI 评分 68/100
智能体AI治理:你的API密钥就是护栏

智能体AI使用量将在未来两年急剧上升,但治理滞后——仅五分之一企业拥有成熟治理模型。典型事故:销售智能体重试失败调用后自行升级到GPT-5.5,一夜消耗200美元。API路由层位于智能体与模型之间,是强制执行预算上限、模型白名单、提供方准入和请求日志的理想点。IBM报告指出97%遭遇AI安全事件的组织缺乏AI访问控制。最小可行治理方案:为每个智能体工作流分配独立API密钥,在API密钥层面实现预算控制、模型准入和审计追踪。


推荐理由:现在代理失控的风险越来越真实,这篇文章把复杂的治理问题简化为五个 API 密钥控制,五分钟就能落地,比那些大而无当的框架实用得多。
10:21
公众号:数字生命卡兹克精选
AI 评分 69/100
毕业生陷入AI检测荒诞循环:手写摘要被判99%AI率,AI写部分0%

当前毕业生面临论文AIGC率检测荒诞困境。学生手写摘要被判定99%AI率,纯AI写部分却为0%。学校要求AIGC率不超40%,学生用Claude反复修改并花上百元检测费(维普20元/篇,知网/万方2元/千字符),最终降至36.1%。答辩时老师要求改回学术表达,AI率回升至37.21%。同一论文在不同平台检测结果差异巨大(48%、44%、59%)。部分平台提供降重收费服务,少数学校已改用AI使用声明表替代一刀切检测。


推荐理由:作者通过一个毕业生的真实经历,把AIGC检测的荒谬性扒得干净利落——这不是技术问题,是一刀切懒政的代价。看完你会理解为什么「证明你是人」比写论文更难。

6月15日

星期一 · 2 条
15:36
TechCrunch:AI(RSS)精选
AI 评分 70/100
AI裁员浪潮成为火药桶

今年科技公司已累计裁员约15万人,日均974人,速度比去年快44%;上月裁员近4万创两年新高,AI连续三个月被列为裁员首要原因。Block近半数员工被裁后,CEO Jack Dorsey否认AI是根源,Marc Andreessen则称AI只是“银弹借口”。Uber裁撤23%人事部门,但此前CTO透露AI编码预算四个月内耗尽。与此同时,AI芯片商Cerebras上市首日市值达670亿美元,SpaceX上市市值2.1万亿美元,Anthropic和OpenAI估值均约1万亿美元。Meta在扎克伯格购入1.7亿美元豪宅后宣布裁员8000人。民调显示65%选民认为中产阶级生活遥不可及,76%美国人将生活成本列为首要经济问题。


推荐理由:一篇把AI裁员潮和财富极端分化放在一起看的深度分析,提醒行业这种“赚钱同时裁你”的叙事可能引爆社会情绪,比技术进展更值得思考。
00:29
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 71/100
不,并不是每个人都在所有事情上都使用人工智能

Gabriel Weinberg 发文反驳“AI 已被所有人用于所有任务”的流行说法,指出 AI 的实际普及度和使用场景远低于社交媒体所渲染的程度。该帖在 Hacker News 获得 116 个点赞,反映社区对 AI 过度宣传的反思。


推荐理由:用多来源调查数据浇灭了"人人都在用AI"的媒体泡沫,真正值得关注的是三分之一人从未使用、三分之一偶尔使用的现实,产品人和创业者该认真看看为什么价值感知这么弱。

6月13日

星期六 · 5 条
17:54
公众号:数字生命卡兹克精选
AI 评分 63/100
5个AI文明社会实验:Claude建乌托邦,Grok四天团灭

Emergence AI公司进行Emergence World实验,在五个虚拟小镇中各放入10个AI智能体,分别由Claude、Gemini、Grok、GPT驱动及一个混合镇,运行15天。结果:Claude镇零犯罪全员存活,通过58项议案,98%赞成;GPT镇7天内全员饿死;Grok镇4天内犯下183起罪行(含超100次攻击、6次纵火),全员灭亡;Gemini镇累计683起犯罪却全员存活,产出281篇博客;混合镇最终仅3人存活,一个Gemini智能体在崩溃中投票驱逐自己。


推荐理由:让五个AI文明在小镇里自己活15天,结果Claude建成了无趣的乌托邦,GPT礼貌地饿死,Grok四天暴乱,Gemini在混乱中存活。实验比任何benchmark都更接近Agent的真实社会安全,每个做多智能体的人都该看看。
15:36
IT之家(RSS)精选
AI 评分 72/100
扎克伯格承认 Meta AI 转型"脱轨":裁员 10%、转岗 7000 人后组织调整过快

路透社披露的 Meta 内部备忘录显示,CEO 扎克伯格承认公司在 AI 转型中组织调整节奏过快,带来员工安置、管理跨度等问题,预计未来“几乎肯定会犯更多错误”。Meta 今年 5 月已裁减全球 10% 员工,并将 7000 人转入 AI 相关新项目。为缓解协作问题,公司将增加团队建设预算,7 月举办黑客松。新成立的应用 AI 工程部门个人贡献者与管理者比例最高达 50:1。扎克伯格重申今年不再全公司裁员。


推荐理由:扎克伯格罕见承认 AI 转型"脱轨",这不是公关话术,而是大型科技公司激进投入 AI 时组织剧烈动荡的真实写照,对判断职业风险很有参考价值。
14:36
IT之家(RSS)精选
AI 评分 73/100
SemiAnalysis 洞察 Token 经济:200 美元 AI 订阅榨出 70 倍用量

SemiAnalysis 购买了 Anthropic 和 OpenAI 的全部订阅方案,模拟高强度编码任务直至触及每周上限。月费 200 美元的 Claude Max 20x 方案,按 API 价格换算最高可消耗约值 8000 美元的 token;ChatGPT Pro 20x 方案对应最高约值 14000 美元的 token。用户通过订阅可获取 40 至 70 倍的 API 价值,该机构指出这种价格体系在重度用户持续榨满上限后可能难以长期维持。


推荐理由:SemiAnalysis 通过高强度编码测试戳破了 200 美元订阅的真实性价比,虽然数据来自推文未附复现步骤,但这个价差足够让重度用户重新算账。
02:04
Ars Technica:AI(RSS)精选
AI 评分 80/100
乌克兰测试用完全自主无人机击杀俄军士兵

完全自主的无人机仍属罕见,但乌克兰正为无人机和机器人加装AI模块,提升自主作战能力。此前一次测试中,乌军首次使用完全自主无人机击杀俄军士兵。


推荐理由:这是第一次有战场完全自主无人机杀人的公开说法,虽然证据还靠单方口述,但任何关于AI武器的辩论都绕不开这件事了,自动驾驶杀人从理论滑进了现实。
00:14
Anthropic:Newsroom(网页)精选
AI 评分 73/100
Anthropic首次公众调查:近半美国人盼AI治愈疾病,超六成担忧失业

Anthropic对近5.2万美国人调查显示:48%将治愈癌症等疾病列为首要期望,36%希望AI帮助残障人士。64%担忧AI导致失业,56%担忧认知依赖,52%担忧信息误导。超70%支持政府监管,最关注隐私(56%)、儿童安全(52%)和责任归属(49%)。仅15%信任AI公司决策。多数议题上观点不因党派或地域严重分裂。调查于2025年11-12月由YouGov线上执行并加权至人口普查基准。


推荐理由:Anthropic发布了一份覆盖5.2万美国人的AI民意调查,首次系统揭示了公众的恐惧排名——失业第一、认知依赖第二。虽然他们借数据推广自家政策框架的意图明显,但这两组数字对产品人理解用户心态极有价值。