I got y'all some outputs from "claude-melon-eap" and "claude-marshmallow-eap" 😉 They're really pushing 3D RL a lot, huh...
I got y'all some outputs from "claude-melon-eap" and "claude-marshmallow-eap" 😉 They're really pushing 3D RL a lot, huh...
Anthropic 发布覆盖 Plan 至 Maintain 六阶段的 AI 原生 SDLC 手册,以版本化工件串联各环节,并区分建议性与强制性控制。DeepSeek 上线实验模型 deepseek-v4-flash-vision-exp API,支持图文混合输入,单张图片最多占 384 tokens,价格与 V4-Flash 相同,Files API 免费开放。
CounterPoint Research 预估 2026~2032 年全球消费级可穿戴设备累计营收将超 1 万亿美元,年复合增长率 12%。智能眼镜到 2032 年营收预计达 440 亿美元,约占可穿戴设备营收的 1/5。智能吊坠、智能戒指和智能眼镜将成为增长最快品类,其中智能吊坠增长起点较低。
ZHO 借《红楼梦》七十七回指出,实用主义系统中“美”因不够有用而最先被裁掉,晴雯的锋芒、优伶的艺术、大观园的诗意皆无生存价值。其引用推文进一步预言,自 2026 年起 AI 将带领人类进入文化上的“大垃圾时代”,生产力提升与物质丰富伴随而来的是大量垃圾的产生及处理问题。
看到大量垃圾质量的 AI 图/文/视频/应用 逐渐铺满整个物理世界和网络世界,我意识到 对不起,我之前说的还是太保守了,因该是: 自 2026 开始,AI 的发展会带领人们进入一种文化上的 “大垃圾时代” 伴随 生产力提升/物质丰富 先来的...
自己和 AI 共生时间越长,我越发喜欢: 人类笨拙的真诚、物体无所谓的存在、自然肆意的变幻 多视角的存在让大脑不再被单一形式所束缚,回到作为一个人的纯粹体验
苹果被曝将推出带摄像头的 AirPods,但据 macOS 26.7 RC 泄露视频与代码,其摄像头仅作 Siri 的“眼睛”,无法拍照或录像,用于识别书籍、食材等环境信息。设备将配备 LED 指示灯,在共享视觉数据时亮起以示透明。该功能旨在推动用户减少掏出 iPhone,更自然地与升级版 Siri AI 交互。
Meet Spider-Girl! 🎬 Made with MiniMax H3 on PixVerse @pixverse project link 👇 #H3onPixVerse #PixVerse #HeroVerse
all of the recent proc gen art, video editing and 3d game demos recently have made me update towards LLM coding models b...
AI 同时抹平了文字、绘画、音乐、视频、3D 乃至虚拟世界的生产门槛,把过去属于少数专业创作者的表现能力大规模发给普通人。当画面、文字、声音、角色甚至世界本身都不再稀缺,艺术竞争将从“谁做得更好”转向“谁能提出一种以前不存在的表达”。AI 真正应催生的,是一种今天还没有名字、甚至不知该如何欣赏的新艺术形态。
@shanghaidaily i will respect the most dogass animation done by humans than the most polished animation done by ai
Couldn't resist the temptation to create this Music using Lyra 3.0 Pro on @PixVerse_ CLI Video using @Hailuo_AI H3 on Ha...
I've been reading Bethany Hughes book on the 7 Wonders & the myths of the Colossus of Rhodes (eg it did not span the har...
荣耀终端产品线总裁方飞称,Robot Phone 不是简单“给手机加云台”,而是对 AI 时代手机新物种的探索,团队用大半年将想法做成可交付产品。该机于 8 月 12 日发布,定价 9,999 元起,搭载第五代骁龙 8 至尊版与端侧大模型 YOYO,并与 ARRI 合作影像技术。方飞认为,未来手机将从“应用的容器”走向“智能体的舞台”。
NVIDIA 研究副总裁刘明宇(Ming-Yu Liu)做客播客,深入解析 Cosmos 系列世界模型,重点谈及近期发布的 Cosmos 3、面向物理世界的 AI 及 NVIDIA 的竞争与技术趋势判断。他常以东方智慧类比技术,如用《孙子兵法》思考世界模型路线,并分享个人习武与冰浴习惯。
OpenAI CEO 奥尔特曼在 2026 年 Internapalooza 活动上表示,未来 6 个月内 OpenAI 后续 AI 模型将具备“完美理解用户使用情境”功能,可“读懂”用户屏幕、录制会议和通话,并全面了解用户生活。用户可划定 AI 访问范围,AI 不会替用户直接决策,而是充当助手角色,协助处理信息量庞大的日常工作。奥尔特曼称,距离这种能力真正变得“极其有用”可能只差 1 代模型。
《Clinical Imaging》一项针对215名乳腺影像学会成员的调查显示,约半数已在用FDA批准的AI工具,另有11%计划采用,但仅少数人视其为决定性因素。实际效果低于预期:仅35%报告召回率降低(59%曾预期)、9%看到不必要活检减少(36%曾预期)、29%感到倦怠减轻(56%曾预期)。成本与机构支持不足是主要障碍。
The new Huberman Lab episode is out: Using AI to Increase Your Intelligence & Enrich Humanity | Dr. Fei-Fei Li (@drfeife...
ZHO 发推称,看到大量低质量 AI 图/文/视频/应用铺满物理与网络世界后,修正此前观点:自 2026 开始,AI 发展将带领人们进入文化上的“大垃圾时代”。其引用自己早前推文,借 Adolf Loos 百年前“装饰即罪恶”之说,类比 AI 时代将进入“大装饰时代”,并指生产力提升与物质丰富伴随而来的是大量垃圾的产生及处理问题。
AI 时代的快速进步让我猛的理解 Adolf Loos 在百年前提出 “装饰即罪恶/装饰是文化的倒退” 的愤怒,虽然我在很长的时间里曾一度反对这个观点 我想,自 2026 开始,AI 的发展会带领人们进入一种文化上的“大装饰时代” 2026...
MIT 研究人员与合作者发现,医疗领域的 AI 可解释性工具效果因使用者而异。在皮肤病诊断中,非专家借助 AI 辅助提升了准确率,但提升主要源于对模型的依赖;初级保健医生则表现出不同的使用模式。
Qwen 3.8 Max is actually impressive Sent a sky pic to it along with Claude Opus 5, Kimi K3, and GPT 5.6 Sol, and asked t...
字节跳动年中全员会上,CEO梁汝波公开承认大语言模型与海外领先差距被拉大,但明确继续自研、接受短期落后,并驳斥“因外部压力才自研”是瞎猜,称是为打牢技术地基。豆包被升格为公司级“主干”,飞书产品团队并入豆包,GTM与火山引擎整合成立“创造力服务平台”。会上披露飞书新增客户超九成同步采购AI产品,内部AI Token半年增长超十倍。
另有 2 家信源报道IT之家(RSS)X:阿易 AI Notes (@AYi_AInotes)面壁智能开源模型 MiniCPM-o 4.5 被开发者 LYi 打造成纯本地桌面 AI 助手,可看、可听、自然对话,用于学习、解题或日常聊天。该项目展示了开源多模态模型结合工程化后,无需联网即可成为桌面伴侣的可能性。
我做了一个纯本地的 AI 贾维斯! 陪玩、上课,干啥都行!
阿里巴巴 Qwen3.8 发布视频公开挑战美国,展示模型在国产新芯片上连续工作 12 小时,强调中国已具备自主算力与顶尖智能。视频中蛋白质画面暗指 AlphaFold,表明中国不再受制于美国。若美国放缓 AI 模型研发节奏,将正中中国下怀。
Meet Qwen3.8-Max: A New Bar for Coding and Cowork.
Fender CEO Edward “Bud” Cole 在 T3 采访中称翻唱歌曲和乐队成员是“模拟 AI”,并认为 AI 将帮助吉他手成为创作大师。该言论在 Fender 因向制琴师发停止函而陷入公关危机后再度发酵,遭音乐人反驳:人类学习翻唱与 AI 训练数据规模不可比,且依赖 AI 可能导致技能退化。
一位开发者用GPT 5.6 Sol、GPT Image 2.0和TripoAI,通过vibe coding构建了3D人体解剖应用,将总资源从约900MB优化至28.6MB,单个模型从120-150MB降至2-5.5MB,帧率从16fps提升。整个过程仅靠与AI对话完成,无需专业团队,展示了工具民主化对教育内容的冲击。
Only if education could be this interactive ❤️🔥 I've had a looong wish to build something genuinely useful through vibe...
Andrej Karpathy 用 1M token 预算(约 $10)让 Opus 5 根据《指环王》首段生成 Three.js 渲染,模型耗时约 2 小时写出 5500 行代码,程序化呈现故事。他认为这类“没人会手动做”的定制内容正变得近乎免费,并指出世界/游戏领域暴露了 LLM 的弱点:无法高效原生感知视频或游玩游戏,Opus 5 只能缓慢截图自查且多次出错。
另有 1 家信源报道IT之家(RSS)Thinking Machines 发布首个模型 Inkling,为 975B-A41B 多模态 MoE,支持文本、图像和音频输入,并推出 276B-A12B 小版本。
Karpathy 提出用《指环王》首段测试 LLM 长程生成能力:给 Opus 5 100 万 token 预算(约 $10),它耗时约 2 小时写出 5500 行 Three.js 代码,程序化渲染整个故事。该测试考验模型跨数千行代码的连贯性与自我审查能力,但暴露了 LLM 无法高效感知视频或游戏内反馈的短板。
We're starting to leave the territory where you'd test an LLM by e.g. "create an svg of pelican on a bicycle". As one id...
Karpathy 给 Claude Opus 5 一段《魔戒》开篇、100 万 token 预算(约 10 美元),两小时后模型写出 5500 行 Three.js 代码,程序化生成了一个可运行的夏尔 3D 场景。他认为这标志着测试范式从“画个 SVG”转向长时程、高复杂度任务,也暴露了 LLM 无法高效感知视频或进入游戏自我审计的短板。
We're starting to leave the territory where you'd test an LLM by e.g. "create an svg of pelican on a bicycle". As one id...
Andrej Karpathy 给 Opus 5 提供《指环王》第一段和 1M token 预算(约 $10),模型耗时约 2 小时写出 5500 行代码,程序化渲染出故事场景。他认为这展示了从“没人会做”到“几乎免费”的转变,并指出 LLM 在视频感知和游戏内审计能力上仍有明显短板。
另有 1 家信源报道IT之家(RSS)BestBlogs 早报精选 10 条 AI 动态:MiniMax H3 发布,统一文本、图像、视频与声音处理,可输出原生双声道 15 秒 2K 视频;OpenAI Astra 内部版本在数学与理论计算机科学的 10 个问题上取得新突破,成本约 2000 美元。另有长时程智能体训练瓶颈、GPU 算力效率优化及大模型 API 降价 80% 等深度分析。
http://x.com/i/article/2083699403760840704
洛杉矶说唱歌手 Fenix Flexin 的单曲“Rubberz”登上 Billboard Hot 100 第 58 位,但被多方质疑主要由 AI 生成。音频中多处出现 AI 生成音乐的典型伪影,封面和歌词被多个 AI 检测器以超 97% 置信度标记为 AI 产物,现场表演也疑似对口型。Fenix 否认指控,但未提供有力反驳。
另有 1 家信源报道IT之家(RSS)Runway 的实时交互数字人系统 Characters 入选 SIGGRAPH 2026 的 Real-Time Live! 环节,团队在现场用一张照片数秒内生成可对话的角色。该系统从单张图片出发,无需微调即可适配任意风格,逐帧生成画面以支持长达 30 分钟以上的连续对话。Characters 于今年 3 月上线,团队正探索可导航环境、多参考图像及记忆功能等后续方向。
MiniMax H3: Omni-Reference, Commercial-Grade Generation, Unbeatable Cost Efficiency, Open Weights http://x.com/i/article...
每个时代都会催生独特的设计语言,AI时代也不例外。文章指出,AI界面催生了流式文本、闪烁文字(表示“思考”或异步任务)、小图标、米色奶油色搭配橙色点缀等美学特征,其中部分正从AI应用扩散至更广泛的软件交互设计。作者以Claude、Codex、Cursor等桌面AI应用与macOS原生应用对比,展示AI应用图标更小更细的现象,并探讨这些设计模式能否像汉堡菜单一样成为长期范式。
可灵AI推出Creator Off Script最新一期,聚焦韩国创作者Daon_box。他利用可灵AI生成猫咪Daon的冒险故事,自年初起全球播放量超20M。可灵AI帮助保持角色一致性、输出原生4K细节,并赋予创作者更强的画面控制力。