Introducing Magnitude: your actually local agent 100% private and offline. No token costs, no API keys. Open source. Tod...
Introducing Magnitude: your actually local agent 100% private and offline. No token costs, no API keys. Open source. Tod...
AMD 收购加拿大 AI 芯片初创公司 Taalas,后者将模型架构与训练参数直接嵌入芯片,推理速度极快但每颗芯片锁定单一模型。其演示芯片运行 Llama 3.1-8B 时,每用户每秒处理超 16,000 tokens,远超竞品。AMD 计划将该技术纳入加速器路线图,与 Instinct GPU 作为系统级方案共同提供,交易尚待监管批准。
另有 3 家信源报道Hacker News 热门(buzzing.cc 中文翻译)X:Emad Mostaque (@EMostaque)IT之家(RSS)🚀 Ling-3.0-tiny from @AntLingAGI is now available via Novita on @openrouter. 🎁 Free through August 13. 7.9B MoE · 1.3B...
More intelligence with less compute? We're in 😎 Try Ling-3.0-tiny in Kilo today. Totally FREE for a limited time.
华为 HarmonyOS 开发者官方今日分享 HarmonyOS SDK 游戏新特性,包括 AI 超分、控显分离、硬件光追等。此前 HarmonyOS SDK 26 已带来游戏秒启秒开功能,升级 HarmonyOS 7 开发者/花粉 Beta 版系统的设备已实装该特性,并支持《原神》《洛克王国》等游戏极速启动。
小米澎湃 HyperOS 4 宣传页面曝光,自研内核新增负载精算、内存预载技术,并采用柔光玻璃材质与全新锁屏设计。系统支持同尺寸小部件堆叠、桌面文件夹最大 6*3 调整,全新融合设备中心支持设备置顶与多家庭切换。超级小爱新增专家模式,支持复杂任务深度思考与定时任务自动执行,另有 AI 笔记与智能输入法。
华硕显示器管理软件 ASUS DisplayWidget Center 迎来重大更新,加入 AI 智能体功能,用户可在不使用 OSD 的情况下,直接用自然语言调整显示器亮度、色温、色彩模式、刷新率等参数。该软件支持命令行接口(CLI)和 Agent Skill,可接入各种 AI 智能体;IT 管理员还可通过 Microsoft Intune 等平台统一部署,一次性调整多台显示器设置。
Run Ling 3.0 Flash locally 🌀 We released GGUF quants on Hugging Face, from lossless BF16 to 1-bit, plus NVFP4! AD-Q5_K_...
面壁智能 CEO 李大海在 APEC 专题研讨会上发表演讲,称端侧 AI 已从“科幻”变为工业现实,可帮助亚太中小企业破解网络延迟、数据隐私与高昂成本三重壁垒。其端侧模型“面壁小钢炮”总下载量突破 4300 万次,全球开发者平台星标超 13 万;开源智能体操作系统 PilotDeck 支持常驻任务与端云协同,已与华为、三星、上汽等企业合作落地。
Liquid AI 发布 LFM2.5-2.6B,一款完全在端侧运行的智能体模型,总参数 2.69B,上下文窗口 131,072 token。该模型在 ToolSandbox、Multi-IF 和 IFStruct 等基准上超越 gemma-4-E4B-it 和 Qwen3.5-9B,在 M5 Max 上解码速度达 220 tokens/s。
小米智能摄像机 4 Max AI 变焦版今日开售,到手价 799 元(京东券后 739 元),大模型会员年费 349 元起。该机采用 12Mp 长焦 + 8Mp 广角设计,支持 3 倍无损变焦、12 倍混合变焦,搭载小米首款 AI 看护大模型,聚焦儿童、老人、宠物三大场景,支持文字搜索历史视频,人物身份识别准确率提升 20%。
Mesa 26.3 已合并 AMD GFX1171,并同步支持 RADV Vulkan 和 RadeonSI OpenGL 驱动。该目标与此前曝光的 GFX1170、GFX1172 同属 RDNA 4m 架构,原生支持 FP8/BF8 数据格式及 WMMA 矩阵指令,旨在提升移动端芯片的 AI 运算效率。
OpenAI 首款硬件设备将是无显示屏的 AI 优先计算机,外形类似甜甜圈、约冰球大小,便于单手在家中携带。设备内置扬声器、麦克风及可自主移动的部件以显示交互状态,电池供电,可手持或置于床头柜、厨房台面。据 Bloomberg,该设备售价 300-400 美元,并配备摄像头。
NEW: OpenAI's device - a human-like smart speaker - will look like a doughnut and be the size of a hockey puck. It meant...
Today, we're releasing Ling-3.0-tiny: 7.9B total parameters, with only 1.3B active per token. A native hybrid reasoning ...
DeepGrove 发布轻量 AI 模型 Maple-Preview,在 iPhone 上运行速度达 127 tokens/s,约为 Bonsai 27B 的 13 倍。该模型总参数量 202 亿,采用 MoE 架构,激活参数 14.9 亿,并提出“三值权重”方案降低内存占用。目前处于预览阶段,处理 131,000 tokens 时内存占用仅 7.69GB。
极趣发布 ZecTrix Note 4 黑白墨水屏“AI 便利贴”,淘宝定价 259 元。产品采用磁吸设计,配备 4.2 英寸 400x300 分辨率墨水屏,集成麦克风/扬声器与 AI 语音按钮,按下即可说话快速创建备忘录。内置 2000mAh 电池,续航至高 3 个月。
雷神水冷迷你 AI 工作站搭载 AMD 锐龙 AI Max+ 395 处理器,配备 128GB LPDDR5X 统一内存,可分配 96GB 用作显存,实测 CPU 峰值功耗达 176W。
LG电子正与韩国芯片设计企业合作,构建向本土Fabless企业开放的多层AIoT芯片平台,以降低开发成本,并与自家AI模型、软件组成完整AI家电堆栈。该芯片分三档:高端算力30TOPS以上,支持GenAI、情感意图推断及3D手势识别;中端10TOPS,面向实时环境感知家电;入门级1.5TOPS,支持唤醒词与能耗优化。
英伟达正加速进入电信运营商市场,在中国寻找基站厂商合作开发符合海外市场要求的 6G 基站,节奏“比较紧迫”,希望在 2027 或 2028 年进入试验网。深圳佳贤通信是合作方之一,双方已基于英伟达 CUDA 生态合作开发 6G AI-RAN 基站半年多。英伟达此前曾以 10 亿美元认购诺基亚新股,持股约 2.9%,并联合诺基亚、爱立信等提出以开放、软件定义和 AI 原生的平台建设 6G。
雷神科技今年 5 月发布的水冷迷你 AI 工作站迎来开箱图赏。该机搭载 AMD 锐龙 AI Max+ 395 处理器,最高 176W 性能释放,首发 26999 元。机身采用 199mm 正方体金属设计,重 6.5kg,内置 400W 12VO 白金电源,支持 Wi-Fi 7 与蓝牙 5.4,接口含双 USB4 Type-C 及 10G 有线网口。
阶跃星辰内部正按两条战略线推进:一条以大模型为核心,另一条以智能体终端为核心,手机业务已放入新公司独立运营。公司正搭建海外商业化团队,计划以语音模型为主向海外销售大模型 API,大模型与手机都将进入海外市场,两条业务线相互促进。此前其已发布终端品牌 STEPX 及首款智能体手机 STEPX Neo,搭载智能体原生系统 Step AOS。
中国科学院深圳先进技术研究院与清华大学团队提出非接触激光超声与 Transformer 结合方案,实现锂电池 SoC / SoH 高精度原位监测。该系统可将超声信号振幅提升 10 倍,信噪比达 30dB,对 SoC 平均误差低于 5.7%、SoH 低于 2.1%。研究基于 40 块商用电池、超 10 万个样本验证,成果发表于《Science Advances》。
开发者 @ratandeep 在 #BuildSmall 黑客松中用 MiniCPM5-1B 构建了 NIGHTWAVE,让该模型担任实时 AI 电台主持人,生成 DJ 风格脚本与音乐解说。项目展示了小语言模型在交互式 AI 应用中的潜力,相关 Demo 与模型已上线 HuggingFace。
MacPaw 与 Liquid AI 合作,为其产品引入本地托管 AI 模型,并计划将相关技术栈开放给开发者。MacPaw 正为其 AI 助手 Eney 开发本地版本,Liquid AI 将负责构建名为 Elix 的端侧推理系统和本地记忆系统。MacPaw 还计划在拥有超 15 万付费用户的 SetApp 应用商店中,以积分制模式支持更多 AI 应用。
华为今日宣布,乾崑智驾 ADS Pro V5.0 将支持园区领航辅助 NCA 功能,用户选定目标车位后,系统可辅助车辆从园区入口驶至车位并泊入。该功能已支持超 100 万个停车场,覆盖写字楼、商场、医院、小区等高频场景。此前发布的 ADS 5 引入了面向自动驾驶的 AI 智能体 WEWA 2.0 架构,且 ADS 4 升级至 ADS 5 对应版本无硬件限制。
小米第二代AI眼镜据报已完成开发,但因高管卢伟冰对设计不满、要求调整,发布可能推迟至2026年Q4甚至2027年。小米否认该报道,称信息不准确,拒绝透露实际开发进展。
Maple-Preview 是一款可在 iPhone 上运行的 ternary 20B MoE 模型,推理速度达 120 tok/s。该项目通过深度优化实现在移动端设备上的高效部署,相关代码与细节已在 deepgrove.ai 公开。
Major update from us @extropic Announcing Torx and Thermalizers, basically our version of PyTorch + kernels, but for The...
Liquid AI 发布开源智能体模型 LFM2.5-2.6B,仅 26 亿参数,可在智能手机等设备端本地部署,同时支持规划、调用、多步骤处理的智能体工作流。该模型在 34T Token 数据集上预训练,并扩展分词器以增强非拉丁字母语言支持,基础和后训练版本已在 Hugging Face 平台提供。
特斯拉 AI 负责人 Ashok Elluswamy 确认,公司目前没有计划恢复 FSD 的用户自定义最高速度功能,并称该设置属于一种“反模式”。自去年 FSD v14 发布后,特斯拉取消了该功能,转而采用从“Sloth”到“Mad Max”的五种“速度模式”,同时决定驾驶风格和速度。车主对此表示困惑,抱怨速度模式随更新变化大,且因 FSD 超速收到的罚单责任仍由车主承担。
通用汽车正开发一款全新车载 AI 智能助手,能力将超过已引入旗下车型的 Gemini AI。该助手结合对话式 AI、车辆知识及 OnStar 智能服务,能调用汽车传感器实时遥测数据,比 Gemini 更了解车辆状态、驾驶环境与用户需求。目前尚未公布具体发布时间,完成后仍需在完整车型阵容中测试以确保稳定性和安全性。
MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。
Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。
NewEyes 尝试从多模态 AI 中移除提示词,让摄像头本身成为触发机制:视觉感知识别潜在需求,持久记忆补充上下文,系统自行判断是否采取行动。该应用由 CollovLabs 推出,是首批由端侧多模态智能驱动的消费级 AI 应用之一,可主动实现所见即购、穿搭建议、房间设计、餐食计数及植物缺水提醒等功能。
What if your camera could... 🛍️ Shop what you see. 👗 Style what you wear. 🛋️ Design the room around you. 🍽️ Count th...
What if your camera could... 🛍️ Shop what you see. 👗 Style what you wear. 🛋️ Design the room around you. 🍽️ Count th...