文章专栏

📝 从零开始学AI

深入浅出,从零开始看懂 AI

22 篇 AI
从最新一篇开始
简介

用通俗易懂的语言,从零开始解读 AI 技术趋势。

文章列表 共 22 篇
022 Google 发布 TimesFM-3:多变量零样本预测,九条指数实测能兑现几成 先讲官方新闻和模型特点,再实测其中三个——能测的用数据说话,没测到的只谈理论
021 Jev 上下文压缩解剖:把 LLM 摘要换成不说话的判断模型 逐行拆开 fast-jev-compaction 的七步流水线、八级缩身阶梯和三级决策瀑布
020 用大白话读完 MiMo-V2.6 技术报告:小米是怎么把 RL「练大」的 不堆公式——1568 个人一起做题、换着教室上课、判卷老师更较真,外加两条保险丝
019 小米发布并开源MiMo-V2.6:Pro成最强开源模型,价格维持不变 6天Live RL训练、AA指数46分,同等智能下价格为海外模型的1/20到1/60
018 Qwen3.8-Omni-Flash上线:原生全模态Agent,百万Token输入0.8元 29项评测平均提升超25%,44分钟视频定位6秒,已上架阿里云百炼
017 达摩院DAMO RADAR登Science:一次CT识别146种病症 覆盖18个器官、AUC达0.913,准确率超过26名医生中的23名,现已开源
016 Einsia发布AgentGit:开源Agent会话协作平台支持交接与复用 会话可保存分享交接,团队共用同一Session并支持6款Agent工具
015 TypeSafe发布Jev:放弃文本生成的判断模型 速度快20到200倍,成本最低到四百分之一,赌的是校准概率
014 小米MiMo-V2.6强化学习直播页解读:手把手看懂训练仪表盘 从双跑账单到18张指标图,覆盖奖励曲线与任务组成
013 9月16日AI日报:Gemini 3.8 Live、Vidu S2与StepAudio 3发布 语音视频模型、翻译开源、小企业工作流与榜单实测,4组13条
012 Meta字节蒸馏研究:小模型换字节学习,上限高出4个百分点 以Llama 3-8B为教师,End-Of-Token字节蒸馏预测准确率达52.4%
011 智谱再融335亿元:六成押注下一代GLM完全自训练 配售加零息可转债净募约393亿港元,上市八个月累计募资约755亿港元
010 Dario Amodei 呼吁为前沿 AI 减速:嵌入式评估与三步计划 递归式自我改进加速与 OAI-HF 事件之后,Anthropic 提出用时间换安全的 pacing 框架
009 9月12日AI日报:Anthropic威胁报告、RubyGems遭攻击与英伟达百亿投资传闻 安全、融资、模型与工程,4组9条
008 Xiaomi MiMo Desktop 开放邀测:桌面 Agent 押注交付成果与 Smart 调度 多格式输入、可交互预览、局部修改,MiMo-X 双 Preview 模型限时免费体验
007 9月6日AI日报:Astra全面推送、Code Arena登顶与wiki事件披露 模型推送、榜单开源、行业安全与实测用法,4组9条
006 9月5日AI日报:Astra开放上线、Anthropic IPO与费马大定理形式化证明 模型上线、产品发布、行业动态、论文研究与观点分析,5组12条
005 GPT-6 Astra 发布:OpenAI 最强模型几乎考满分,还更懂分寸 98% 的 FrontierMath、99.9% 的 ARC-AGI-3、100% 的 ExploitBench——但最值得看的是“不该做的事坚决不做”
004 WorkBuddy 开放平台上线:腾讯想做 Agent 时代的「操作系统」 3月上线、50次迭代、100家伙伴入局——9款硬件与30个行业应用同步亮相
003 Claude Fable 5.1 发布:最强编程模型又变强了,价格还便宜了 45% 同一个模型,两种形态——Fable 面向所有人,Mythos 专门给科学家和安全专家
002 边看、边听、边说:SeedRealtime 把 AI 从「应答」带进「实时世界」 一个端到端模型,如何同时看见你的画面、听懂你的话、把准开口的时机
001 「听得懂比听得清更重要」腾讯混元 Hy ASR 3.0 preview,让语音识别开始"理解上下文" 从逐字转写到理解语境,语音识别的新范式来了