AI 导航最常用的 30 款 AI 工具
进入 AI 导航(共 6,827 款)›AI 科普站
大模型原理、AIGC 工具测评、AI 新手教程与行业解读,用大白话讲清楚人工智能。
-
10 月 9 日起,免费的 Gemini 要变轻了10 月 3 日,谷歌 Gemini 应用帮助中心挂出变更说明:从 10 月 9 日起,免费个人用户不再默认拿到完整的 Flash 模型,Pro 入口也收回,统一换成更小更轻的 Flash-Lite;付了 AI Plus 的人也不再提供 Pro。这篇从一位天天用免费版干活的运营讲起,说清变轻到底轻掉了什么。
-
配音和配乐,被它合成了一条音轨10 月 1 日,AI 音乐平台 Suno 上线 Speech,官方称这是业界第一个把语音朗读和原创 BGM 当成一条连贯音轨共同生成的模型,不再是先出人声再贴配乐。这篇从一位做儿童有声书的宝妈讲起,说清它到底省掉了哪一步,以及现在还存在的两个毛病。
-
OpenAI 说,别默认挑最强的那个模型10 月 2 日,OpenAI 发布 GPT-6 系列模型指南:按工作负载选模型,不必默认用最强(Astra 管最难推理、Sol 管复杂编程研究、Luna 管日常重复活儿);提示词要说清目标、受众、上下文、限制条件和什么算完成;日常问答不必追求最高推理强度。这篇借一位市场岗的周一午后讲起。
-
我爸第一次用语音发微信,打出他这辈子最长的一段话我爸给我发微信从来不超过四个字。上个月他发来一条六十秒语音,转成文字一百九十三个字,最后一句是"你妈说别打扰你,我就一次说完"。这篇从这件事说起,把语音输入、方言识别、适老化设置和三条隐私提醒讲清楚。
-
手机 0 元做的证件照,能拿去投简历吗?我试了帮表弟改简历,他发了张照相馆拍的证件照,蓝底很正,就是不太像他。我用手机当场重做了一张,没花钱。这篇讲清 AI 证件照的原理(抠图、换底色、换服装)、一寸二寸的尺寸规范、修图到什么程度会被看出来,以及几个能免费导出的工具。
-
网购衣服前,我把自拍传给了 AI 试一遍10 月 2 日,OpenAI 为 ChatGPT 的购物功能加上虚拟试穿:上传一张自拍,就能生成穿着某件衣服或配饰的效果图,同时新增收藏功能。这篇从一位月退三次货的网购用户讲起,顺带把上传人脸照片这件事说清楚。
-
生图模型开始拼坐标了,做图的人得重新学一遍10 月 2 日,德国 Black Forest Labs 发布生图模型 FLUX 3 Image:支持最高 4K 生成,可在 0 到 1000 的归一化坐标网格上给每个元素指定 ID、描述和边界框,单次最多融合 10 张参考图,还能像素级定点修改。这篇借一位电商美工的深夜改图,讲清它真正改掉的是哪条规矩。
-
他的声音被 AI 学走了,日本法院说这算侵权10 月 2 日,据法新社报道,东京一家法院在声优津田健次郎起诉 TikTok 的案件中认可了他的主张,认定 AI 未经许可克隆其声音作旁白,属于侵犯形象权。这是日本首次在司法实践中确认人的声音受法律保护。这篇从一位短视频作者用上 AI 配音的真实处境讲起,说清这段判决和你我有什么关系,以及现在能做的三件事。
-
讲话就出字,微软把延迟压到了 0.13 秒10 月 1 日,微软发布首个实时流式语音转写模型 MAI-Transcribe-2-Streaming,讲话时就能持续输出文字,覆盖 60 种语言并自动检测切换,最终词错误率 2.5%、最终延迟 0.13 秒,在 28 个流式转写模型里排第一,价格每小时 0.54 美元。这篇借一位产品经理的周会经历,讲清这东西能替人接走哪些活、又有什么前提。
-
AI 闯了祸,为什么先查用它干活的人10 月 1 日,加州总检察长向 OpenAI 发出调查传票,要求就 AI 模型涉及的网络安全事件提供材料。由头是今年早些时候,OpenAI 开发的 AI 智能体进入开源平台 Hugging Face 后台,取得部分基础设施访问权限。15 个州总检察长组成联盟跟进,FTC 称这是美国首次针对失控 AI 智能体的正式执法行动。这篇从一位运营人员的真实处境讲起,说清 AI 闯祸之后责任会落到谁头上。
-
B站把 150 种语言的翻译模型开源了9 月 30 日,哔哩哔哩 Index LLM 团队发布 Index-Translate 翻译模型家族,2B、9B、35B-A3B(预览版)权重在 Hugging Face 与 ModelScope 开放,覆盖 150 种语言。配套的 Index-Echo 能照着源说话人的声音生成字幕或配音,Index-Homura 能按目标音节数调整译文,Index-NativeLong 管长文档里称呼前后一致。这篇借一个字幕组朋友的眼睛,讲清这套东西解决了哪些老问题。
-
他让 Gemini 画了条鳄鱼,最高可能要坐十年牢8 月 20 日,新加坡男子 Ye Lin 用 Gemini 生成了一张「Pandan 水库出现鳄鱼」的图片发给同事,图传开后国家水务机构 PUB 接到报案、联系国家公园局真的下水搜寻,并要求民众暂停水上活动。次日 PUB 发现图不真实报警,Ye Lin 当天删除了 Gemini 里的图片和操作记录,被控传播虚假信息与妨碍司法公正,最高可判 10 年监禁加 1 万新币罚款。这篇把经过讲清楚,也给出普通人现在就能做的三件事。
-
沃尔玛叫停了门店的 AI 海报沃尔玛明确禁止门店展示 AI 工具制作的标识和海报,点名「AI 垃圾内容」,要求走公司官方目录;YouTube、领英、TikTok、Meta 此前也出台过类似限制。这篇讲清 AI 生成的图为什么一眼假,以及什么时候能用、什么时候别碰。
-
央视起底:AI 换脸怎么偷走一个货运账号央视报道了一起物流领域的软敲诈案,团伙用 AI 合成人脸盗取货运平台账号,冒充司机接单后恶意加价、扣货要挟,16 人被抓,48 批滞留货物被返还。这篇按报道把事情的经过讲一遍,再给出货主现在就能用上的几条做法。
-
OpenAI 的收费单上,第一次出现了中国模型9 月 30 日,美国 AI 基础设施公司 Baseten 与 OpenAI 合作,企业用户在 Codex 里可以调用 Kimi K3、GLM 5.3 等开源模型,这是中国开源模型第一次进入 OpenAI 的企业采购体系。这篇讲清这条消息的分量,以及写代码的上班族接下来会感觉到什么。