博客

  • 乐事薯片四格创意涂鸦广告插画

    乐事薯片四格创意涂鸦广告插画

    乐事薯片四格创意涂鸦广告插画



    🤖 ChatGPT

    🇨🇳 中文提示词

    Create a premium 2x2 grid advertising artwork for Lay’s potato chips, one single image divided into four equal panels, all in the same clean conceptual style. The overall poster should feel witty, fresh, playful, highly designed, and visually interactive, with strong art-direction and collectible ad-poster quality.
    
    Core visual language:
    minimal warm off-white paper-texture background, lots of clean negative space, refined black-and-white hand-drawn doodle illustration, combined with realistic colorful Lay’s potato chip packaging and golden chips as the only strong color highlights. The mood is smart, humorous, light, graphic, and premium.
    
    Layout:
    a clean 2x2 composition, four square panels, evenly aligned, thin subtle spacing between panels, unified visual rhythm, same art style across all four scenes, like a campaign series presented in one page. Keep the image neat, balanced, and high-end.
    
    Product:
    Use iconic realistic Lay’s potato chips bag packaging as the hero object in every panel. The bag should look authentic, glossy, premium, instantly recognizable, with strong realistic volume, shadows, highlights, and crisp brand identity. Prefer classic bright yellow Lay’s pack as the main hero, or use a harmonious family of Lay’s colors if needed, but keep the campaign unified and clean.
    
    Each of the four panels should show a different playful interaction between the real Lay’s bag / chips and the black doodle world:
    
    Panel 1:
    The Lay’s chip bag acts as a hot air balloon basket, floating upward. Hand-drawn doodle balloon canopy above, clouds, tiny birds, airflow lines, cheerful adventure icons. Golden potato chips fly around like wind-blown leaves.
    
    Panel 2:
    The Lay’s bag becomes a skateboard or surf ramp. Black line doodle characters slide across curved chips as if they are skate ramps or waves. Motion lines, stars, mini flags, playful action symbols. Strong sense of movement and energy.
    
    Panel 3:
    The Lay’s bag works as a music speaker or party amplifier. Doodle sound waves, dancing lines, tiny music notes, happy mini figures, chips bouncing outward like rhythm beats. The composition feels lively and punchy but still visually clean.
    
    Panel 4:
    The Lay’s bag becomes a doorway or portal into a doodle snack universe. Hand-drawn swirls, stars, floating chips, tiny ladders, adventurous mini people, playful arrows, and whimsical snack symbols emerging from the bag opening. The scene should feel imaginative and delightful.
    
    Art direction:
    The hand-drawn doodles must be elegant, controlled, witty, and compositionally smart, not childish scribbles. Use clean black ink lines, refined cartoon minimalism, soft humor, and subtle visual storytelling. The real product should interact directly with the doodles so the scene feels cleverly integrated, not pasted on top. Every panel should have one clear visual joke or interaction.
    
    Chips:
    Golden Lay’s potato chips should appear in all four panels as supporting heroes, realistic, crisp, lightly salted, appetizing, floating or interacting with the doodle world. Some chips can act like suns, wheels, stepping stones, surfboards, or flying objects, but all ideas must remain clean and readable.
    
    Typography:
    Add minimal but artistic campaign typography, clean and modern, integrated into the overall layout, not large messy headlines. Use a stylish mix of English and Chinese, with refined spacing and ad-design elegance. Suggested text:
    “Lay’s”
    “Crunch Into Fun”
    “One Bag, Four Adventures”
    Chinese text:
    “乐事薯片”
    “一口开启趣味”
    “四格同频快乐”
    “脆趣正在发生”
    Typography should feel editorial, light, premium, and balanced with the visuals. Avoid crude heavy fonts.
    
    Overall feel:
    clean commercial illustration poster, conceptual packaging ad, modern minimal layout, clever visual interaction, witty and bright, premium campaign board, playful but sophisticated, high-end brand presentation, warm paper background, realistic product photography mixed with black ink doodle art, strong negative space, strong composition, 8k, hyper-detailed, unique, memorable.
    
    Negative prompt:
    messy layout, cluttered background, low detail, childish doodles, cheap design, distorted packaging, blurry logo, too many objects, overdecorated poster, dark background, random colors, weak interaction, flat composition, generic snack ad, unreadable text, extra products, low-end illustration
  • 商场时尚撞衫趣事自拍

    商场时尚撞衫趣事自拍

    商场时尚撞衫趣事自拍



    🤖 ChatGPT

    🇺🇸 English Prompt

    Ultra-realistic cinematic smartphone selfie. Beautiful young woman in an oversized off-shoulder cream knit sweater, denim shorts, white sneakers, and a small crossbody bag, soft Korean glam makeup.
    Inside a modern mall clothing store, happily posing beside another girl wearing the exact same outfit like a fashion twin. Both lean shoulder-to-shoulder making double peace signs with bright smiles.
    Large red "50% OFF" sign above them, polished floor, warm store lighting, blurred shoppers in the background. One employee facepalms while another hides laughter, and a shopper secretly records the moment.
    Smartphone camera UI visible, HDR, realistic skin, slight wide-angle distortion, photorealistic, cinematic, 8K.
    Negative: anime, CGI, blur, bad anatomy, extra fingers, watermark, logo.

    🇨🇳 中文提示词

    超写实电影感智能手机自拍。一位美丽的年轻女性,穿着一件超大号露肩米色针织毛衣、牛仔短裤、白色运动鞋和一个小斜挎包,画着柔和的韩式魅力妆容。在一家现代商场服装店内,快乐地站在另一位穿着完全相同服装的女孩旁边合影,就像时尚双胞胎。两人肩并肩靠在一起,带着灿烂的笑容做出双比耶手势。她们上方有一个巨大的红色“50% OFF”标志,抛光地板,温暖的店面灯光,背景中有模糊的购物者。一名员工捂脸,而另一名员工在偷笑,还有一名购物者在偷偷记录这一时刻。可见智能手机摄像头界面,HDR,真实皮肤,轻微广角畸变,写实,电影感,8K。负面:动漫,CGI,模糊,不良解剖结构,多余的手指,水印,标志。
  • ZARA高端时尚杂志封面排版提示词

    ZARA高端时尚杂志封面排版提示词

    ZARA高端时尚杂志封面排版提示词



    🤖 ChatGPT

    🇺🇸 English Prompt

    SYSTEM ROLE
    
    You are the Global Fashion Creative Director for ZARA.
    
    Your task is to create a premium EDITORIAL SOCIAL MEDIA CAMPAIGN that looks like a luxury magazine cover.
    
    Every design should feel collectible.
    
    Every composition should feel intentional.
    
    Every typography element should become architecture.
    
    Reject:
    
    generic fashion ads
    
    catalog photography
    
    influencer aesthetics
    
    busy graphic design
    
    cheap luxury
    
    AI-generated fashion clichés
    
    CAMPAIGN
    
    Platform
    
    Format
    
    4:5 Vertical
    
    Resolution
    
    8K
    
    Editorial Commercial Photography
    
    CREATIVE DIRECTION
    
    The campaign should look like:
    
    Vogue Italia Cover
    
    Harper's Bazaar Editorial
    
    Zara Studio
    
    Mango Campaign
    
    COS Lookbook
    
    Luxury print magazine
    
    The image should stop users while scrolling because it looks like editorial publishing rather than advertising.
    
    HERO MODEL
    
    One elegant fashion model.
    
    Age 22–30.
    
    Natural beauty.
    
    Relaxed expression.
    
    Confident posture.
    
    Minimal makeup.
    
    Soft skin texture.
    
    Luxury hair styling.
    
    No exaggerated pose.
    
    Walking naturally toward camera.
    
    Movement in garments.
    
    Luxury confidence.
    
    Wardrobe:
    
    Current season Zara collection.
    
    Perfect tailoring.
    
    Visible premium textile texture.
    
    Luxury leather accessories.
    
    Minimal jewellery.
    
    LOCATION
    
    Minimal architectural environment.
    
    Warm ivory seamless wall
    
    Travertine stone
    
    Concrete architecture
    
    Museum gallery
    
    Luxury villa
    
    Large window daylight
    
    Minimal furniture
    
    Architectural shadows
    
    Nothing distracting.
    
    Environment supports typography.
    
    EDITORIAL TYPOGRAPHY
    
    Typography is NOT decoration.
    
    Typography IS architecture.
    
    Create one enormous editorial word behind the model.
    
    Examples:
    
    ZARA
    
    MODERN
    
    FORM
    
    STUDIO
    
    AUTUMN
    
    The typography occupies approximately 55% of the canvas.
    
    Large luxury serif.
    
    Letters extend beyond frame.
    
    Letters partially hidden behind model.
    
    Natural overlap.
    
    Editorial kerning.
    
    Luxury spacing.
    
    Magazine quality.
    
    LAYOUT SYSTEM
    
    TOP LEFT
    
    ZARA logo
    
    TOP RIGHT
    
    Season
    
    Collection code
    
    Vertical text
    
    CENTER
    
    Model
    
    Oversized typography
    
    Luxury negative space
    
    LEFT PANEL
    
    Campaign headline
    
    Editorial copy
    
    Short description
    
    BOTTOM LEFT
    
    Luxury CTA
    
    SHOP NOW →
    
    Minimal button
    
    BOTTOM CENTER
    
    Collection navigation
    
    NEW ARRIVALS
    
    TAILORED
    
    ESSENTIALS
    
    LIMITED DROP
    
    ONLINE EXCLUSIVE
    
    BOTTOM RIGHT
    
    Collection information panel
    
    Collection Name
    
    Season
    
    Limited Drop
    
    Website
    
    Everything aligned to Swiss Grid.
    
    GRAPHIC DESIGN
    
    Luxury editorial layout.
    
    Swiss Grid.
    
    Perfect alignment.
    
    Large negative space.
    
    Editorial hierarchy.
    
    Magazine proportions.
    
    No decorative graphics.
    
    No stickers.
    
    No icons.
    
    No gradients.
    
    No unnecessary lines.
    
    Everything feels printed.
    
    COLOR SYSTEM
    
    Primary
    
    Black
    
    Warm White
    
    Ivory
    
    Stone
    
    Secondary
    
    Taupe
    
    Concrete Grey
    
    Soft Sand
    
    Accent
    
    Natural leather brown
    
    Muted olive
    
    No saturated colours.
    
    No bright fashion palette.
    
    LIGHTING
    
    Natural luxury daylight.
    
    Large soft window light.
    
    Museum lighting.
    
    Soft directional shadows.
    
    Beautiful textile highlights.
    
    No flash.
    
    No HDR.
    
    CAMERA
    
    Phase One XF IQ4 150MP
    
    Schneider Kreuznach 80mm
    
    Medium format realism
    
    Editorial framing
    
    Eye level
    
    Luxury textile detail
    
    Natural depth of field
    
    TEXTURE
    
    Visible linen weave
    
    Cotton fibres
    
    Leather grain
    
    Natural skin pores
    
    Travertine texture
    
    Soft matte finish
    
    Museum-quality realism
    
    COLOR GRADING
    
    Luxury editorial grading.
    
    Cream highlights.
    
    Soft blacks.
    
    Neutral skin.
    
    Matte finish.
    
    Subtle film grain.
    
    Premium magazine colour science.
    
    NEGATIVE PROMPT
    
    NO influencer pose
    
    NO smiling at camera
    
    NO fashion runway
    
    NO luxury cars
    
    NO city skyline
    
    NO neon
    
    NO glowing effects
    
    NO oversaturated colours
    
    NO AI artifacts
    
    NO floating graphics
    
    NO random shapes
    
    NO catalogue composition
    
    NO excessive props
    
    NO plastic skin
    
    NO fake fabric
    
    QUALITY BAR
    
    Baron & Baron typography
    
    Fabien Baron art direction
    
    Vogue Italia editorial

    🇨🇳 中文提示词

    系统角色
    
    你是ZARA的全球时尚创意总监。
    
    你的任务是创建一个高级编辑社交媒体活动(EDITORIAL SOCIAL MEDIA CAMPAIGN),看起来像奢侈杂志封面。
    
    每一个设计都应该具有收藏价值。
    
    每一个构图都应该是有意为之。
    
    每一个排版元素都应该成为建筑。
    
    拒绝:
    
    平庸的时尚广告
    
    目录摄影
    
    网红审美
    
    繁杂的平面设计
    
    廉价的奢华
    
    AI生成的时尚陈词滥调
    
    活动
    
    平台
    
    格式
    
    4:5 垂直
    
    分辨率
    
    8K
    
    编辑商业摄影
    
    创意方向
    
    该活动看起来应该像:
    
    Vogue Italia 封面
    
    Harper's Bazaar 社论
    
    Zara Studio
    
    Mango 活动
    
    COS Lookbook
    
    奢侈印刷杂志
    
    该图像应该能让用户在滚动时停下来,因为它看起来更像是编辑出版物而非广告。
    
    核心模特
    
    一位优雅的时尚模特。
    
    年龄 22–30 岁。
    
    自然美。
    
    放松的表情。
    
    自信的姿势。
    
    极简妆容。
    
    柔软的皮肤质感。
    
    奢华的发型设计。
    
    没有夸张的姿势。
    
    自然地走向镜头。
    
    服装中的动态感。
    
    奢华的自信。
    
    衣橱:
    
    ZARA 当季系列。
    
    完美剪裁。
    
    可见的高级纺织品质感。
    
    奢华皮革配饰。
    
    极简珠宝。
    
    地点
    
    极简建筑环境。
    
    暖象牙色无缝墙
    
    洞石
    
    混凝土建筑
    
    博物馆画廊
    
    豪华别墅
    
    大窗户自然光
    
    极简家具
    
    建筑阴影
    
    没有任何分散注意力的东西。
    
    环境支持排版。
    
    编辑排版
    
    排版不是装饰。
    
    排版即建筑。
    
    在模特身后创建一个巨大的编辑单词。
    
    示例:
    
    ZARA
    
    MODERN
    
    FORM
    
    STUDIO
    
    AUTUMN
    
    排版占据约 55% 的画布。
    
    大型奢侈衬线体。
    
    字母延伸至画框外。
    
    字母部分隐藏在模特身后。
    
    自然重叠。
    
    编辑级字间距。
    
    奢侈间距。
    
    杂志品质。
    
    布局系统
    
    左上角
    
    ZARA 标志
    
    右上角
    
    季节
    
    系列代码
    
    垂直文字
    
    中心
    
    模特
    
    超大排版
    
    奢华负空间
    
    左侧面板
    
    活动标题
    
    编辑文案
    
    简短描述
    
    左下角
    
    奢侈行动呼吁
    
    立即购物 →
    
    极简按钮
    
    底部中心
    
    系列导航
    
    新品 (NEW ARRIVALS)
    
    剪裁 (TAILORED)
    
    基础款 (ESSENTIALS)
    
    限量发售 (LIMITED DROP)
    
    在线独家 (ONLINE EXCLUSIVE)
    
    右下角
    
    系列信息面板
    
    系列名称
    
    季节
    
    限量发售
    
    网站
    
    一切都遵循瑞士网格(Swiss Grid)对齐。
    
    平面设计
    
    奢华编辑布局。
    
    瑞士网格。
    
    完美对齐。
    
    大面积负空间。
    
    编辑层级。
    
    杂志比例。
    
    无装饰性图形。
    
    无贴纸。
    
    无图标。
    
    无渐变。
    
    无不必要的线条。
    
    一切都感觉像是印刷出来的。
    
    颜色系统
    
    主色
    
    黑色
    
    暖白色
    
    象牙色
    
    石头色
    
    次色
    
    灰褐色
    
    混凝土灰
    
    柔沙色
    
    点缀色
    
    自然皮革棕
    
    柔和橄榄绿
    
    无高饱和颜色。
    
    无鲜艳的时尚调色盘。
    
    光照
    
    自然的奢华日光。
    
    大面积柔和窗光。
    
    博物馆照明。
    
    柔和的方向性阴影。
    
    美丽的纺织品高光。
    
    无闪光灯。
    
    无 HDR。
    
    相机
    
    Phase One XF IQ4 150MP
    
    Schneider Kreuznach 80mm
    
    中画幅真实感
    
    编辑级构图
    
    眼平高度
    
    奢侈纺织品细节
    
    自然景深
    
    纹理
    
    可见的亚麻编织
    
    棉纤维
    
    皮革纹理
    
    自然皮肤毛孔
    
    洞石纹理
    
    柔和哑光质感
    
    博物馆级真实感
    
    调色
    
    奢侈编辑级调色。
    
    奶油色高光。
    
    柔和的黑色。
    
    中性肤色。
    
    哑光质感。
    
    细微胶片颗粒。
    
    高级杂志色彩科学。
    
    负向提示词
    
    无网红姿势
    
    无对着镜头微笑
    
    无时尚 T 台
    
    无豪华汽车
    
    无城市天际线
    
    无霓虹灯
    
    无发光效果
    
    无过饱和颜色
    
    无 AI 人工痕迹
    
    无悬浮图形
    
    无随机形状
    
    无目录构图
    
    无过多的道具
    
    无塑料感皮肤
    
    无假面料
    
    质量基准
    
    Baron & Baron 排版
    
    Fabien Baron 艺术指导
    
    Vogue Italia 编辑级
  • 2004年袖珍数码相机风低视角城市肖像

    2004年袖珍数码相机风低视角城市肖像

    2004年袖珍数码相机风低视角城市肖像



    🤖 ChatGPT

    🇺🇸 English Prompt

    A cinematic, low-angle urban portrait taken with a cheap 2004 pocket digital camera, forced flash off. A young Japanese woman stands on a paved sidewalk next to a road. She has long, straight dark hair and a slightly amused, playful expression, with one hand raised near her mouth, fingers lightly touching her lips as if hiding a smile. The other hand holds the handle of a small black bag. She wears a crisp white short-sleeved button-up shirt with a small black graphic on the chest, a brown and black plaid mini skirt, black crew socks, and black chunky loafers. Tattoos are visible on her right arm. The camera angle is very low, looking up at her from the ground, making her figure appear tall and commanding. Behind her is a low concrete wall with a metal frame window structure, a long black asphalt road with white lane markings, and a tall metal communication tower in the background. The sky is dramatic and moody, filled with textured, swirling clouds in shades of deep teal, steel grey, and faded blue. A bright, distinct white contrail cuts diagonally across the sky. The color palette is desaturated and cinematic, dominated by cool teal, muted grey, stark white, and deep black. Soft, diffused overcast lighting. Realistic skin texture, visible pores, a faint natural shine on her forehead, no beauty filter. Heavy grain, slight chromatic aberration, sickly greenish-yellow tint. A stray cat tail peeks from behind the concrete wall at the bottom left corner.
    dutch angle, stray cat tail --ar 9:16

    🇨🇳 中文提示词

    一幅电影感的、低角度的城市肖像,用一部便宜的2004年袖珍数字相机拍摄,强制关闭闪光灯。一名年轻的日本女性站在马路旁的铺装人行道上。她留着长直黑发,表情带着一丝调侃和俏皮,一只手抬起靠近嘴边,手指轻轻触碰嘴唇,仿佛在掩饰笑意。另一只手拿着一个小黑包的提手。她穿着一件干净的白色短袖衬衫,胸口有一个黑色的小图案,一条棕黑格纹超短裙,黑色圆领袜,以及黑色厚底乐福鞋。右臂上有可见的纹身。相机角度非常低,从地面向上看她,使她的身材显得高大且具有威慑力。在她身后是一堵低矮的混凝土墙,墙上有金属框架窗户结构,一条带有白色车道线的长长的黑色沥青路,背景中有一座高大的金属通讯塔。天空充满戏剧性且阴沉,布满了深青色、钢灰色和褪色蓝色的纹理感漩涡云。一道明亮、清晰的白色凝结尾迹对角线穿过天空。色调饱和度较低且具有电影感,以冷青色、柔和的灰色、纯白色和深黑色为主。柔和、扩散的阴天光线。真实的皮肤纹理,可见毛孔,额头上带有微弱的自然光泽,无美颜滤镜。重颗粒,轻微色差,病态的绿黄色调。在左下角混凝土墙后露出一截流浪猫尾巴。
    荷兰角,流浪猫尾巴 --ar 9:16
  • Zvec:阿里开源轻量级进程内向量数据库,一行 pip install 搞定十亿级向量检索

    Zvec:阿里开源轻量级进程内向量数据库,一行 pip install 搞定十亿级向量检索

    📌 项目简介

    Zvec 是阿里巴巴开源的轻量级进程内向量数据库(In-process Vector Database)——无需启动独立服务,直接嵌入你的应用代码中运行。它以闪电般的速度完成数十亿级向量的相似性搜索,同时支持密集向量、稀疏向量、混合检索和全文搜索,是构建 RAG 应用、AI Agent 记忆系统和语义搜索引擎的理想底层引擎。

    经过阿里巴巴集团内部生产环境验证,Zvec 在保持极简部署的同时提供了企业级的低延迟和高吞吐能力。

    ⚙️ 安装要求和过程

    环境要求

    • 操作系统:Linux(x86_64 / ARM64)、macOS(ARM64)、Windows(x86_64)
    • Python 版本:3.10 ~ 3.14(pip 安装方式)
    • Node.js / Go / Rust / Dart:均有官方 SDK 支持

    快速安装(Python)

    # 一行命令安装
    pip install zvec
    
    # 验证安装
    python -c "import zvec; print('Zvec OK')"

    一分钟上手示例

    import zvec
    
    # 定义集合 Schema
    schema = zvec.CollectionSchema(
        name="example",
        vectors=zvec.VectorSchema("embedding", zvec.DataType.VECTOR_FP32, 4),
    )
    
    # 创建集合
    collection = zvec.create_and_open(path="./zvec_example", schema=schema)
    
    # 插入文档
    collection.insert([
        zvec.Doc(id="doc_1", vectors={"embedding": [0.1, 0.2, 0.3, 0.4]}),
        zvec.Doc(id="doc_2", vectors={"embedding": [0.2, 0.3, 0.4, 0.1]}),
    ])
    
    # 向量相似度搜索
    results = collection.query(
        zvec.Query(field_name="embedding", vector=[0.4, 0.3, 0.3, 0.1]),
        topk=10
    )
    print(results)

    📦 其他语言 SDK

    • Node.jsnpm install @zvec/zvec
    • Rustzvec-rust
    • Gozvec-go
    • Dart/Flutterflutter pub add zvec

    🔥 核心功能

    1. 极速检索 —— 十亿级向量毫秒级响应
      基于 HNSW 等高效索引算法,在数十亿向量规模下仍能实现毫秒级延迟的相似度搜索。
    2. 密集 + 稀疏向量双模态支持
      同时支持 Dense Vector(浮点密集向量)和 Sparse Vector(稀疏向量),适配不同 Embedding 模型输出格式。
    3. 原生全文搜索(FTS)
      v0.5.0 新增!可为任意字符串字段附加 FTS 索引,支持自然语言或结构化表达式查询,无需外部搜索引擎。
    4. 混合检索(Hybrid Search)
      单次 MultiQuery 融合向量相似度、全文搜索、标量过滤和多维度排序,返回精确结果。
    5. DiskANN 磁盘索引
      v0.5.0 新增!将大部分索引数据放在磁盘上,大幅降低大规模数据集的内存占用。
    6. 持久化存储(WAL 日志)
      Write-Ahead Logging 保证崩溃安全——即使进程异常退出或断电,数据也绝不丢失。
    7. 多语言生态 + 可视化工具
      官方提供 Python / Node.js / Go / Rust / Dart 五种 SDK,另有 Zvec Studio 图形化管理工具。

    💡 典型使用场景

    场景一:RAG 检索增强生成系统

    将文档切片后的 Embedding 向量存入 Zvec,用户提问时先做语义检索召回相关片段,再送入 LLM 生成回答。Zvec 的本地化特性意味着零网络延迟、零外部依赖,特别适合隐私敏感的企业 RAG 场景。

    场景二:AI Agent 长期记忆

    为 AI Agent 构建持久化的记忆库——将用户交互、偏好、历史决策编码为向量存入 Zvec,Agent 启动时自动加载记忆上下文。WAL 持久化确保记忆永不丢失,混合检索支持按时间、主题、情感等多维度精准回忆。

    场景三:边缘设备 / 本地优先语义搜索

    作为进程内库嵌入到笔记本 App、IoT 设备或 CLI 工具中,实现离线语义搜索能力。无服务端依赖资源占用极小,支持 ARM64 和 RISC-V 架构,从云端到边缘全覆盖。

    ✨ 推荐理由

    用过不少向量数据库后,Zvec 的设计哲学让我印象深刻:“Just Works”——不需要配置服务器、不需要 Docker、不需要外部依赖。一个 pip install zvec 就能开始使用。

    对比同类方案:

    特性 Zvec 传统向量数据库
    部署方式 一行 pip install 独立服务 + 配置集群
    外部依赖 零依赖 Redis/Elasticsearch 等
    全文搜索 内置 FTS 需额外集成 ES
    混合检索 原生支持 需自行编排
    适用场景 RAG / Agent / 本地应用 大规模分布式检索

    v0.5.0 更是加入了全文搜索 + DiskANN + 多语言 SDK三大重磅功能,让 Zvec 从一个纯粹的向量数据库进化为全能型本地搜索引擎。对于正在搭建 RAG 系统、AI Agent 或需要本地语义搜索能力的开发者来说,Zvec 是目前最值得尝试的选择之一。

    🔗 下载地址

  • 纽约时报等出版商要求制裁OpenAI:指控其隐瞒训练证据

    纽约时报与 OpenAI 版权诉讼概念图
    新闻业与 AI 公司的版权博弈(配图由 AI 生成)

    这起打了快三年的版权官司,这两天又升级了。纽约时报、每日新闻等多家媒体在 7 月 9 日向曼哈顿联邦法院提交了一份动议,要求法官对 OpenAI 处以制裁。理由很重:它们指控 OpenAI 在诉讼过程中隐瞒、甚至销毁了能说明 ChatGPT 怎么用新闻内容训练的证据。

    这份 52 页的文件写得很直白。出版商们说,OpenAI「选择了阻挠」——明明手里有训练数据集和 ChatGPT 的输出日志,却迟迟不交出来,而这些材料恰恰能显示 AI 系统到底怎么用了受版权保护的新闻内容。原告方要求法官就「证据开示不当」惩罚这家公司,理由是这种行为可能扭曲了整起案件的关键证据。

    「这份动议是请法院惩罚 OpenAI 隐藏并销毁证据,证明 ChatGPT 是怎么用偷来的新闻业内容训练出来的。」——每日新闻代理律师 Steven Lieberman

    「两年都在做不实陈述」

    出版商这边的核心指控是:OpenAI 两年来一直「做不实陈述」,说自己没法在训练数据集和日志里检索受版权保护的内容。这个说辞是直到今年 2 月,OpenAI 隐私工程负责人 Vinnie Monaco 第二次作证时才被戳破的——证词显示,OpenAI 其实早就已经检索过训练数据集和输出数据,和公司最初的表态完全矛盾。原告还指控 OpenAI 删除了部分日志,这违反了法院的证据保全命令。

    纽约时报的主辩律师、Susman Godfrey 律师事务所的 Crosby 说得更不客气:「OpenAI 对纽约时报、每日新闻的原告方、公众和法庭都撒了谎。它声称检索 ChatGPT 输出里有没有我们的内容,是做不到、太麻烦、又侵犯用户隐私的——可同时它又藏着不说,自己早就这么干过了。」

    OpenAI 的回击:我们在保护用户隐私

    OpenAI 没有认下这些指控。公司发言人 Drew Pusateri 把这形容为原告在案件走弱之后的纠缠:「随着时报的案子变弱、还被迫撤回了对我们的部分索赔,他们仍在坚持侵犯与本案无关的人的隐私,包括用这些明显虚假的指控。」他强调,OpenAI 会继续捍卫用户隐私,以及「合理使用」(fair use)这条早就立住的法律原则。

    这里头的张力很清楚:出版商想要看训练数据,OpenAI 说那会泄露用户隐私。而「合理使用」正是整场官司的命门——OpenAI 和一大批科技公司都主张,拿网上的书、文章去训练 AI 受版权法里的「合理使用」保护,这个理论正在几十起诉讼里被反复检验,结果好坏参半。


    这场拉锯的代价不低。纽约时报光是在和 AI 公司打官司上就已经花了超过 2800 万美元,光今年第一季度就烧了 420 万。有意思的是,一边在法庭上互撕,一边又有越来越多媒体跟 OpenAI、谷歌、Meta 签了授权协议——通常是收一笔钱,换对方用自己的新闻库训练 AI。新闻业正卡在一个尴尬的位置:既想守住自己的内容,又舍不得 AI 带来的那张支票。这场制裁之争不管怎么判,都很可能给整个行业的未来定调。

  • Meta的自研AI芯片要量产了:9月上线,想少给英伟达交「算力税」

    Meta 自研 AI 训练芯片概念图
    Meta 自研 AI 训练芯片 MTIA 概念图(配图由 AI 生成)

    Meta 最近被路透社爆出一个消息:他们最新一代的自研 AI 芯片,最快今年 9 月就要开始量产了。这事听起来挺技术宅的,但背后其实是 Meta 在算一笔很现实的账——它不想再被英伟达的 GPU 价格卡着脖子。

    据路透社看到的内部备忘录,至少有一款芯片用大约六周时间就顺利走完了测试阶段。Meta 找了博通(Broadcom)一起做芯片设计,真正代工交给台积电。配套的存储和零部件也铺开了:内存买三星的,存储用闪迪(Sandisk),光纤设备来自住友电工。换句话说,一颗芯片背后,是一整条被重新梳理过的供应链。

    「每一代 MTIA 都建立在上一代之上,用模块化小芯片、更短的迭代节奏,跟上 AI 需求的快速变化。」——Meta 官方谈自研芯片路线

    一颗芯片背后的千亿赌注

    这套芯片属于 Meta 的 MTIA 项目(Meta Training and Inference Accelerator,训练与推理加速器)。Meta 今年 3 月专门介绍过这四颗新芯片,走的「模块化小芯片」路线——说白了就是把芯片拆成一个个乐高块,哪块不够用了就换哪块,好跟上 AI 需求几个月一变的速度。

    Meta 为什么这么急?最直接的原因是钱。在 GPU 严重短缺的当口,向英伟达和 AMD 买算力越来越贵。自研芯片能帮它省下一部分采购开支,尤其是用来跑推荐算法、排序,以及给自家 App 做推理。当然,Meta 也明确说了,该花的钱还是得花,和英伟达、AMD 的合作不会断。

    这件事有个时间背景:Meta 今年 4 月给出的资本开支指引是 1250 亿到 1450 亿美元,大头都砸在 AI 上。为了给新的 Muse Spark 系列模型备好算力和电力,它在全球签了一堆数据中心和供电协议,光今年就要部署 7 吉瓦的算力,明年还要翻倍。从 2023 年开始,Meta 就在自己搞 AI 芯片了,现在算是把这条路走到了量产节点。

    不是 Meta 一家在「去英伟达化」

    其实不止 Meta 一个人在这么干。大家都想在同一个目标上少被英伟达抽成:把最贵的那部分算力,握在自己手里。看看这一圈玩家就明白了:

    • OpenAI 上个月刚公布了和博通合作的自研推理芯片;
    • Anthropic 据传也在和三星谈自研芯片;
    • 亚马逊有 Trainium,谷歌有 TPU,都是自家用的 AI 芯片;
    • 再加上一堆初创公司,全都在抢同一块「自己造 AI 芯片」的蛋糕。

    对 Meta 来说,自研芯片量产是个里程碑,但也只是开始。芯片造出来能不能真正撑起训练任务、能不能比买英伟达更划算,还得等真刀真枪跑起来才知道。不过有一点是确定的:当最烧钱的几家 AI 公司都开始自己造「发动机」,算力这门生意的玩法,已经悄悄变了。

  • Character.AI 杀进微短剧:你不仅能看,还能跟剧里的 AI 角色聊上两句

    Character.AI 用 AI 角色制作的微短剧
    Character.AI 用 AI 角色拍起了微短剧,观众还能进到剧情里

    微短剧今年火到什么程度?几乎所有盯着「用户注意力」这门生意的公司都在做——专门的微短剧 App 不用说,TikTok、Instagram 在弄,Peacock、Amazon Prime、印度的 JioHotstar 也都下场了。现在,做 AI 角色聊天的 Character.AI 也挤了进来,而且它玩了个别人还真复制不了的花活。

    首发三部剧,关键在「你能跟角色聊」

    Character.AI 给自己做的微短剧起了个名字叫 c.ai Series,先用 AI 生产工具做了三部:爱情向的《Last Summer》、恐怖向的《The Nighttime Game》,还有一部类似《饥饿游戏》的生存剧《Eden Fall》。

    真正有意思的是它的那个 twist。Character.AI 的老本行就是让用户跟定制的 AI 角色聊天,所以它顺手把这个能力接进了剧里:18 岁以上的观众,能直接跟剧里的角色对话、提问,甚至换个剧情线去角色扮演。看剧,变成了「进到剧里」。

    「先用工作室模式把格式打磨好、把流程理顺、摸清楚观众到底想要什么,往后目标是把这些经验和工作流变成创作工具,让用户用自己原创的角色做系列剧,分享给全球观众。」—— Character.AI 发言人

    从聊天工具到「娱乐公司」,它去年就开始转了

    这已经是它去年把重心转向娱乐之后,一连串新功能里的最新一步。今年 4 月,它先抛出一个叫 Lorebook 的工具,让用户给角色写世界观设定;接着又推了 Books,能让你把自己塞进经典文学里,或者扮演书里的角色。

    它还在测两样东西:一个叫 c.ai FM,让你拼音频剧;另一个叫 c.ai Reads,用来写小说。音频剧目前放在实验项目 c.ai Labs 里,给一部分用户和职业作家做连载广播剧用。


    观众是真的愿意泡在里面

    Sensor Tower 的数据说,2026 年上半年,用户平均每个月要在 Character.AI 上花 950 多分钟。微短剧本来就靠「几秒一个钩子、爽点密」吃饭,现在再叠上一层能对话的 AI 角色,等于把观众从「看客」直接拉成了「参与者」。

    这事儿能不能跑通、观众会不会看腻,现在谁也不敢下定论。但把「看剧」变成「进剧」这个方向,大概率就是 AI 娱乐接下来要长的样子。

  • Ollama 又融了 6500 万美元:让开发者在自己电脑上跑大模型,这门生意成了

    在个人电脑上运行开源大模型的 Ollama
    在个人电脑上跑开源大模型,Ollama 想做成 AI 时代的「Docker」

    Ollama 这家公司的名字,做 AI 开发的人基本都听过,圈外知道的不多。最近它宣布完成 6500 万美元的 B 轮融资,领投方是 Theory Ventures。加上之前 Benchmark 的 Peter Fenton 领投的 1500 万 A 轮,这家公司前后总共融了 8800 万美元。

    从 Docker 出来的团队,给 AI 干了件类似的事

    Ollama 在 2023 年上线,做的事情其实很朴素:让开发者在自己的电脑上,几分钟就把开源大模型跑起来。它在 GitHub 上攒了 17.6 万颗 star、将近 1.7 万个 fork,被无数教程、视频和博客拿来当范例。

    创始人 Jeff Morgan 和 Michael Chiang 之前都在 Docker 干过,做过 Docker Desktop,后来公司被 Docker 收购。所以 Ollama 对 AI 模型干的事,基本就是 Docker 当年对云计算干的事——把那些麻烦的硬件配置、环境差异全给你屏蔽掉,开发者只管跑。

    「2023 年开源模型就出来了,但那时候真的很难用,都是给研究人员准备的,不是给程序员用的。想把它们跑起来特别费劲。」Morgan 说。

    近 900 万月活,团队却只有 14 个人

    上线三年,Ollama 现在每个月有 890 万开发者在用,85% 的财富 500 强公司都在用,而背后撑起这一切的团队,只有 14 个人。它能长到这么快,靠的就是「在本地电脑上更顺手地搭 AI」这件事本身的需求。

    商业模式上,桌面免费版一点没变,赚钱靠的是云端订阅,从免费到每月 100 美元分几档,按 GPU 时长而不是 token 计费。那些太大、在自己电脑上跑不动的开源模型,Ollama 就帮你在它的云上找算力跑。

    企业开始认真考虑「用便宜的,留贵的」

    Morgan 把 Ollama 真正像个生意跑起来,归因于今年 1 月 OpenClaw 爆火。那之后,开源模型突然能做 agentic 任务了,比如写代码,企业开始认真琢磨:是不是能把日常活儿交给更便宜的开源模型,只在必要时才掏钱用 Anthropic 那种闭源模型。

    Fenton 的观点是,开源和闭源不是二选一,两边都有的赚。但他也点出一个现实:凡是推理成本高、也就是用模型烧钱烧得狠的公司,都有一股「生存级」的动力往开源权重模型上搬。


    免费的还免费,但「开发工具堕落」的骂声已经有了

    不是所有粉丝都买账。大概一年前,就有一批博客和论坛帖子吐槽 Ollama 的云服务,说它把精力从心爱的免费项目上挪走,把这股风气叫「开发工具的 enshittification(逐渐变烂)」。

    Morgan 不这么看,他说云端是开源使命的延伸——那些顶尖的大模型你自家电脑跑不动,「那我们就帮你把算力找来」。Fenton 也补了一句:桌面上的免费核心产品,前提一点没变,该发现模型、该跑本地模型,还是那个地方。

    不管争议怎么走,Ollama 都算是 AI 催生出来的那一拨「开源项目长成公司」里的最新样本。和它差不多的还有做推理的 Inferact(vLLM)、RadixArk(SGLang),以及从零训自己开源模型的 Arcee。AI 这波浪潮,正在把一批本来免费的工具,一点点变成正经生意。

  • claude-video:让 Claude 真正“看懂”视频的 /watch 技能,6.4K Stars 把视频变成 AI 能读的输入

    claude-video:让 Claude 真正“看懂”视频的 /watch 技能,6.4K Stars 把视频变成 AI 能读的输入

    📌 项目简介

    claude-video 是一个让 Claude(以及 Codex、Cursor、Gemini CLI 等 50+ AI 编程工具)真正”看懂”视频的开源 Agent Skill。它的核心理念只有一句话:Claude 能读网页、能读 PDF、能读代码仓库,但默认它看不了视频——而 claude-video 把”看视频”这件事补上了。你丢给它一个 YouTube 链接或本地视频,它自动下载、抽帧、转写音频,再把画面帧 + 时间戳字幕一起喂给大模型,让 AI 基于真实视听觉内容来回答,而不是靠标题瞎猜。

    🛠 安装要求和过程

    环境要求:

    • Python 3.10+(核心脚本 watch.py / download.py / frames.py / transcribe.py 均为 Python 实现)
    • yt-dlp:负责从 YouTube、Loom、TikTok、X、Instagram 等站点下载视频(首次运行 macOS 上自动 brew 安装,Linux/Windows 会打印安装命令)
    • ffmpeg:负责抽帧、音频提取(同上,首次运行自动引导安装)
    • 带字幕的视频完全免费;无字幕时才需要 Whisper API Key(Groq whisper-large-v3 或 OpenAI whisper-1

    快速安装(三选一):

    方式一 · Claude Code(推荐):

    /plugin marketplace add bradautomates/claude-video
    /plugin install watch@claude-video

    方式二 · 任意 Agent Skills 宿主(Codex / Cursor / Copilot / Gemini CLI 等 50+ 工具):

    npx skills add bradautomates/claude-video -g

    方式三 · 手动 / 开发:

    git clone https://github.com/bradautomates/claude-video.git
    ln -s "$(pwd)/claude-video/skills/watch" ~/.claude/skills/watch
    # 或 ~/.codex/skills/watch

    首次运行会调用 scripts/setup.py --check 引导安装依赖,并在 ~/.config/watch/.env 中生成 GROQ_API_KEY / OPENAI_API_KEY 占位配置。

    ⚡ 核心功能

    1. 多源视频获取:支持 URL(yt-dlp 兼容的几乎所有视频站点)或本地路径(.mp4/.mov/.mkv/.webm),一条命令即可接入。
    2. 智能帧提取:用 ffmpeg 按细节模式抽帧——efficient(关键帧,约 0.5s)到 token-burner(场景切换检测);内置帧去重(默认开启,丢弃近重复帧)与自动 fps / token 预算控制。
    3. 双通道转写:优先用 yt-dlp 提取原生字幕(免费);无字幕时回退 Whisper API,并支持 >25MB 自动分块,确保长视频也能完整转写。
    4. 多模态交给大模型:脚本输出带 t=MM:SS 标记的帧路径 + 时间戳转写,Claude 并行 Read 图像,基于真实画面与声音作答。
    5. 细节模式可调节:--detail transcript|efficient|balanced|token-burner 权衡速度与 token 成本;支持 --start/--end 聚焦片段、--timestamps 指定时刻、--no-whisper 等精细控制。

    🎯 典型使用场景

    • 拆解爆款内容:把竞品发布会、广告片、干货视频丢给它,让它分析钩子结构、叙事节奏、真正的新功能,远快于 2x 倍速硬看。
    • 看录屏诊断 Bug:前端同学把屏幕录制喂给它,它能定位”出错的那一帧”,描述现象与可能原因,把视频变成可调试的输入。
    • 视频转结构化笔记:把一整个播放列表逐条摘要,自动构建可搜索的知识库;或剥离更新视频里的 hype,只提取”真正变了什么”。

    💡 推荐理由(个人使用心得)

    这是个”小而准”的工具,解决的痛点非常真实——我们天天让 AI 读文档读代码,但遇到一个视频链接就瞬间退化成”靠标题猜”。claude-video 最漂亮的设计是零配置起步:有字幕就白嫖字幕,没字幕才花一点点 Whisper 钱;帧去重 + 预算控制又避免了”把整个视频塞进上下文”的 token 爆炸。它本质上是在给 LLM 补上一双眼睛,而且是以”可复用技能包”的形式存在,Claude Code / Cursor / Codex 通吃。如果你经常需要让 AI 处理视频内容,这个 6.4K Star、MIT 协议、纯 Python 的小项目,值得一键装进你的工具箱。

    🔗 下载地址

    • GitHub:github.com/bradautomates/claude-video
    • 安装(Claude Code):/plugin marketplace add bradautomates/claude-video/plugin install watch@claude-video
    • 许可证:MIT(可自由商用、修改、分发)