Các lượt nộp
    Danh sách bài
    Trang chủ
    Báo lỗi

    solution

    Đề bài: [Data Science] Pipeline phân tích cửa hàng (eval + query @vars + multi-sort)

    Cho bảng store, region, revenue, cost, units. Pipeline: (1) eval profit = revenue - cost, margin = profit/revenue*100, rev_per_unit = revenue/units. (2) Tính median_rev = df['revenue'].median(). (3) query lọc: region in @regs AND margin > 20 AND units >= 50 AND revenue > @median_rev. (4) Sort: region asc, margin desc, profit desc. (5) Lấy top m bản ghi đầu tiên.

    • Định dạng đầu vào:

      Dòng 1: n. Dòng 2: m. Dòng 3: regions (dấu phẩy). n dòng: store,region,revenue,cost,units.

    • Ràng buộc đầu vào:

      1 <= n <= 200; 1 <= m <= n; units >= 1.

    • Định dạng đầu ra:

      Tối đa m dòng store region profit margin rev_per_unit (2 chữ số).

    Ví dụ:

    Đầu vào:

    6
    3
    N,S
    s1,N,1000.0,700.0,100
    s2,S,2000.0,1500.0,200
    s3,E,3000.0,1000.0,300
    s4,N,500.0,200.0,40
    s5,S,1500.0,900.0,150
    s6,N,1200.0,800.0,80
    

    Đầu ra:

    s5 S 600.00 40.00 10.00
    s2 S 500.00 25.00 10.00

    Giải thích:

    profit/margin/rev_per_unit: s1(300,30,10), s2(500,25,10), s3 loại E, s4(300,60,12.5) loại units<50, s5(600,40,10), s6(400,33.33,15). Median revenue=(1000+1200+1500+2000+...)... thực tế median của 6 giá trị 500,1000,1200,1500,2000,3000 = (1200+1500)/2=1350. Lọc rev>1350: s2,s5. Tất cả region N,S, margin>20, units>=50: s2(S,500,25,10), s5(S,600,40,10). Sort: N (none), S theo margin desc: s5, s2. Lấy top 3.

    Đang tải editor...